Vai al contenuto
100% locale

Compressore del contesto LLM

Riduci il testo o il codice incollato in modo che costi meno token prima di inviarlo a un LLM.

Ingresso
Uscita

Compressore del contesto LLM

Incolla il codice o la prosa che stai per inviare a un LLM e questo strumento elimina le parti che costano token senza avere molto significato, quindi una parte maggiore del budget del contesto va ai contenuti di cui il modello ha effettivamente bisogno. È progettato per il compito quotidiano di incollare un file, un registro o un lungo blocco di istruzioni in una finestra di chat e osservare l'aumento del conteggio dei token.

Quattro levette controllano ciò che viene rimosso. "Strip code comments" elimina i commenti // , # e -- line più i commenti /* */ block: utile quando si incollano file sorgente in cui i commenti sono per gli esseri umani, non per il modello. "Comprimi le righe vuote e gli spazi finali" riduce le serie di righe vuote a una e ritaglia gli spazi bianchi alla fine di ogni riga. "Elimina rientro ridondante" rimuove lo spazio bianco iniziale condiviso da ogni riga, quindi un blocco di codice profondamente annidato incollato da un editor non spreca token per il rientro di cui il modello non ha bisogno per riprodurre la struttura. "Rimuovi parole di riempimento/stop in prosa" è l'opzione più aggressiva: elimina un elenco leggero di siepi e parole funzionali - molto, fondamentalmente, giuste, in un certo senso, in ordine e simili - dalle frasi ordinarie, motivo per cui è disattivato per impostazione predefinita ed è meglio riservarlo alla prosa piuttosto che al codice.

Il conteggio in tempo reale sotto l'output mostra i caratteri e un conteggio stimato dei token prima e dopo, oltre alla percentuale salvata, in modo da poter vedere l'effetto di ogni interruttore mentre lo giri. La stima del token è un'approssimazione approssimativa basata sui caratteri (circa quattro caratteri per token), non un conteggio esatto dal tokenizzatore di un modello specifico, utile per giudicare il risparmio relativo, non per raggiungere un budget esatto.

Tutto funziona come testo semplice e elaborazione regex nel tuo browser: non esiste un parser di codice, nessun AST e nulla di ciò che incolli viene mai caricato da nessuna parte. Ciò rende sicuro l'esecuzione su codice sorgente privato, documentazione interna o bozze di prompt prima che lascino il computer.

FAQ

Questo cambierà ciò che fa il mio codice?
Le opzioni predefinite (rimozione commenti, compressione righe vuote, rimozione rientro) rimuovono solo spazi bianchi e commenti, quindi il comportamento del codice non viene influenzato. "Rimuovi parole di riempimento/stop" riscrive la prosa e non è pensato per il codice: lascialo disattivato quando incolli i file sorgente.
Quanto è accurato il conteggio dei token?
Si tratta di una stima basata su circa quattro caratteri per token, una regola pratica comune per il testo inglese. Modelli diversi tokenizzano in modo diverso, quindi considera il numero come una guida al risparmio relativo, non come un conteggio esatto.
Perché la rimozione dei commenti a volte è sbagliata su codice insolito?
Lo strumento utilizza una semplice regex, non un parser del linguaggio, quindi un `//` o `#` all'interno di una stringa letterale può occasionalmente essere scambiato per un indicatore di commento. Esamina l'output prima di incollare il codice di produzione altrove.
Posso usarlo su markdown o in semplice prosa, non solo sul codice?
SÌ. Disattiva "Rimuovi commenti sul codice" se il tuo testo utilizza # per le intestazioni markdown anziché per i commenti e attiva "Rimuovi parole di riempimento/stop" per eliminare il linguaggio di copertura dalla prosa.
Il mio testo è caricato da qualche parte?
No. La compressione viene eseguita interamente nel tuo browser utilizzando la semplice elaborazione delle stringhe: il tuo testo non lascia mai il tuo dispositivo.