Ir para o conteúdo
Totalmente local

Compressor de contexto LLM

Reduza o texto ou código colado para que custe menos tokens antes de enviá-lo para um LLM.

Entrada
Saída

Compressor de contexto LLM

Cole o código ou a prosa que você está prestes a enviar para um LLM e essa ferramenta corta as partes que custam tokens sem ter muito significado, de modo que mais do seu orçamento de contexto vá para o conteúdo que o modelo realmente precisa. Ele foi desenvolvido para a tarefa diária de colar um arquivo, um log ou um longo bloco de instruções em uma janela de bate-papo e observar a contagem de tokens aumentar.

Quatro botões controlam o que é removido. "Retirar comentários de código" exclui // , # e -- comentários de linha mais /* */ bloquear comentários — útil quando você está colando arquivos de origem onde os comentários são para humanos, não para o modelo. "Recolher linhas em branco e espaços à direita" reduz as séries de linhas vazias para uma e corta os espaços em branco perdidos no final de cada linha. "Retirar o recuo redundante" remove o espaço em branco inicial que cada linha compartilha, de modo que um bloco de código profundamente aninhado colado de um editor não desperdiça tokens no recuo que o modelo não precisa para reproduzir a estrutura. "Remover palavras de preenchimento/paradas em prosa" é a opção mais agressiva: exclui uma lista leve de limites e palavras funcionais - muito, basicamente, justo, mais ou menos, em ordem e semelhantes - de frases comuns, e é por isso que está desativado por padrão e é melhor reservado para prosa do que para código.

A contagem ao vivo na saída mostra caracteres e uma contagem estimada de tokens antes e depois, além da porcentagem salva, para que você possa ver o efeito de cada alternância ao ativá-la. A estimativa do token é uma aproximação aproximada baseada em caracteres (cerca de quatro caracteres por token), não uma contagem exata do tokenizer de qualquer modelo específico – útil para avaliar economias relativas, não para atingir um orçamento exato.

Tudo roda como texto simples e regex no navegador: sem parser, sem AST, e nada do que você cola é enviado a lugar nenhum. Isso torna seguro processar código-fonte privado ou rascunhos de prompts antes de saírem da sua máquina.

FAQ

Isso mudará o que meu código faz?
As alternâncias padrão (retirar comentários, recolher linhas em branco, remover recuo) removem apenas espaços em branco e comentários, portanto, o comportamento do código não é afetado. "Remover palavras de preenchimento/paradas" reescreve a prosa e não se destina ao código - deixe-o desativado ao colar os arquivos de origem.
Quão precisa é a contagem de tokens?
É uma estimativa baseada em aproximadamente quatro caracteres por token, uma regra prática comum para textos em inglês. Diferentes modelos tokenizam de maneira diferente, portanto, trate o número como um guia para economias relativas, não como uma contagem exata.
Por que a remoção de comentários às vezes é errada em códigos incomuns?
A ferramenta usa regex simples, não um analisador de linguagem, portanto, um `//` ou `#` dentro de uma string literal pode ocasionalmente ser confundido com um marcador de comentário. Revise a saída antes de colar o código de produção em outro lugar.
Posso usá-lo em markdown ou em prosa simples, não apenas em código?
Sim. Desative "Retirar comentários de código" se o seu texto usar # para títulos markdown em vez de comentários, e ative "Remover palavras de preenchimento/paradas" para cortar a linguagem de cobertura da prosa.
Meu texto é carregado em algum lugar?
Não. A compactação é executada inteiramente no seu navegador usando processamento simples de strings — seu texto nunca sai do seu dispositivo.