Ga naar inhoud
100% lokaal

LLM-contextcompressor

Verklein de geplakte tekst of code zodat het minder tokens kost voordat u deze naar een LLM stuurt.

Invoer
Uitvoer

LLM-contextcompressor

Plak code of proza die u op het punt staat naar een LLM te sturen en deze tool snijdt de onderdelen af die tokens kosten zonder veel betekenis te hebben, zodat een groter deel van uw contextbudget naar de inhoud gaat die het model daadwerkelijk nodig heeft. Het is gebouwd voor de dagelijkse klus van het plakken van een bestand, een logboek of een lang instructieblok in een chatvenster en het kijken naar de stijging van het aantal tokens.

Vier schakelaars bepalen wat wordt verwijderd. "Stripcodeopmerkingen" verwijdert // , # en -- regelopmerkingen plus /* */ blokkeeropmerkingen - handig als u bronbestanden plakt waarbij de opmerkingen voor mensen zijn, niet voor het model. Met "lege regels en volgspaties samenvouwen" wordt het aantal lege regels teruggebracht tot één en worden de spaties aan het einde van elke regel verwijderd. "Strip redundante inspringing" verwijdert de leidende witruimte die elke regel deelt, zodat een diep genest codeblok geplakt vanuit een editor geen tokens verspilt aan inspringing; het model hoeft geen structuur te reproduceren. 'Verwijder opvul-/stopwoorden in proza' is de meest agressieve optie: het verwijdert een lichtgewicht lijst met heggen en functiewoorden - heel, in principe, gewoon, soort van, om en dergelijke - uit gewone zinnen. Daarom staat het standaard uit en is het het beste gereserveerd voor proza in plaats van voor code.

De live telling onder de uitvoer toont karakters en een geschat aantal tokens ervoor en erna, plus het opgeslagen percentage, zodat u het effect van elke schakelaar kunt zien terwijl u deze omdraait. De tokenschatting is een ruwe, op karakters gebaseerde benadering (ongeveer vier tekens per token), en geen exacte telling van de tokenizer van een specifiek model - handig voor het beoordelen van relatieve besparingen, niet voor het bereiken van een exact budget.

Alles draait als platte tekst en regex-verwerking in uw browser: er is geen codeparser, geen AST, en niets dat u plakt, wordt ooit ergens geüpload. Dat maakt het veilig om privébroncode, interne documentatie of conceptprompts te gebruiken voordat deze uw machine verlaten.

FAQ

Zal dit veranderen wat mijn code doet?
De standaardschakelaars (opmerkingen verwijderen, lege regels samenvouwen, inspringen verwijderen) verwijderen alleen witruimte en commentaar, dus het gedrag van de code wordt niet beïnvloed. "Verwijder opvul-/stopwoorden" herschrijft proza en is niet bedoeld voor code. Laat het uit bij het plakken van bronbestanden.
Hoe nauwkeurig is het aantal tokens?
Het is een schatting gebaseerd op ongeveer vier tekens per token, een gebruikelijke vuistregel voor Engelse tekst. Verschillende modellen tokeniseren verschillend, dus behandel het getal als een leidraad voor relatieve besparingen, niet als een exacte telling.
Waarom is het verwijderen van commentaar soms verkeerd bij ongebruikelijke code?
De tool gebruikt gewone regex, geen taalparser, dus een `//` of `#` binnen een letterlijke tekenreeks kan af en toe worden aangezien voor een commentaarmarkering. Controleer de uitvoer voordat u de productiecode ergens anders plakt.
Kan ik het gebruiken op markdown of gewoon proza, niet alleen op code?
Ja. Schakel 'Code-opmerkingen verwijderen' uit als uw tekst # gebruikt voor markdown-kopteksten in plaats van opmerkingen, en schakel 'Verwijder opvul-/stopwoorden' in om hedging-taal uit proza te verwijderen.
Wordt mijn tekst ergens geüpload?
Nee. De compressie wordt volledig in uw browser uitgevoerd met behulp van gewone tekenreeksverwerking: uw tekst verlaat uw apparaat nooit.