Компрессор контекста LLM
Сократите вставленный текст или код, чтобы он стоил меньше жетонов, прежде чем отправлять его в LLM.
Компрессор контекста LLM
Вставьте код или текст, который вы собираетесь отправить в LLM, и этот инструмент обрежет части, которые стоят жетонов и не несут особого смысла, поэтому большая часть вашего контекстного бюджета уходит на контент, который действительно нужен модели. Он создан для повседневной работы по вставке файла, журнала или длинного блока инструкций в окно чата и наблюдения за увеличением количества токенов.
Четыре переключателя управляют тем, что удаляется. «Очистить комментарии кода» удаляет // , # и -- комментарии к строкам, а также блокирует комментарии /* */ — это удобно, когда вы вставляете исходные файлы, где комментарии предназначены для людей, а не для модели. «Свернуть пустые строки и конечные пробелы» сокращает количество пустых строк до одной и обрезает случайные пробелы в конце каждой строки. «Удалить избыточные отступы» удаляет ведущие пробелы, которые разделяют каждую строку, поэтому глубоко вложенный блок кода, вставленный из редактора, не тратит впустую токены на отступы, которые модели не нужны для воспроизведения структуры. «Удалить слова-заполнители/стоп-слова в прозе» — самый агрессивный вариант: он удаляет легкий список защитных и служебных слов — очень, по сути, просто, вроде, для того и подобных — из обычных предложений, поэтому по умолчанию он отключен и лучше всего используется для прозы, а не для кода.
Живой подсчет под выводом показывает символы и примерное количество токенов до и после, а также сохраненный процент, поэтому вы можете видеть эффект каждого переключения при его переключении. Оценка токена представляет собой приблизительную оценку на основе символов (около четырех символов на токен), а не точный подсчет токенизатора какой-либо конкретной модели. Это полезно для оценки относительной экономии, а не для достижения точного бюджета.
Все выполняется в вашем браузере как обычный текст и обработка регулярных выражений: нет ни анализатора кода, ни AST, и ничего, что вы вставляете, никогда никуда не загружается. Это позволяет безопасно запускать частный исходный код, внутреннюю документацию или черновики запросов до того, как они покинут ваш компьютер.