Перейти к содержанию

Парсер журнала чата с искусственным интеллектом

Очищает вставленную расшифровку ChatGPT или Claude в аккуратный диалог между пользователем и ИИ.

Входные данные
Выходные данные

Парсер журнала чата с искусственным интеллектом

Копирование разговора из веб-интерфейса ChatGPT или Клода редко оказывается результативным. Наряду с реальным диалогом вы получаете надписи на кнопках, такие как «Копировать» и «Регенерировать», случайные метки времени и названия моделей, расположенные на отдельной строке — беспорядок, из-за которого стенограмму неудобно читать, делиться ею в службе поддержки или вставлять в документ. Этот инструмент удаляет интерфейсный шум и собирает то, что осталось, в четкий, чередующийся разговор.

Он распознает метки говорящего, которые обычно показывают эти инструменты — «Вы», «ChatGPT», «Клод», «Ассистент» и несколько общих эквивалентов — независимо от того, сидят ли они одни на линии или ведут прямо к первому предложению («Вы: как мне…»). Если вставка полностью потеряла свои метки, синтаксический анализатор возвращается к обработке каждого блока, разделенного пустой строкой, как одного хода и чередует пользователя и AI, начиная с пользователя, и именно так читается большинство транскриптов после исчезновения хрома. Короткие строки, предназначенные только для пользовательского интерфейса — «Копировать», «Копировать код», «Регенерировать», «Повторить», пустое время — удаляются перед выполнением любого прохода, поэтому они никогда не будут неправильно прочитаны как часть диалога.

По умолчанию вывод имеет вид Markdown — **User:** и **AI:** разделяются пустыми строками — и готовы для вставки в документ, сообщение в блоге или отчет об ошибке. Вместо этого при включении опции вывода JSON создается массив объектов \`{ role, content }\` в том же порядке, что полезно для подачи расшифровки в скрипт, набор оценочных данных или другой инструмент в конвейере.

Все работает в вашем браузере: вставка, анализ и форматирование происходят локально в JavaScript, а расшифровка никогда никуда не загружается и не отправляется.

FAQ

Как инструмент узнает, какие строки принадлежат пользователю, а какие — ИИ?
Он ищет распространенные ярлыки говорящих — «Вы», «ChatGPT», «Клод», «Ассистент» — на отдельной строке или после двоеточия, и начинает новое сообщение каждый раз, когда оно появляется. Если вставленный текст потерял свои метки, он возвращается к чередованию поворотов в каждой пустой строке, начиная с пользователя.
Что считается «шумом», который удаляется?
Короткие строки интерфейса, не являющиеся частью разговора — «Копировать», «Копировать код», «Повторить», «Повторить», «Поделиться», «Нравится» — и пустые временные метки, такие как «10:32», находящиеся отдельно в строке.
Как выглядит вывод JSON?
Массив объектов `{"role": "user" | "ai", "content": "…"}`, по одному за ход в порядке их появления — готовые для использования в сценарии, файле оценки JSONL или другом инструменте.
Загружен ли где-нибудь мой вставленный разговор?
Нет. Анализ выполняется полностью в вашем браузере; расшифровка никогда не покидает ваше устройство и не касается сервера.
Работает ли он с экспортом из инструментов чата AI, кроме ChatGPT или Claude?
Да, список меток также охватывает общие термины, такие как «Пользователь», «ИИ», «Помощник» и «Бот», а резервная пустая строка по-прежнему работает, когда инструмент использует метки, которые синтаксический анализатор не распознает, хотя необычный формат экспорта может впоследствии потребовать небольшой ручной очистки.