Перейти до вмісту

Парсер журналу чату AI

Очищає вставлену транскрипцію ChatGPT або Claude у акуратне діалогове вікно користувача/AI.

Введення
Вихід

Парсер журналу чату AI

Копіювання розмови з веб-інтерфейсу ChatGPT або Claude рідко виходить чистим. Разом із фактичним діалогом ви отримуєте написи кнопок, як-от «Копіювати» та «Відновити», випадкові мітки часу та назви моделей, які стоять у окремому рядку — безлад, через який незручно читати стенограму, ділитися в заявці служби підтримки чи вставляти в документ. Цей інструмент видаляє цей шум інтерфейсу та збирає те, що залишилося, у чітку, чергуючу розмову.

Він розпізнає мітки доповідачів, які зазвичай показують ці інструменти — «Ви», «ChatGPT», «Клод», «Асистент» і кілька загальних еквівалентів — незалежно від того, чи сидять вони окремо на лінії, чи ведуть безпосередньо до першого речення («Ти: як я…»). Якщо вставлення повністю втратило свої мітки, синтаксичний аналізатор повертається до обробки кожного блоку, розділеного порожніми рядками, як один хід і чергує користувача та штучний інтелект, починаючи з користувача, саме так читається більшість транскриптів, коли Chrome зникає. Короткі рядки лише для інтерфейсу користувача — «Копіювати», «Копіювати код», «Відновити», «Повторити», «голий час» — видаляються перед виконанням будь-якого проходу, тому вони ніколи не зчитуються неправильно як частина діалогу.

За замовчуванням виводиться Markdown — **Користувач:** і **AI:** чергуються, розділені порожніми рядками — готові для вставлення в документ, публікацію блогу або звіт про помилку. Якщо натомість увімкнути опцію виводу JSON, буде створено масив об’єктів \`{ role, content }\` у тому самому порядку, корисний для подачі транскрипту в сценарій, набір даних eval або інший інструмент у конвеєрі.

Усе працює у вашому браузері: вставка, синтаксичний аналіз і форматування відбуваються локально в JavaScript, а стенограма ніколи не завантажується та не надсилається нікуди.

FAQ

Як інструмент дізнається, які рядки є користувачем, а які ШІ?
Він шукає загальні мітки доповідачів — «Ви», «ChatGPT», «Клод», «Асистент» — у окремому рядку або після двокрапки та починає нове повідомлення щоразу, коли воно з’являється. Якщо вставлений текст втратив свої мітки, він повертається до чергування кожного порожнього рядка, починаючи з користувача.
Що вважається "шумом", який видаляється?
Короткі рядки інтерфейсу, які не є частиною розмови — «Копіювати», «Копіювати код», «Згенерувати повторно», «Повторити спробу», «Поділитися», «Подобається» — і голі мітки часу, такі як «10:32 ранку», які стоять окремо в рядку.
Як виглядає вихід JSON?
Масив об’єктів, `{"роль": "користувач" | "ai", "content": "…"}`, по одному на хід у порядку їх появи — готові для введення в сценарій, файл оцінки JSONL або інший інструмент.
Чи завантажено кудись мою вставлену розмову?
Ні. Розбір повністю виконується у вашому браузері; стенограма ніколи не залишає ваш пристрій і не торкається сервера.
Чи працює він з експортом з інструментів чату AI, крім ChatGPT або Claude?
Так, список міток також охоплює такі загальні терміни, як «Користувач», «ШІ», «Помічник» і «Бот», і резервний варіант із порожнім рядком все ще працює, коли інструмент використовує мітки, які аналізатор не розпізнає, хоча згодом незвичний формат експорту може потребувати невеликого очищення вручну.