Przejdź do treści

Parser dziennika czatów AI

Czyści wklejoną transkrypcję ChatGPT lub Claude do uporządkowanego dialogu użytkownika/AI.

Wejście
Wynik

Parser dziennika czatów AI

Kopiowanie rozmowy z interfejsu internetowego ChatGPT lub Claude rzadko wychodzi czysto. Wraz z rzeczywistym dialogiem otrzymujesz etykiety przycisków, takie jak „Kopiuj” i „Regeneruj”, niepotrzebne znaczniki czasu i nazwy modeli umieszczone w osobnych wierszach — bałagan, który sprawia, że transkrypcja jest niewygodna do przeczytania, udostępnienia zgłoszenia do pomocy technicznej lub wklejenia do dokumentu. To narzędzie usuwa szumy interfejsu i ponownie składa to, co pozostało, w wyraźną, naprzemienną rozmowę.

Rozpoznaje etykiety głośników, które zwykle wyświetlają te narzędzia — „Ty”, „ChatGPT”, „Claude”, „Asystent” i kilka ogólnych odpowiedników — niezależnie od tego, czy znajdują się osobno w wierszu, czy prowadzą bezpośrednio do pierwszego zdania („Ty: jak mam…”). Jeśli pasta całkowicie utraciła swoje etykiety, parser wraca do traktowania każdego bloku oddzielonego pustymi liniami jako jeden obrót i naprzemiennie wymienia użytkownika i sztuczną inteligencję, zaczynając od użytkownika, tak właśnie czyta się większość transkrypcji po zniknięciu chromu. Krótkie linie przeznaczone wyłącznie do interfejsu użytkownika — „Kopiuj”, „Kopiuj kod”, „Wygeneruj ponownie”, „Ponów próbę”, same czasy zegara — są usuwane przed uruchomieniem któregokolwiek przebiegu, więc nigdy nie zostaną błędnie odczytane w ramach dialogu.

Domyślnie wynik to Markdown — **User:** i **AI:** są oddzielone pustymi liniami — gotowe do wklejenia do dokumentu, wpisu na blogu lub raportu o błędzie. Zamiast tego włączenie opcji wyjściowej JSON tworzy tablicę obiektów \`{ role, content }\` w tej samej kolejności, co jest przydatne do wprowadzania transkrypcji do skryptu, zbioru danych eval lub innego narzędzia w potoku.

Wszystko działa w Twojej przeglądarce: wklejanie, analizowanie i formatowanie odbywa się lokalnie w JavaScript, a transkrypcja nigdy nie jest nigdzie przesyłana ani wysyłana.

Częste pytania

Skąd narzędzie wie, które linie są użytkownikiem, a które sztuczną inteligencją?
Wyszukuje popularne etykiety głośników — „Ty”, „ChatGPT”, „Claude”, „Asystent” — w osobnej linii lub z dwukropkiem i rozpoczyna nową wiadomość za każdym razem, gdy się pojawi. Jeśli wklejony tekst utracił swoje etykiety, powraca do naprzemiennych obrotów przy każdej pustej linii, zaczynając od użytkownika.
Co liczy się jako „szum”, który zostaje usunięty?
Krótkie linie interfejsu, które nie są częścią konwersacji — „Kopiuj”, „Kopiuj kod”, „Wygeneruj ponownie”, „Spróbuj ponownie”, „Udostępnij”, „Lubię to” — i same sygnatury czasowe, takie jak „10:32” siedzące samotnie na linii.
Jak wygląda wynik JSON?
Tablica obiektów, `{"role": "user" | „ai”, „content”: „…”}`, po jednym na turę w kolejności, w jakiej się pojawiały — gotowe do wprowadzenia do skryptu, pliku ewaluacyjnego JSONL lub innego narzędzia.
Czy moja wklejona rozmowa jest gdzieś przesłana?
Nie. Analiza odbywa się całkowicie w Twojej przeglądarce; transkrypcja nigdy nie opuszcza Twojego urządzenia ani nie dotyka serwera.
Czy działa to w przypadku eksportu z narzędzi czatu AI innych niż ChatGPT lub Claude?
Tak — lista etykiet obejmuje również terminy ogólne, takie jak „Użytkownik”, „AI”, „Asystent” i „Bot”, a rezerwa na puste wiersze nadal działa, gdy narzędzie używa etykiet, których parser nie rozpoznaje, chociaż nietypowy format eksportu może później wymagać ręcznego oczyszczenia.