Přeskočit na obsah
100% lokálně

Filtr řádků mimo ASCII

Zachovejte nebo odeberte každý řádek obsahující znak mimo standardního rozsahu ASCII.

Vstup

Filtr řádků mimo ASCII

Vložte jakýkoli text a tento nástroj jej zkontroluje řádek po řádku: každý řádek buď obsahuje pouze standardní znaky ASCII (kódy 0-127 — běžná latinská písmena, číslice a interpunkci na americké klávesnici), nebo ne. V režimu "Odebrat řádky mimo ASCII" se odstraní každý řádek obsahující i jeden znak mimo tohoto rozsahu — písmo s diakritikou, emoji, statickou uvozovku, znak CJK nebo náhodný řídicí bajt — a vše ostatní projde beze změny. Přepněte do režimu "Zachovat jen řádky mimo ASCII" a obratte filtr naopak, abyste izolovali právě ty řádky, které obsahují něco neobvyklého — to je často rychlejší způsob, jak je najít.

Tento nástroj je navržen pro čištění, které neustále vzniká při práci s logy a surová data: server log, kde jsou naprostá část řádků čistá, ale několik se poškodilo mojibake, CSV export, kde chybný krok kódování zanechal v několika řádcích chybné bajty, nebo seskupená data, která míchají čistě anglické záznamy s fragmenty v jiných skriptech, které nechcete zpracovat dále. Namísto ručního hledání těchto řádků nebo psaní jednorázového skriptu jednoduše vložte text a okamžitě dostanete čistý výsledek — nebo přepněte režim a získejte pouze problémové řádky pro podrobnější kontrolu.

Nástroj kontroluje každý znak v řádku, ne pouze první, takže řádek, který je přinejmenším ASCII s jedním vloženým diakritickým znakem nebo symbolem, se nadále počítá jako mimo ASCII a je zpracován odpovídajícím způsobem. Konce řádků Windows (CRLF) a Unix (LF) se zpracovávají stejným způsobem a nástroj je dostatečně rychlý na zpracování souborů se statisíci řádků během milisekund — součet pod výstupem přesně ukazuje, kolik řádků přišlo, kolik zůstalo a kolik bylo odfiltrováno.

Všechno běží lokálně ve vašem prohlížeči. Váš text se nikdy nenahraje na server, což je důležité pro zaznamenané zdroje a interní datové výpisy, které často obsahují názvy hostitelů, uživatelská data nebo další podrobnosti, které byste raději neposílali nikam. Zkopírujte výsledek, stáhněte si je jako soubor .txt nebo jej pošlete přímo dalšímu nástroji, abyste pokračovali v čištění.

Časté dotazy

Co se počítá jako znak mimo ASCII?
Cokoli mimo kódové body 0-127 — zahrnuje to písma s diakritikou jako é nebo ü, emoji, statické uvozovky, em pomlčky a znaky z nelatinských skriptů, jako jsou cyrilice, řečtina nebo CJK.
Odstraní jeden znak mimo ASCII celý řádek?
Ano. Pokud se v řádku nachází i jeden znak mimo rozsah ASCII, celý řádek se považuje za mimo ASCII — ne jen ten znak.
Mohu zachovat jen řádky mimo ASCII?
Ano. Přepněte režim na "Zachovat jen řádky mimo ASCII" a nástroj obráti filtr, čímž vrátí právě ty řádky, které by jinak odstranil — užitečné pro nalezení problémů s kódováním.
Jak se zpracovávají konce řádků Windows a Unix?
Stejným způsobem. Rozpoznávají se konce CRLF i LF a výsledek se spojí s jedním znakem nového řádku na řádek bez ohledu na formát vstupu.
Je můj text někde nahrán?
Ne. Filtrování probíhá zcela ve vašem prohlížeči a váš text nikdy neopustí vaše zařízení — nic se nenahraje, nepošle na server ani se nezaznamenává.