Preskoči na vsebino
100% lokalno

Filter vrstic izven ASCII

Obdržite ali odstranite vsako vrsto, ki vsebuje znak zunaj standardnega območja ASCII.

Vhod

Filter vrstic izven ASCII

Prilepite poljuben tekst in to orodje ga preverja vrstico za vrstico: vsaka vrstica bodisi vsebuje samo standardne znake ASCII (kode 0-127 — navadne latinične črke, številke in ločila na ameriški tipkovnici) bodisi ne. V načinu "Odstrani vrstice izven ASCII" se vsaka vrstica, ki vsebuje tudi samo en sam znak zunaj tega območja — nagnjeno črko, emoji, ukrivljene narekovaje, znak CJK ali zablumarjen nadzorni bajt — izbriše, vse ostalo pa ostane nespremenjeno. Preklopite v način "Obdrži samo vrstice izven ASCII", da obrnete filter in izolirate točno te vrstice, ki vsebujejo kaj nenavadnega — to je pogosto najhitrejši način, da jih poiščete.

To orodje je bilo izgradjeno za vrsto čiščenja, ki nenehno nastaja pri dnevnikih in neobdelanih izvozih podatkov: dnevnik strežnika, kjer je večina vrstic čista, vendar je bilo nekaj poškodovanih z mojibake, izvoz CSV, pri katerem je pokvarjen korak kodiranja puščal okvarjene bajte v nekaj vrsticah, ali zbrani podatki, ki mešajo čiste angleške zapise s fragmenti v drugih skriptah, ki jih ne želite dalje obdelovati. Namesto da bi te vrstice ročno iskali ali pisali enkratni skript, preprosto prilepite tekst in takoj dobite čist rezultat — ali preklopite način, da izvlečete samo problematične vrstice za temeljitejši pregled.

Preverjanje preiščuje vsak znak v vrstici, ne le prvega, zato se vrstica, ki je v glavnem ASCII z enim vgrajenim naglasom ali simbolom, še vedno šteje kot izven ASCII in se obravnava ustrezno. Končni znaki vrstic za Windows (CRLF) in Unix (LF) se obravnavajo na enak način, in orodje je dovolj hitro za obdelavo datotek s stotinami tisoči vrstic v milisekundah — skupno pod rezultatom prikazuje točno, koliko vrstic je prispelo, koliko jih ostane in koliko je bilo filtrirano.

Vse se izvršava lokalno v vašem brskalniku. Vaš tekst se nikoli ne naloži na strežnik, kar je pomembno za dnevnike in notranje podatkovne izpiske, ki pogosto vsebujejo imena gostiteljev, podatke uporabnikov ali druge podrobnosti, ki bi jih rajši ne pošiljali nikamor. Kopirajte rezultat, ga prenesite kot datoteko .txt ali ga pošljite neposredno drugemu orodju, da nadaljujete s čiščenjem.

FAQ

Kaj se šteje kot znak izven ASCII?
Karkoli zunaj kodnih točk 0-127 — to vključuje nagnjene črke, kot so é ali ü, emoji-je, ukrivljene narekovaje, em pomišljave in znake iz ne-latiničnih skript, kot so cirilica, grščina ali CJK.
Ali en sam znak izven ASCII odstrani celo vrstico?
Da. Če se tudi samo en znak v vrstici nahaja zunaj območja ASCII, se celotna vrstica obravnava kot izven ASCII — ne samo ta znak.
Ali lahko obdržim samo vrstice izven ASCII?
Da. Preklopite način na "Obdrži samo vrstice izven ASCII" in orodje preobrne filter, vrne pa natanko tiste vrstice, ki bi jih sicer izbrisalo — koristno za zaznavanje težav s kodiranjem.
Kako se obravnavajo končni znaki vrstic za Windows in Unix?
Na enak način. Prepoznani so tako končni znaki CRLF kot LF, rezultat pa se združi z enim samim znakom nove vrstice na vrstico, ne glede na obliko vnosa.
Ali se moje besedilo naloži nekje?
Ne. Filtriranje se izvršava v celoti v vašem brskalniku in vaše besedilo nikoli ne zapusti vašega naprave — nič se ne naloži, pošlje na strežnik ali beleži.