Hoppa till innehåll
100% lokalt

ASCII-radfilter

Behåll eller ta bort varje rad som innehåller ett tecken utanför ASCII-standardintervallet.

Inmatning

ASCII-radfilter

Klistra in vilken text som helst och det här verktyget granskar det rad för rad: varje rad innehåller antingen endast standard-ASCII-tecken (koderna 0-127 — de enkla latinska bokstäverna, siffrorna och skiljetecknen på ett amerikanskt tangentbord) eller gör det inte. I läget "Ta bort non-ASCII-rader" tas varje rad bort som innehåller även ett enda tecken utanför det intervallet — en accentuerad bokstav, en emoji, ett krökt citattecken, ett CJK-tecken eller en vilsen styrbyte — och allt annat passerar oförändrat. Byt till läget "Behåll bara non-ASCII-rader" för att vända filtret och isolera exakt raderna som innehåller något ovanligt — det är ofta det snabbaste sättet att hitta dem.

Det här verktyget byggt för den typ av rengöring som uppstår konstant med loggar och rådataexporter: en serverlogg där de flesta raderna är rena men några har skadats av mojibake, en CSV-export där ett felaktigt kodningssteg lämnade skadade byte i några rader, eller skrapad data som blandar rena engelska poster med fragment i andra script som du inte vill bearbeta vidare. I stället för att söka efter dessa rader manuellt eller skriva ett engångsscript klistrar du helt enkelt in texten och får ett rent resultat omedelbar — eller ändrar läget för att extrahera endast de problematiska raderna för närmare granskning.

Kontrollen undersöker varje tecken i en rad, inte bara det första, så en rad som till största delen är ASCII med en inbäddad accent eller symbol räknas fortfarande som non-ASCII och hanteras i enlighet med detta. Radtermineringar för Windows (CRLF) och Unix (LF) hanteras på samma sätt, och verktyget är tillräckligt snabbt för att bearbeta filer med hundratusentals rader på millisekunder — summan under utmatningen visar exakt hur många rader som kom in, hur många som kvarstår och hur många som filtrerades.

Allt körs lokalt i din webbläsare. Din text laddas aldrig upp till en server, vilket är viktigt för loggar och interna datautskrifter som ofta innehåller värdnamn, användardata eller andra detaljer som du helst inte vill skicka någonstans. Kopiera resultatet, ladda ned det som en .txt-fil eller skicka det direkt till ett annat verktyg för att fortsätta rengöringen.

FAQ

Vad räknas som ett non-ASCII-tecken?
Allt utanför kodpunkterna 0-127 — det inkluderar accentuerade bokstäver som é eller ü, emoji, krökta citattecken, em-bindestreck och tecken från icke-latinska skript som kyrilliska, grekiska eller CJK.
Tar ett enda non-ASCII-tecken bort hela raden?
Ja. Om även ett tecken i en rad ligger utanför ASCII-intervallet behandlas hela raden som non-ASCII — inte bara det tecknet.
Kan jag behålla bara non-ASCII-raderna?
Ja. Byt läget till "Behåll bara non-ASCII-rader" och verktyget inverterar filtret, vilket returnerar exakt de rader som det annars skulle ha tagit bort — användbart för att hitta kodningsproblem.
Hur hanteras radtermineringar för Windows och Unix?
På samma sätt. Både CRLF- och LF-radtermineringar känns igen, och resultatet sammanfogas med en enda ny rad per rad oavsett inmatningsformat.
Laddas min text upp någonstans?
Nej. Filtreringen körs helt och hållet i din webbläsare och din text lämnar aldrig din enhet — ingenting laddas upp, skickas till en server eller loggas.