Filtr minimálního počtu slov
Odstraňte řádky, které obsahují méně slov, než je vámi nastavený práh.
Filtr minimálního počtu slov
Vložte seznam řádků a tento nástroj odfiltruje ty, které nenesou dostatek slov, aby byly užitečné – jednoslovné fragmenty, bludné štítky, zkrácené řádky ze seškrábnutí nebo šum, který zbyde z kopírování tabulky do prostého textu. Nastavte minimální počet slov a ponechte pouze řádky, které jej splňují, nebo přepněte režim a udělejte opak a místo toho vytáhněte pouze krátké řádky.
Počet slov se měří rozdělením každého řádku na mezery, takže spuštění několika mezer nebo tabulátorů mezi slovy počet nezvětší a prázdný řádek se vždy počítá jako nula slov. Prahová hodnota je včetně: s minimem tří je řádek s přesně třemi slovy udržován ve výchozím režimu „uchovat dlouhé“. Přepněte na „keep short“, chcete-li inverzní – například izolovat neúplné řádky, abyste je mohli kontrolovat nebo opravovat samostatně, místo abyste je rovnou odstraňovali.
To je užitečné pro čištění odcizeného textu, exportů protokolů, sloupců CSV vložených jako prostý text nebo jakéhokoli seznamu, kde jsou skutečně krátké řádky nevyžádané místo dat – seznam URL slug, sada značek nebo poznámek, kde osamocené slovo obvykle znamená neúplný záznam. Zachází s koncovkami řádků ve Windows (CRLF) i Unixu (LF) stejně a záznam pod výstupem ukazuje, kolik řádků zbývá, kolik bylo odstraněno a výsledný počet znaků, takže výsledek můžete zkontrolovat na první pohled.
Vše běží lokálně ve vašem prohlížeči. Váš text není nikdy nahrán na server, takže jej můžete bezpečně použít v interních poznámkách, nepublikovaných konceptech nebo čemkoli jiném, co byste raději uchovali v soukromí. Jakmile budete s výsledkem spokojeni, zkopírujte jej, stáhněte si jej jako soubor .txt nebo jej rovnou odešlete do jiného nástroje, abyste mohli pokračovat v čištění textu.