Preskoči na vsebino
TextArray
100% lokalno

Besedni frekvenčni števec

Vsako besedo v besedilu naštejte s tem, kolikokrat se pojavi, razvrščeno po številu.

Vhod
Izhod

Besedni frekvenčni števec

Prilepite besedilo in pridobite razvrščeni seznam njegovih besed s tem, kako pogosto se vsaka pojavi. Pisatelji ga uporabljajo, da ujamejo besedo, na katero so se preveč oprli, strokovnjaki za SEO, da preverijo, katere izraze stran dejansko poudarja, študenti in raziskovalci, da profilirajo prepis intervjuja, in uredniki, da poiščejo dopolnilo pred prepisom.

Štetje brez razlikovanja med velikimi in malimi črkami je privzeto vklopljeno, zato si »besedilo« in »besedilo« delita vrstico; izklopite, da bo črkovanje ločeno. Nastavite najmanjšo dolžino besede, da izpustite kratke funkcijske besede, ali vklopite preskakovanje pogostih besed, kar odstrani približno dva ducata najpogostejših besed v jeziku, v katerem brskate. Razvrstite po številu, da vidite, kaj prevladuje, ali po abecedi, da poiščete določeno besedo, in nastavite omejitev vrstice, da obdržite samo zgornje vnose – 0 navede vse.

Besede se ujemajo s črkovnimi pravili Unicode, tako da "čučoriedka", "Grüße", "źdźbło" in "gyümölcs" ostanejo cele, namesto da bi se razdelile na naglašeno črko, "don't" in "well-known" pa vsaka štejeta kot ena beseda. Orodje šteje besedne oblike natanko tako, kot je napisano: ne lematizira, zato "teči" in "teči" zasedata ločeni vrstici. Število je poravnano desno, tako da se stolpec poravna, seštevek pa poroča o edinstvenih besedah, skupnem številu preštetih besed in najpogostejši besedi s svojim številom.

Vse se izračuna v vašem brskalniku. Vaše besedilo ni nikoli naloženo, zato je varno prilepiti osnutke, dokumente strank in raziskovalno gradivo. Kopirajte seznam, ga prenesite kot datoteko .txt ali ga premaknite nazaj na vnos za nadaljnje razvrščanje ali čiščenje.

FAQ

Katere pogoste besede se preskočijo?
Približno 25 najpogostejših funkcijskih besed za vsak jezik — "the", "and", "of" v angleščini in ustrezniki drugje. Seznam je namenoma majhen: odstrani očiten šum, namesto da deluje kot popoln korpus stop besed. Sledi jeziku strani, zato prilepite nemško besedilo na angleško stran in uporabljen je angleški seznam.
Ali združuje "teči" in "teči" skupaj?
Ne. Orodje šteje besedne oblike točno tako, kot se pojavijo, brez korena ali lematizacije. Ednina in množina ter vsaka sklonjena oblika dobijo svojo vrsto.
Ali naglašene in neangleške besede štejejo pravilno?
ja Ujemanje besed uporablja lastnosti črk Unicode, tako da slovaške, češke, nemške, poljske in madžarske črke ostanejo v svojih besedah, namesto da bi jih razdelili. Tudi zloženke z vezajem in apostrofi ostanejo cele.
Zakaj seštevek poimenuje besedo, ki ni v prvi vrsti?
Seštevek vedno poroča o najpogostejši besedi v celotnem besedilu. Razvrščanje po abecedi ali nastavitev omejitve vrstice spremeni seznam, ki ga vidite, ne pa tudi, katera beseda dejansko vodi.
Je moje besedilo kje naloženo?
Ne. Orodje deluje v celoti v vašem brskalniku in vaše besedilo nikoli ne zapusti vaše naprave.