Hoppa till innehåll
100% lokalt

Egennamnsextraktor

Extrahera troliga namn, platser och märkesnamn från en textblock.

Inmatning
Utmatning

Egennamnsextraktor

Klistra in en artikel, transkription eller anteckningar och det här verktyget hämtar de ord som sannolikt är namn, platser eller märkesnämnanden: kapitaliserade ord som inte bara står i början av en mening. Det är ett snabbt sätt att se vem och vad en text faktiskt handlar om, utan att läsa det rad för rad.

Standard räknas en stor bokstav bara när den förekommer mitt i meningen, eftersom ett ord i början av en mening är kapitaliserat oavsett vad det är. Slå på "Inkludera meningsstartsord" för att utöka nätet när du hellre samlar in allt än missar något. "Sammanfoga angränsande stora bokstäver" förenas som "New York" eller "Golden Gate Bridge" till en enda enhet istället för att dela dem i separata ord, och "Ignorera vanliga ord" tar bort ofta kapitaliserade poster – pronomen, hälsningar, veckodags- och månadsnamn – som sällan är det namn du letar efter. Sortera resultaten efter frekvens för att se vad som nämns mest, eller alfabetiskt för att skanna en ren referenslista, och välj vanlig lista eller CSV-utgång beroende på var resultatet går härnäst.

Verktyget känner igen vanliga förkortningar som "Dr.", "Mr." och "St." så ordet direkt efter tas inte av misstag för början av en ny mening och hoppas över. Det hanterar Windows- och Unix-radbrytningar på samma sätt, klarar mycket lång inmatning utan att sakta ner, och summeringen under utgången rapporterar hur många distinkta enheter som hittades och hur många gånger de förekom totalt.

Allt körs lokalt i din webbläsare – texten du klistrar in skickas aldrig nånstans. När du är klar kopierar du resultatet, laddar ner det som en .txt-fil, eller skickar utgången direkt tillbaka till inmatningen för att förfina det ytterligare.

FAQ

Vad räknas som ett "egennamn" här?
Alla kapitaliserade ord eller, när sammanslagning är på, en rad kapitaliserade ord som inte bara markerar meningens början. Det är en heuristik baserad på kapitalisering, inte en ordbok över verkliga namn, så det fångar ibland ett kapitaliserat gemensamt ord och missar ett gemener märke.
Varför hoppas ett namn över helt i början av en mening?
Varje ord i början av en mening är kapitaliserat, verkligt namn eller inte, så att räkna dessa skulle översvämma resultaten med falska positiva. Slå på "Inkludera meningsstartsord" om du hellre ser allt.
Hur fungerar sammanslagna angränsande ord?
När två eller fler kapitaliserade ord står bredvid varandra, åtskilda av ett enda mellanslag, sammanfogas de till en enhet – "New York" i stället för "New" och "York" separat. Skiljetecken eller ett gemener ord emellan stannar sammanslagningen.
Vad tar bort "ignorera vanliga ord"?
En liten inbyggd lista över ofta kapitaliserade ord som sällan är det namn du vill ha: pronomen som "I", hälsningar och veckodags- eller månadsnamn. Flertalet entiteter som "New York" påverkas aldrig av detta filter.
Laddas min text upp någonstans?
Nej. Extraktionen körs helt i din webbläsare – din text lämnar aldrig din enhet.