Ga naar inhoud
100% lokaal

Taalherkenner

Bepaal in welke taal een tekst is geschreven, gerangschikt op betrouwbaarheid.

Invoer
Uitvoer

Taalherkenner

Plak een willekeurige tekst in en dit hulpmiddel bepaalt in welke taal deze is geschreven, gerangschikt op basis van betrouwbaarheid. Het vergelijkt de tekst met een profiel van veelgebruikte werkwoorden en karakteristieke letters voor elke ondersteunde taal, dus het werkt met alles van enkele zinnen tot lange documenten, logbestanden of lijsten met onbekende opmerkingen.

De optie Taalgroep beperkt de zoekopdracht tot een familie – Slavisch, Germaans, Romaans of ander –, wat helpt als je al ongeveer weet wat je met je handen hebt en een scherpere uitkomst wilt. Minimale lengte bepaalt hoeveel tekens het hulpmiddel verwacht voordat het een resultaat als betrouwbaar beschouwt; kortere fragmenten krijgen nog steeds een gok, maar met een waarschuwing. Evaluatie laat je de hele tekst als één eenheid of elke regel of alinea afzonderlijk beoordelen, handig voor tekst die halverwege van taal verandert. Onderscheid soortgelijke talen voegt extra gewicht toe aan letters die effectief uniek zijn voor één zijde van een vaak verwarde combinatie, zoals Slowaaks ľ en ô tegen Tsjechisch ř en ě, of Kroatisch đ tegen Sloveens. Scores kunnen als percentages of onbewerkte waarden worden weergegeven, en de uitvoer kan de volledige gerangschikte lijst of alleen de best-guess taalcode zijn.

Detectie is van nature benaderd – zeer korte tekst, code-switching of talen die de meeste veelgebruikte woorden delen, verlagen de betrouwbaarheid, en het hulpmiddel zegt dit eerder dan valse zekerheid voor te wenden. Wanneer het vermoeden heeft dat een tekst meer dan één taal bevat, voegt het een opmerking toe in plaats van stilzwijgend één te kiezen.

Alles draait lokaal in uw browser; de tekst die u plakt wordt nergens geüpload. Kopieer het resultaat, download het als .txt-bestand, of stuur het rechtstreeks naar een ander hulpmiddel om ermee verder te werken.

FAQ

Hoe nauwkeurig is de detectie?
Het werkt goed op een volledige zin of langer in een van de ondersteunde talen, vooral eenmaal diacrieten of andere karakteristieke letters aanwezig zijn. Zeer korte fragmenten, alleen nummers of talen die de meeste veelgebruikte woorden delen, scoren lager en worden gemarkeerd als minder betrouwbaar.
Waarom worden meerdere talen vermeld in plaats van slechts één?
De rangschikking toont hoe zeker het hulpmiddel is ten opzichte van de alternatieven. Eén dominante taal scoort meestal veel hoger dan de rest; een close race tussen twee of drie betekent dat de tekst dubbelzinnig of kort is.
Wat verandert eigenlijk met "Onderscheid maken tussen soortgelijke talen"?
Het voegt extra gewicht toe aan letters die effectief uniek zijn voor één taal in een verwisselbaar paar, zoals Slowaaks tegen Tsjechisch of Kroatisch tegen Sloveens, wat meestal de kloof tussen hen vergroten zonder andere talen te beïnvloeden.
Kan het talen detecteren die niet in de taalgroeplijst voorkomen?
Nee – het ordent alleen talen waarvoor het een profiel heeft. Tekst in een niet-ondersteunde taal toont lage, grofweg gelijke scores voor alle talen in plaats van een betrouwbare overeenkomst.
Wordt mijn tekst ergens geüpload?
Nee. Detectie draait volledig lokaal in uw browser met behulp van een klein ingebouwd woord- en letterprofiel – uw tekst verlaat nooit uw apparaat.