Zum Inhalt springen
100% lokal

Spracherkennung

Bestimme, in welcher Sprache ein Text geschrieben ist, sortiert nach Zuverlässigkeit.

Eingabe
Ausgabe

Spracherkennung

Füge einen beliebigen Text ein und dieses Tool bestimmt, in welcher Sprache er verfasst ist. Es vergleicht den Text mit einem Profil häufiger Funktionswörter und charakteristischer Buchstaben für jede unterstützte Sprache, daher funktioniert es von einzelnen Sätzen über lange Dokumente bis hin zu Log-Dateien oder Listen unbekannter Kommentare.

Die Sprachgruppen-Option grenzt die Suche auf eine Familie ein – Slawisch, Germanisch, Romanisch oder andere –, was hilft, wenn du ungefähr weißt, worauf sich der Text bezieht, und eine präzisere Antwort möchtest. Die Mindestlänge legt fest, wie viele Zeichen das Tool vor einer zuverlässigen Einschätzung erwartet; kürzere Texte erhalten auch eine Vermutung, aber mit einer Warnung. Auswertung ermöglicht es, den ganzen Text als eine Einheit oder jede Zeile oder jeden Absatz separat zu bewerten – nützlich für Texte, die die Sprache wechseln. Ähnliche Sprachen unterscheiden gibt extra Gewicht auf Buchstaben, die einzigartig für eine Seite eines häufig verwechselten Paares sind, etwa Slowakisch ľ und ô gegen Tschechisch ř und ě, oder Kroatisch đ gegen Slowenisch. Scores können als Prozentsätze oder Rohwerte angezeigt werden, und die Ausgabe kann die vollständige Rangfolge oder nur den wahrscheinlichsten Sprachcode sein.

Die Erkennung ist ihrer Natur nach ungefähr – sehr kurze Texte, Code-Switching oder Sprachen, die sich in den meisten häufigen Wörtern ähneln, senken die Zuverlässigkeit, und das Tool teilt dies mit, statt falsche Sicherheit vorzutäuschen. Wenn es vermutet, dass ein Text mehr als eine Sprache mischt, fügt es eine Notiz hinzu statt stumm eine auszuwählen.

Alles läuft lokal in Ihrem Browser ab; Texte werden niemals hochgeladen. Kopiere das Ergebnis, lade es als .txt herunter, oder sende es direkt in ein anderes Tool um weiter daran zu arbeiten.

Häufige Fragen

Wie genau ist die Erkennung?
Sie funktioniert gut bei vollständigen Sätzen oder längeren Texten in einer der unterstützten Sprachen, besonders wenn Diakritika oder andere charakteristische Buchstaben vorhanden sind. Sehr kurze Texte, nur Zahlen oder Sprachen, die die meisten häufigen Wörter teilen, erzielen niedrigere Scores und werden als weniger zuverlässig gekennzeichnet.
Warum werden mehrere Sprachen statt nur eine aufgelistet?
Die Rangfolge zeigt die Zuverlässigkeit des Tools relativ zu den Alternativen. Eine einzelne dominante Sprache erreicht gewöhnlich deutlich höhere Scores als die übrigen; ein knappes Rennen zwischen zwei oder drei bedeutet, dass der Text mehrdeutig oder kurz ist.
Was ändert sich tatsächlich durch "Ähnliche Sprachen unterscheiden"?
Es fügt extra Gewicht auf Buchstaben hinzu, die effektiv einzigartig für eine Sprache in einem verwechselbaren Paar sind, etwa Slowakisch gegen Tschechisch oder Kroatisch gegen Slowenisch, was gewöhnlich die Lücke zwischen ihnen vergrößert, ohne andere Sprachen zu beeinflussen.
Kann es Sprachen erkennen, die nicht in der Sprachgruppen-Liste stehen?
Nein – es ordnet nur die Sprachen, für die es ein Profil hat. Text in einer nicht unterstützten Sprache zeigt niedrige, ungefähr gleiche Scores über alle Sprachen hinweg statt einer zuverlässigen Übereinstimmung.
Wird mein Text überall hochgeladen?
Nein. Die Erkennung läuft völlig lokal in Ihrem Browser mit einem kleinen eingebauten Wort- und Buchstabenprofil – Ihr Text verlässt niemals Ihr Gerät.