Spracherkennung
Bestimme, in welcher Sprache ein Text geschrieben ist, sortiert nach Zuverlässigkeit.
Spracherkennung
Füge einen beliebigen Text ein und dieses Tool bestimmt, in welcher Sprache er verfasst ist. Es vergleicht den Text mit einem Profil häufiger Funktionswörter und charakteristischer Buchstaben für jede unterstützte Sprache, daher funktioniert es von einzelnen Sätzen über lange Dokumente bis hin zu Log-Dateien oder Listen unbekannter Kommentare.
Die Sprachgruppen-Option grenzt die Suche auf eine Familie ein – Slawisch, Germanisch, Romanisch oder andere –, was hilft, wenn du ungefähr weißt, worauf sich der Text bezieht, und eine präzisere Antwort möchtest. Die Mindestlänge legt fest, wie viele Zeichen das Tool vor einer zuverlässigen Einschätzung erwartet; kürzere Texte erhalten auch eine Vermutung, aber mit einer Warnung. Auswertung ermöglicht es, den ganzen Text als eine Einheit oder jede Zeile oder jeden Absatz separat zu bewerten – nützlich für Texte, die die Sprache wechseln. Ähnliche Sprachen unterscheiden gibt extra Gewicht auf Buchstaben, die einzigartig für eine Seite eines häufig verwechselten Paares sind, etwa Slowakisch ľ und ô gegen Tschechisch ř und ě, oder Kroatisch đ gegen Slowenisch. Scores können als Prozentsätze oder Rohwerte angezeigt werden, und die Ausgabe kann die vollständige Rangfolge oder nur den wahrscheinlichsten Sprachcode sein.
Die Erkennung ist ihrer Natur nach ungefähr – sehr kurze Texte, Code-Switching oder Sprachen, die sich in den meisten häufigen Wörtern ähneln, senken die Zuverlässigkeit, und das Tool teilt dies mit, statt falsche Sicherheit vorzutäuschen. Wenn es vermutet, dass ein Text mehr als eine Sprache mischt, fügt es eine Notiz hinzu statt stumm eine auszuwählen.
Alles läuft lokal in Ihrem Browser ab; Texte werden niemals hochgeladen. Kopiere das Ergebnis, lade es als .txt herunter, oder sende es direkt in ein anderes Tool um weiter daran zu arbeiten.