Przejdź do treści
100% lokalnie

Detektor języka

Określ, w jakim języku tekst jest napisany, posortowany według pewności.

Wejście
Wynik

Detektor języka

Wklej tekst a to narzędzie oszacuje, w jakim języku został napisany, uszereguje najprawdopodobniejszych kandydatów według wyniku pewności. Porównuje tekst z profilem wspólnych słów funkcyjnych i charakterystycznych liter dla każdego obsługiwanego języka, więc działa od jednego zdania do długiego dokumentu, wypisów dziennika lub listy komentarzy w nieznanym języku.

Opcja grupy języka zawęża wyszukiwanie do rodziny — słowiańskie, germańskie, romańskie lub inne — co pomaga, gdy już wiesz mniej więcej, z czym masz do czynienia i chcesz bardziej precyzyjną odpowiedź. Minimalna długość określa, ile znaków narzędzie oczekuje, zanim uzna wynik za wiarygodny; krótkie fragmenty nadal otrzymują oszacowanie, ale z ostrzeżeniami. Opcja oceny pozwala na ocenę całego tekstu jako jednej jednostki lub każdego wiersza lub akapitu osobno, co jest przydatne w tekście, który zmienia język w połowie drogi. Wyostrzenie podobnych języków nadaje dodatkową wagę literom, które są efektywnie unikalne dla jednego języka w myląccej parze, takiej jak polski względem czeski lub chorwacki względem słoweński, co zwykle rozszerza przerwę między nimi bez wpływu na inne języki. Wyniki mogą być wyświetlane jako procenty lub wartości surowe, a wynik może być pełną listą lub tylko kodem najlepszego języka.

Detekcja jest z natury przybliżona — bardzo krótki tekst, zdania w mieszanym języku lub języki, które dzielą większość wspólnych słów, zmniejszają pewność, a narzędzie to mówi zamiast zgadywać z fałszywą pewnością. Gdy podejrzewa, że tekst miesza więcej niż jeden język, dodaje notatkę zamiast po cichu wybierać jeden.

Wszystko działa lokalnie w przeglądarce; tekst, który wkleisz, nigdy nie zostanie przesłany gdziekolwiek. Skopiuj wynik, pobierz go jako plik .txt lub wyślij bezpośrednio do innego narzędzia, aby kontynuować pracę z tym samym tekstem.

Częste pytania

Jak dokładna jest detekcja?
Działa dobrze na jedno lub więcej zdań w jednym z obsługiwanych języków, zwłaszcza gdy są obecne znaki diakrytyczne lub inne charakterystyczne litery. Bardzo krótkie fragmenty, tekst zawierający tylko liczby lub języki, które dzielą większość wspólnych słów, otrzymują niższe wyniki i są oznaczane jako mniej wiarygodne.
Dlaczego wymienia wiele języków zamiast tylko jednego?
Ranking pokazuje, jak pewne jest narzędzie w stosunku do alternatyw. Jeden dominujący język zwykle uzyskuje znacznie wyższy wynik niż pozostałe; ciasny wyścig między dwoma lub trzema oznacza, że tekst jest niejednoznaczny lub krótki.
Co właściwie zmienia "wyostrzenie podobnych języków"?
Dodaje dodatkową wagę literom, które są efektywnie unikalne dla jednego języka w myląccej parze, takiej jak polski względem czeski lub chorwacki względem słoweński, co zwykle rozszerza przerwę między nimi bez wpływu na inne języki.
Czy może rozpoznać języki, które nie znajdują się na liście grup języków?
Nie — tylko ocenia języki, dla których ma profil. Tekst w nieobsługiwanym języku będzie wykazywać niskie, mniej więcej równomiernie rozłożone wyniki na całym zakresie, a nie pewne dopasowanie.
Czy mój tekst jest przesyłany gdziekolwiek?
Nie. Detekcja działa całkowicie w przeglądarce przy użyciu małego wbudowanego profilu słów i liter — Twój tekst nigdy nie opuszcza Twoje urządzenie.