Sări la conținut
Complet local

Detector de limbă

Estimează în ce limbă este scris un text, clasificat după încredere.

Intrare

Detector de limbă

Lipiți orice text și acest instrument estimează în ce limbă este scris, clasificând cei mai probabil candidați după un scor de încredere. Compară textul cu un profil de cuvinte de funcție comune și litere diagnostice pentru fiecare limbă suportată, deci funcționează pe orice, de la o simplă propoziție până la un document lung, extras de jurnal sau listă de comentarii ale utilizatorului într-o limbă necunoscută.

Opțiunea de grupă de limbi restrânge căutarea la o familie — Slavă, Germană, Romantică sau alta — ceea ce ajută atunci când știți deja aproximativ cu ce vă ocupați și doriți un răspuns mai ascuțit. Lungimea minimă stabilește câte caractere se așteaptă instrumentul înainte de a trata un rezultat ca fiabil; fragmentele mai scurte primesc încă o presupunere, doar cu o avertizare atașată. Evaluare vă permite să punctuați textul întreg ca o unitate, sau fiecare rând sau paragraf pe cont propriu, util pentru textul care schimbă limba la jumătate. Ascuții limbile apropiate dă greutate suplimentară literelor care sunt efectiv unice pentru o parte a unei perechi confuzate în mod obișnuit, cum ar fi ľ și ô slovac versus ř și ě ceh, sau đ croat versus sloven. Scorurile pot fi afișate ca procente sau valori brute, iar rezultatul poate fi lista completă clasificată sau doar codul limbii cu cea mai bună presupunere.

Detectarea este aproximativă din fire — text foarte scurt, propoziții cu comutare de cod, sau limbi care partajează majoritatea cuvintelor comune vor scădea încrederea, iar instrumentul o afirmă mai degrabă decât să ghicească cu fals cert. Când suspectează că un text amestecă mai mult de o limbă, adaugă o notă în loc să aleagă în tăcere una.

Totul se execută local în browser-ul dvs.; textul pe care îl lipiți nu este niciodată trimis nicăieri. Copiați rezultatul, descărcați-l ca fișier .txt, sau trimiteti-l direct la alt instrument pentru a continua să lucrați pe același text.

FAQ

Cât de precisă este detectarea?
Funcționează bine pe o propoziție completă sau mai mult într-una din limbile suportate, mai ales odată ce sunt prezente diacritice sau alte litere distinctive. Fragmentele foarte scurte, textul doar cu numere, sau limbile care partajează majoritatea cuvintelor comune au un scor mai mic și sunt semnalate ca mai puțin fiabile.
De ce enumeră mai multe limbi în loc de doar una?
Clasificarea arată cât de sigur este instrumentul în raport cu alternativele. O singură limbă dominantă obișnuit punctează bine deasupra celorlalte; o cursă strânsă între două sau trei înseamnă că textul este ambiguu sau scurt.
Ce schimbă exact "ascuți limbile apropiate"?
Adaugă greutate suplimentară literelor care sunt efectiv unice pentru o limbă într-o pereche confuzată, cum ar fi slovac versus ceh sau croat versus sloven, care de obicei lărgește decalajul între ele fără a afecta alte limbi.
Poate detecta limbi care nu sunt pe lista grupei de limbi?
Nu — doar clasifică limbile pentru care are un profil. Textul într-o limbă nesuportată va arăta scoruri scăzute, aproximativ chiar pe tablă în loc de o potrivire sigură.
Textul meu este încărcat undeva?
Nu. Detectarea se execută complet în browser-ul dvs. folosind un profil mic de cuvânt și literă încorporat — textul dvs. nu pleacă niciodată din dispozitivul dvs.