Rilevatore di lingua
Stima in quale lingua è scritto un testo, ordinato per fiducia.
Rilevatore di lingua
Incolla qualsiasi testo e questo strumento stima in quale lingua è scritto, classificando i candidati più probabili per un punteggio di fiducia. Confronta il testo con un profilo di parole di funzione comuni e lettere diagnostiche per ogni lingua supportata, quindi funziona su qualsiasi cosa da una singola frase a un lungo documento, un estratto di log o un elenco di commenti di utenti in una lingua sconosciuta.
L'opzione del gruppo di lingua limita la ricerca a una famiglia — slava, germanica, romanza o altra — il che aiuta quando sai già approssimativamente con cosa hai a che fare e desideri una risposta più precisa. La lunghezza minima imposta il numero di caratteri che lo strumento si aspetta prima di considerare un risultato affidabile; i frammenti più brevi ricevono comunque una stima, solo con un avviso allegato. Valutare ti consente di valutare l'intero testo come un'unità, o ogni riga o paragrafo separatamente, utile per il testo che cambia lingua a metà strada. Distinguere lingue simili dà peso extra alle lettere che sono effettivamente uniche per un lato di una coppia comunemente confusa, come la ľ e ô dello slovacco contro la ř e ě del ceco, o la đ del croato contro lo sloveno. I punteggi possono essere visualizzati come percentuali o valori grezzi, e l'output può essere l'elenco completo classificato o solo il codice lingua con la migliore stima.
La rilevazione è approssimativa per natura — il testo molto breve, le frasi code-switched o le lingue che condividono la maggior parte delle parole comuni riducono la fiducia e lo strumento lo dice piuttosto che indovinare con falsa certezza. Quando sospetta che un testo mescoli più di una lingua, aggiunge una nota invece di sceglierne silenziosamente una.