Přeskočit na obsah
100% lokálně

Detektor jazyka

Odhadněte, v jakém jazyce je text napsán, seřazeno dle jistoty.

Vstup
Výstup

Detektor jazyka

Vložte text a tento nástroj odhadne, v jakém jazyce je napsán, seřadí nejvěrohodněji kandidáty podle skóre jistoty. Porovnává text s profilem běžných funkčních slov a diagnostických písmen pro každý podporovaný jazyk, takže funguje od jedné věty po dlouhý dokument, výtahy logů nebo seznam komentářů v neznámém jazyce.

Možnost skupiny jazyka zúží hledání na rodinu — slovanské, germánské, románské nebo ostatní — což pomáhá, když víte přibližně, s čím máte co dělat a chcete ostřejší odpověď. Minimální délka určuje, kolik znaků nástroj očekává, aby výsledek považoval za spolehlivý; kratší úryvky stále dostanou odhad, jen s varováními. Vyhodnotit vám umožní skórovat celý text jako jednu jednotku nebo každý řádek nebo odstavec zvlášť, což je užitečné pro text, který si uprostřed změní jazyk. Zlepšení rozlišení blízkých jazyků přidává další váhu písmenům, která jsou efektivně jedinečná pro jeden jazyk v matoucím páru, jako je čeština versus slovenština nebo chorvatština versus slovinština, což obvykle rozšiřuje mezeru mezi nimi bez ovlivnění ostatních jazyků. Skóre lze zobrazit jako procenta nebo surové hodnoty a výstup může být úplný seznam nebo pouze kód nejlepšího jazyka.

Detekce je ze své podstaty přibližná — velmi krátký text, věty se smíšeným jazykem nebo jazyky, které si dělí většinu běžných slov, snižují jistotu a nástroj to říká spíše než tiše hádat s falešnou jistotou. Když podezřívá, že text míchá více než jeden jazyk, přidá poznámku místo tichého výběru jednoho.

Všechno se spouští lokálně ve vašem prohlížeči; text, který vložíte, se nikam nenahraje. Zkopírujte výsledek, stáhněte si jej jako soubor .txt nebo jej pošlete přímo do jiného nástroje a pokračujte v práci se stejným textem.

Časté dotazy

Jak přesná je detekce?
Funguje dobře na jednu nebo více vět v jednom z podporovaných jazyků, zejména když jsou přítomny diakritické znamínka nebo jiná charakteristická písmena. Velmi krátké úryvky, text obsahující pouze čísla nebo jazyky, které si dělí většinu běžných slov, dosahují nižšího skóre a jsou označeny jako méně spolehlivé.
Proč uvádí několik jazyků místo pouze jednoho?
Pořadí ukazuje, jak si je nástroj vědom relativní k alternativám. Jeden dominantní jazyk obvykle dosahuje podstatně vyššího skóre než zbytek; úzké závody mezi dvěma nebo třemi znamenají, že text je nejednoznačný nebo krátký.
Co vlastně změní "zlepšení rozlišení blízkých jazyků"?
Přidává další váhu písmenům, která jsou efektivně jedinečná pro jeden jazyk v matoucím páru, jako je čeština versus slovenština nebo chorvatština versus slovinština, což obvykle rozšiřuje mezeru mezi nimi bez ovlivnění ostatních jazyků.
Může detekovat jazyky, které nejsou v seznamu skupin jazyků?
Ne — pouze hodnotí jazyky, pro které má profil. Text v nepodporovaném jazyce bude mít nízké, přibližně rovnoměrné skóre v celém rozsahu spíše než sebevědomou shodu.
Je můj text nahrán kdekoli?
Ne. Detekce se spouští zcela v prohlížeči pomocí malého vestavěného profilu slov a písmen — váš text nikdy neopustí vaše zařízení.