Ir para o conteúdo
TextArray
Totalmente local

Detector de caracteres invisível

Encontre caracteres Unicode ocultos no texto e destaque, remova ou substitua-os.

Entrada
Saída

Detector de caracteres invisível

Texto que parece limpo pode conter caracteres que você não consegue ver. Copie de um assistente de bate-papo, Word, PDF ou página da web e espaços de largura zero, espaços inseparáveis, hífens suaves e marcas de direção acompanham - então uma importação de CSV falha, duas strings de aparência idêntica se recusam a corresponder, quebras de código em um caractere que o editor não mostra ou uma pesquisa perde o óbvio. Este detector torna a camada oculta visível e elimina-a.

Cole seu texto e cada caractere invisível será marcado no lugar com um token como ⟨U+200B⟩, para que você veja exatamente onde cada um está. Abaixo do texto, um resumo lista cada caractere encontrado com seu ponto de código Unicode, nome e contagem – espaço de largura zero × 3, espaço sem quebra × 2 – para que você saiba com o que está lidando antes de alterar qualquer coisa.

Mude a ação para remover para remover todos os caracteres ocultos ou para substituir por espaço para transformar caracteres semelhantes a espaços, como espaços finos e inseparáveis, em espaços comuns, enquanto os caracteres de largura zero desaparecem completamente - o que evita que as palavras se colem. Espaços ininterruptos costumam ser tipografia intencional, portanto, uma opção separada os protege. São detectados espaços e juntores de largura zero, a marca de ordem de byte, hífens suaves, marcas e substituições bidirecionais, espaços Unicode exóticos, o preenchimento hangul, o branco braille e códigos de controle; guias e quebras de linha são estrutura, não lixo, e são deixadas em paz.

Tudo é executado no seu navegador e nada é carregado. A contagem mostra quantos caracteres invisíveis foram encontrados, de quantos tipos e a contagem total de caracteres.

FAQ

De onde vêm os personagens invisíveis?
Processadores de texto e mecanismos de layout inserem espaços inseparáveis e hífens suaves para tipografia, os arquivos começam com uma marca de ordem de byte e o texto copiado de assistentes de bate-papo ou páginas da web geralmente carrega espaços de largura zero - às vezes deliberadamente, como uma marca d'água ou para passar por filtros. Todos eles sobrevivem ao copiar e colar.
Qual é a diferença entre Remover e Substituir por espaço?
Remover exclui todos os caracteres detectados imediatamente, o que pode unir as palavras quando há um espaço ininterrupto entre elas. Substituir por espaço transforma caracteres semelhantes a espaço - espaços ideográficos finos e ininterruptos e similares - em um espaço regular e remove apenas os de largura zero, para que os limites das palavras sobrevivam.
Por que a ferramenta sinaliza meu emoji?
Emojis combinados, como famílias e emojis profissionais, são mantidos juntos por marceneiros de largura zero (U + 200D), que o detector relata honestamente. Removê-los divide o emoji em partes. Execute o destaque primeiro e, se os marcadores pertencerem ao emoji que você deseja manter, deixe o texto como está.
Caracteres invisíveis podem ser um problema de segurança?
Sim. As substituições da direita para a esquerda podem reverter visualmente parte de um nome de arquivo ou URL, de modo que "gpj.exe" seja lido como "exe.jpg", e as substituições bidirecionais no código-fonte podem fazer com que ele seja revisado de maneira diferente da compilação. O resumo nomeia cada marca de direção que encontra, então esse tipo de truque não tem onde se esconder.
Meu texto é carregado em algum lugar?
Não. A ferramenta funciona inteiramente no seu navegador e seu texto nunca sai do seu dispositivo.