FerramentasTodas as ferramentas

Texto

Conferir texto antes de enviar a um formulário ou sistema

Inspeciona o texto colado sem alterar nada e reúne num relatório único o que costuma causar problema ao enviar para um formulário ou sistema: caracteres invisíveis e de controle, marcação de markdown residual, espaços múltiplos, quebra de linha irregular, tag HTML solta e trecho sem espaço longo demais.

Texto0 caracteres

Cole ou digite um texto acima para ver o resultado.

Processamento local: seu arquivo não sai do seu computador.

  • Faz:Inspeciona o texto colado sem alterar nada e reúne num relatório único o que costuma causar problema ao enviar para um formulário ou sistema: caracteres invisíveis e de controle, marcação de markdown residual, espaços múltiplos, quebra de linha irregular, tag HTML solta e trecho sem espaço longo demais.
  • Processa:O texto é processado inteiramente no seu navegador — nada é enviado a servidor.

Por que conferir antes de enviar, e não só limpar depois

Nem todo campo de texto reage bem a qualquer conteúdo colado. Um formulário de site, um sistema interno de empresa ou um campo de cadastro às vezes rejeita, corta ou exibe errado um texto que parece perfeitamente normal na tela — porque carrega algo que não é visível: um caractere invisível vindo de outro editor, uma tag HTML esquecida de uma página copiada, uma quebra de linha de outro sistema operacional. Esta ferramenta existe para o momento anterior ao envio: mostrar o que está de fato dentro do texto, sem mudar nada, para decidir com informação se vale a pena corrigir algo antes.

O que entra no relatório

Seis categorias são conferidas de uma vez. Caracteres invisíveis e de controle — espaço de largura zero, marca de direção de texto, caractere de controle não imprimível — que não aparecem na tela mas existem no texto de verdade. Marcação de markdown residual — asterisco, sustenido, crase — que sobra quando um texto foi escrito para um lugar que interpreta markdown e vai parar num lugar que não interpreta. Espaço múltiplo ou sobrando no fim da linha. Quebra de linha que parece solta no meio de uma frase, comum em texto colado de PDF. Tag ou entidade HTML residual, de colar direto de uma página web. E trecho de texto sem nenhum espaço acima de 100 caracteres, que pode estourar a largura de uma coluna mal preparada para isso.

Uma família de três ferramentas, três momentos diferentes

Esta ferramenta reusa a mesma lógica de detecção de limpar texto colado e de detectar caracteres invisíveis — as três enxergam o mesmo tipo de problema, cada uma num momento diferente do trabalho. Detectar caracteres invisíveis foca só nesse tipo específico de problema, com uma visualização detalhada de onde cada ocorrência está. Limpar texto colado já aplica a correção de várias categorias de uma vez, substituindo o texto. Conferir texto fica no meio: um raio-X completo, sem tocar em nada, para decidir com base no relatório se vale a pena seguir para a limpeza ou enviar o texto como está.

Por que mistura de quebra de linha é um problema real

Windows tradicionalmente termina cada linha de um arquivo de texto com dois caracteres (retorno de carro e nova linha, "CRLF"); sistemas Unix e Mac modernos usam só um ("LF"). A maioria dos programas lida bem com qualquer um dos dois sozinho — o problema aparece quando um texto tem os DOIS misturados, geralmente porque foi editado em mais de um sistema ou colado de fontes diferentes. Um sistema que espera consistência (para contar linhas, para processar registro por registro) pode se comportar de forma inesperada diante dessa mistura, mesmo que o texto pareça visualmente normal em qualquer editor.

Tag HTML residual: um sinal de origem, não um erro de digitação

Encontrar algo como <span> ou &nbsp; dentro de um texto colado quase sempre indica que a origem foi uma página web — copiar texto formatado de um site às vezes traz fragmentos da marcação por trás dele, que ficam invisíveis na maioria dos editores de texto mas continuam ali, dentro da string. Um formulário que trata o campo como texto puro pode exibir esses fragmentos literalmente, ou pior, interpretá-los se o sistema de destino renderizar HTML sem sanitização — mais um motivo para saber que estão ali antes de enviar.

Por que um trecho sem espaço muito longo entra no relatório

A maioria dos sistemas de layout (de uma página web a uma célula de planilha) quebra uma linha de texto no espaço entre palavras — quando falta um espaço por um trecho longo o suficiente (um link colado sem quebra, uma sequência de caracteres colada por engano, uma string técnica), o sistema não tem onde quebrar a linha e o texto pode estourar a largura do contêiner, forçando rolagem horizontal ou distorcendo o layout ao redor. O limite usado aqui (100 caracteres sem nenhum espaço) é alto o suficiente para não marcar uma palavra realmente longa do idioma como suspeita, mas baixo o suficiente para pegar os casos que costumam causar esse problema.

O que esta ferramenta não faz

Ela não corrige nenhum dos problemas encontrados — só relata presença e quantidade de cada categoria, deixando a decisão de agir (ou não) por conta de quem está conferindo. Não garante que um texto sem nenhuma ocorrência relatada vai funcionar perfeitamente em qualquer sistema de destino, já que cada sistema tem suas próprias regras e limites, que esta ferramenta não conhece. E não verifica ortografia, gramática ou qualidade do conteúdo — só a formatação técnica por trás do texto visível.

Perguntas frequentes

Qual a diferença entre esta ferramenta e limpar-texto-colado ou detectar-caracteres-invisiveis?

Esta ferramenta só inspeciona e reporta, sem alterar uma letra do texto — pensada para o momento antes de enviar algo, quando o objetivo é saber se há algum problema, não corrigi-lo ainda. Detectar caracteres invisíveis faz uma parte dessa inspeção (só os caracteres invisíveis, com mais detalhe visual). Limpar texto colado já aplica a correção. As três reusam a mesma lógica de detecção por baixo, cada uma com um propósito diferente no fluxo de trabalho.

O que conta como 'formatação suspeita que costuma quebrar formulário ou sistema'?

Nesta ferramenta: tag HTML residual (de colar texto direto de uma página web), entidade HTML como "&nbsp;" (mesma origem), trecho de texto sem nenhum espaço acima de 100 caracteres (pode estourar a largura de uma coluna ou campo mal preparado para isso), e mistura de quebra de linha estilo Windows (CRLF) com estilo Unix (LF) dentro do mesmo texto — cada um desses já causou, em algum sistema real, um comportamento inesperado ao processar o texto.

Encontrar uma ocorrência de cada tipo significa que o texto vai quebrar o sistema de destino?

Não necessariamente — significa que aquele tipo de conteúdo está presente, o que É um risco conhecido em vários sistemas, mas nem todo sistema reage mal a cada um deles. O relatório informa presença e quantidade; se aquilo vai de fato causar problema depende do sistema específico que vai receber o texto, algo que esta ferramenta não tem como saber.

Por que a ferramenta não corrige os problemas encontrados automaticamente?

Porque o propósito aqui é diagnóstico, não correção — uma etapa de conferência antes de decidir o que fazer. Quando a decisão já é corrigir, a ferramenta limpar texto colado desta mesma família aplica exatamente essas correções (markdown, travessão, aspas, invisíveis, espaços, quebras) de uma vez, com relatório do que foi alterado.

Esta ferramenta envia o texto para algum lugar durante a conferência?

Não. Toda a análise acontece no navegador, no momento em que o texto é colado ou digitado — nada é enviado a nenhum servidor deste portal.

Ferramentas relacionadas