Contador de caracteres
Conte caracteres contra um limite que você define — e não contra um limite de plataforma que a gente chutou.
Seu texto fica no seu navegador.
Fique dentro de um limite de caracteres definido por você.
Seu texto em números
Os tempos de leitura e de fala são estimativas.
Metas de texto curto
Defina seus próprios limites. Não fixamos limites de plataformas de propósito: eles mudam, e um número desatualizado é pior que nenhum.
- 0 / 60 usados · faltam 60
- 0 / 155 usados · faltam 155
- 0 / 200 usados · faltam 200
Os caracteres são contados como o leitor os vê: um emoji é um caractere, mesmo quando por baixo são vários pontos de código.
Limite de caracteres aparece em bio, meta description, campanha de SMS, campo de formulário e resumo de artigo. Eles raramente concordam entre si e mudam sem aviso.
Por isso esta ferramenta não traz uma lista de limites de plataformas. Você nomeia suas metas e define o teto de cada uma. Um limite que você mesmo digitou é um limite que continua correto mês que vem.
Limite de caractere quase nunca é sobre conteúdo: é sobre caber. Uma linha do resultado de busca, um campo que para de aceitar texto, uma mensagem que se parte em duas e é cobrada duas vezes. Saber qual desses casos é o seu define qual número olhar e quanta folga deixar antes do teto.
Como esta ferramenta conta
Os caracteres são contados como clusters de grafema — as unidades que o leitor enxerga. Uma bandeira, um emoji com tom de pele e um "ç" acentuado são cada um um caractere, mesmo sendo várias unidades de código por baixo.
Isso importa porque "🇧🇷".length em JavaScript é 4. Reportar 4 seria falar de armazenamento e não ajudaria em nada quem está escrevendo uma bio.
"Caracteres sem espaços" exclui todo tipo de espaço em branco: espaço comum, tabulação, quebra de linha e aqueles espaços não separáveis que o editor de texto insere sem avisar.
O que é um caractere quando entram emoji e acentos
Existem três respostas defensáveis para "quantos caracteres tem este texto", e elas não batem entre si. Um cluster de grafema é aquilo que o leitor apontaria e chamaria de caractere. Um ponto de código é uma entrada do Unicode. Uma unidade UTF-16 é um dos compartimentos de dezesseis bits em que o navegador guarda o texto. Em texto sem acento os três números são iguais, e é por isso que ninguém percebe a diferença até ela cobrar caro.
O acento é onde a coisa deixa de ser teórica. A letra "é" existe duas vezes no Unicode: como uma entrada única, já pré-composta, e como um "e" seguido de um acento agudo combinante. As duas aparecem idênticas na tela e nenhuma das duas está errada. Um contador que trabalha em pontos de código devolve um para a primeira grafia e dois para a segunda, então dois textos visualmente iguais recebem totais diferentes sem que o leitor tenha como enxergar o motivo.
Texto digitado no teclado costuma vir pré-composto. Texto colado de PDF, exportado de certos aplicativos do Mac ou gerado por sistemas de publicação antigos vem decomposto com frequência. Contar por cluster de grafema elimina o problema: a letra-base e tudo o que se empilha sobre ela formam um cluster só, então as duas grafias de "é" voltam como um.
| Texto | Clusters de grafema | Pontos de código | Unidades UTF-16 |
|---|---|---|---|
| ação (ç e ã pré-compostos) | 4 | 4 | 4 |
| ação (ã decomposto em a + til) | 4 | 5 | 5 |
| 👋 | 1 | 1 | 2 |
| 👋🏽 (com modificador de tom de pele) | 1 | 2 | 4 |
| 🇧🇷 (bandeira) | 1 | 2 | 4 |
| 👨👩👧 (família) | 1 | 5 | 8 |
Por que dois contadores dão dois números
Duas ferramentas medindo o mesmo parágrafo podem discordar. Os motivos são banais, não misteriosos, e saber qual deles está em jogo diz quanta folga aquele teto exige.
Nenhuma das causas abaixo torna uma contagem errada. Elas fazem do destino o juiz: escreva olhando esta página e confira o texto final no campo que vai aceitar ou recusar, principalmente se você estiver nos últimos cinco caracteres de um limite rígido.
- Normalização. Alguns sistemas convertem o texto para uma forma canônica antes de medir e outros não, o que desloca o total de qualquer trecho com acento combinante.
- Corte de bordas. O destino pode remover espaço no início e no fim antes de contar, então uma quebra de linha esquecida no fim da colagem custa um caractere em um lugar e nada em outro.
- Peso por alfabeto. Alguns serviços cobram mais de uma unidade por caractere fora do alfabeto latino, então uma frase em japonês consome mais do orçamento que uma frase latina do mesmo tamanho.
- Substituição. Links costumam ser medidos com tamanho fixo, seja qual for a URL real, porque o serviço pretende reescrevê-los na saída.
- Caracteres invisíveis. Junções de largura zero, hífens opcionais e seletores de variação não ocupam largura nenhuma na tela e mesmo assim tomam um lugar em quase todo esquema de contagem.
Onde o limite de caracteres realmente aperta
Orçamento de caractere vem em dois tipos. Uns são impostos: o campo recusa a próxima tecla, ou a mensagem se parte e você paga em dobro. Outros são estéticos: nada recusa o seu texto, ele só é cortado na frente de quem você queria alcançar. O segundo tipo faz mais estrago, porque nada avisa que aconteceu.
| Onde | Faixa de trabalho | O que acontece se passar |
|---|---|---|
| Meta description | Entre 150 e 160 | A busca corta o texto, quase sempre no meio da frase |
| Título no resultado de busca | Entre 55 e 60 | O fim do título vira reticências |
| Mensagem de SMS | 160 ou 70 por segmento | Divide em segmentos, cada um cobrado à parte |
| Campo com maxlength | O que a pessoa que programou definiu | A digitação para em silêncio; a colagem é cortada no teto |
| Bio de perfil | Definido pela plataforma e revisado com o tempo | O campo recusa o texto ou a página o corta |
| Resumo de artigo ou congresso | Definido na chamada de trabalhos | O sistema de submissão rejeita o campo |
SMS: como um emoji transforma 160 caracteres em 70
O SMS é o caso mais claro de um teto que não é sobre caractere nenhum. A mensagem é codificada antes de sair, e a codificação é que define o teto.
A codificação padrão é o GSM-7, um alfabeto compacto de cerca de 128 símbolos mais um pequeno conjunto de extensão. Ele cobre letras latinas sem acento, dígitos, pontuação comum e uma lista curta e específica de letras acentuadas — "é" e "à" estão nela; "á", "ã", "õ" e "ê" não estão. Uma mensagem que fica dentro desse alfabeto cabe em 160 caracteres num único segmento.
No instante em que um único caractere fica de fora, a mensagem inteira passa para UCS-2, que gasta dois bytes em tudo. Não no caractere problemático: na mensagem toda. O teto cai para 70.
| Codificação | Mensagem única | Por segmento quando divide |
|---|---|---|
| GSM-7 | 160 caracteres | 153 caracteres |
| UCS-2 (emoji, acentos fora do conjunto GSM, alfabetos não latinos) | 70 caracteres | 67 caracteres |
Com espaços, sem espaços e quem pede cada um
Os dois totais aparecem porque cada pessoa pede um, e quase ninguém deixa claro qual.
Com espaços é o padrão certo para tudo que envolve caber. O espaço ocupa largura na linha, no campo e dentro do segmento de SMS, então todo limite que descreve quanto texto vai fisicamente entrar em algum lugar conta o espaço. Meta description, campo de formulário, bio e mensagem são tetos com espaços.
Sem espaços aparece quando o número está no lugar de "quanto conteúdo existe" e não de "quanto espaço isso ocupa". Algumas tabelas de tradução e de diagramação cobram assim, e certos critérios de avaliação pedem dessa forma. Se o enunciado diz apenas "caracteres" e para por aí, ele quer com espaços — mas a diferença entre os dois totais em prosa comum é de mais ou menos um sexto do texto, o bastante para valer uma pergunta antes de escrever para o número errado.
Três coisas inflam a contagem com espaços sem parecer que deveriam. O espaço duplo depois do ponto final, mantido por hábito ou herdado de um documento antigo. O espaço não separável, que o editor insere para impedir uma quebra de linha feia e que nenhuma tecla distingue de um espaço comum. E o hífen opcional, marca invisível de onde a palavra pode ser partida, que chega aos montes quando você cola de um PDF. Os três contam. Só o primeiro dá para ver.
Por que aqui não tem uma tabela de limites de plataforma
Seria a seção mais fácil de escrever e a mais rápida de apodrecer. Os tetos de redes sociais, plataformas de anúncio e sistemas de conteúdo mudam no calendário de quem é dono deles, e ninguém avisa as páginas que citaram o número antigo. Um limite desatualizado é pior que limite nenhum, porque quem encontra o número aqui não tem motivo para duvidar nem como conferir sem sair da página.
Em vez disso, o contador recebe os tetos de você. Dê nome à meta, defina o número e ela passa a ser acompanhada sobre o que estiver na caixa. Várias podem rodar ao mesmo tempo, que é o caso normal — um mesmo texto costuma virar título em um lugar, resumo em outro e legenda em um terceiro.
Chegar a um teto confiável leva mais ou menos um minuto:
- Abra o campo de destino do texto: o editor de verdade, o painel administrativo ou o formulário de submissão, não uma captura de tela deles.
- Leia o contador que ele mostra, ou cole um texto de enchimento e observe onde ele para de aceitar. Esse ponto de recusa é o único teto garantidamente real.
- Registre esse número aqui como meta nomeada.
- Tire uma pequena margem se o destino corta espaços ou reescreve links, para que uma surpresa de dois caracteres no dia do envio não leve embora a última oração.
Um exemplo prático
A frase "Olá! 👋🏽 Tudo bem?" medida de três formas:
- Caracteres (com espaços)
- 16
- Caracteres (sem espaços)
- 13
- Unidades UTF-16 (o que .length informa)
- 19
O emoji de mão acenando com modificador de tom de pele é um caractere para o leitor e quatro unidades de código para o computador. Este contador informa o número do leitor.
Perguntas frequentes
Por que a contagem difere da que aparece na rede social?
As plataformas aplicam regras próprias — algumas pesam alfabetos não latinos de forma diferente, outras contam um link com tamanho fixo, independentemente do tamanho real. Use este número como a contagem exata do texto e o campo da própria plataforma como palavra final.
Quantos caracteres tem um emoji?
Um, aqui. Um emoji composto, como uma família ou uma bandeira, é um único cluster de grafema — e é isso que o leitor vê.
Quebra de linha conta como caractere?
Conta no total "com espaços" e é excluída do total "sem espaços", junto com tabulações e espaços não separáveis.
Dá para acompanhar mais de um limite ao mesmo tempo?
Sim. Adicione quantas metas quiser — título, resumo e legenda podem ser acompanhados sobre o mesmo texto de uma vez.
Devo contar com ou sem espaços?
Com espaços, a menos que tenham pedido o contrário. Todo limite que descreve quanto texto vai caber em algum lugar conta o espaço, porque espaço ocupa lugar. A contagem sem espaços aparece em algumas tabelas de preço de tradução e em certos critérios de correção, e quando é isso que se quer o enunciado costuma dizer com todas as letras.
Por que um emoji faz o SMS custar três vezes mais?
O emoji tira a mensagem inteira do alfabeto compacto GSM-7 e a joga no UCS-2, que derruba a capacidade de 160 para 70 por segmento. Uma mensagem de 158 caracteres que cabia em um segmento vira 159 unidades num formato que aceita 67 por segmento, ou seja, três segmentos. Não se cobra pelo emoji: cobra-se por recodificar tudo o que está em volta dele.
Qual o tamanho ideal de uma meta description?
A faixa de trabalho fica entre 150 e 160 caracteres, mas quem manda é a largura em pixels, não a contagem, então letras largas e maiúsculas são cortadas antes das estreitas. Coloque nos primeiros 120 caracteres aquilo que precisa sobreviver e trate o resto como bônus. Confira a página numa pré-visualização de resultado de busca em vez de confiar em um número só.
Letra com acento conta como um ou dois caracteres?
Um, aqui, não importa como esteja guardada. O Unicode permite escrever "á" como um caractere pré-composto ou como um "a" seguido de acento combinante, e a contagem por cluster de grafema devolve um nos dois casos. Sistemas que contam pontos de código informam dois na forma decomposta, e essa é uma origem comum de diferenças que ninguém consegue explicar.
A contagem subiu depois que colei um texto de PDF. Por quê?
PDF e editor de texto carregam caracteres invisíveis que sobrevivem à colagem: hífen opcional marcando onde a palavra pode quebrar, espaço não separável e, às vezes, junção de largura zero. Nenhum deles aparece na tela e todos contam. Colar antes num editor de texto puro, ou redigitar um trecho curto, limpa isso.