Contador de caracteres

Conte caracteres contra um limite que você define — e não contra um limite de plataforma que a gente chutou.

Seu texto fica no seu navegador.

Fique dentro de um limite de caracteres definido por você.

Seu texto em números

0Caracteres
0Palavras
0Caracteres (sem espaços)
0Frases
0Parágrafos
0Linhas
0,0Palavras por frase
0,0Palavras por parágrafo
0:00Tempo de leitura
0:00Tempo de fala

Os tempos de leitura e de fala são estimativas.

Metas de texto curto

Defina seus próprios limites. Não fixamos limites de plataformas de propósito: eles mudam, e um número desatualizado é pior que nenhum.

  • 0 / 60 usados · faltam 60
  • 0 / 155 usados · faltam 155
  • 0 / 200 usados · faltam 200

Os caracteres são contados como o leitor os vê: um emoji é um caractere, mesmo quando por baixo são vários pontos de código.

Limite de caracteres aparece em bio, meta description, campanha de SMS, campo de formulário e resumo de artigo. Eles raramente concordam entre si e mudam sem aviso.

Por isso esta ferramenta não traz uma lista de limites de plataformas. Você nomeia suas metas e define o teto de cada uma. Um limite que você mesmo digitou é um limite que continua correto mês que vem.

Limite de caractere quase nunca é sobre conteúdo: é sobre caber. Uma linha do resultado de busca, um campo que para de aceitar texto, uma mensagem que se parte em duas e é cobrada duas vezes. Saber qual desses casos é o seu define qual número olhar e quanta folga deixar antes do teto.

Como esta ferramenta conta

Os caracteres são contados como clusters de grafema — as unidades que o leitor enxerga. Uma bandeira, um emoji com tom de pele e um "ç" acentuado são cada um um caractere, mesmo sendo várias unidades de código por baixo.

Isso importa porque "🇧🇷".length em JavaScript é 4. Reportar 4 seria falar de armazenamento e não ajudaria em nada quem está escrevendo uma bio.

"Caracteres sem espaços" exclui todo tipo de espaço em branco: espaço comum, tabulação, quebra de linha e aqueles espaços não separáveis que o editor de texto insere sem avisar.

O que é um caractere quando entram emoji e acentos

Existem três respostas defensáveis para "quantos caracteres tem este texto", e elas não batem entre si. Um cluster de grafema é aquilo que o leitor apontaria e chamaria de caractere. Um ponto de código é uma entrada do Unicode. Uma unidade UTF-16 é um dos compartimentos de dezesseis bits em que o navegador guarda o texto. Em texto sem acento os três números são iguais, e é por isso que ninguém percebe a diferença até ela cobrar caro.

O acento é onde a coisa deixa de ser teórica. A letra "é" existe duas vezes no Unicode: como uma entrada única, já pré-composta, e como um "e" seguido de um acento agudo combinante. As duas aparecem idênticas na tela e nenhuma das duas está errada. Um contador que trabalha em pontos de código devolve um para a primeira grafia e dois para a segunda, então dois textos visualmente iguais recebem totais diferentes sem que o leitor tenha como enxergar o motivo.

Texto digitado no teclado costuma vir pré-composto. Texto colado de PDF, exportado de certos aplicativos do Mac ou gerado por sistemas de publicação antigos vem decomposto com frequência. Contar por cluster de grafema elimina o problema: a letra-base e tudo o que se empilha sobre ela formam um cluster só, então as duas grafias de "é" voltam como um.

Os mesmos trechos curtos, contados de três maneiras
TextoClusters de grafemaPontos de códigoUnidades UTF-16
ação (ç e ã pré-compostos)444
ação (ã decomposto em a + til)455
👋112
👋🏽 (com modificador de tom de pele)124
🇧🇷 (bandeira)124
👨‍👩‍👧 (família)158
A primeira coluna é o que esta página informa. A última é o que a maioria das linguagens de programação devolve por padrão, e é o motivo de um campo recusar um texto que parecia curto de sobra.

Por que dois contadores dão dois números

Duas ferramentas medindo o mesmo parágrafo podem discordar. Os motivos são banais, não misteriosos, e saber qual deles está em jogo diz quanta folga aquele teto exige.

Nenhuma das causas abaixo torna uma contagem errada. Elas fazem do destino o juiz: escreva olhando esta página e confira o texto final no campo que vai aceitar ou recusar, principalmente se você estiver nos últimos cinco caracteres de um limite rígido.

  • Normalização. Alguns sistemas convertem o texto para uma forma canônica antes de medir e outros não, o que desloca o total de qualquer trecho com acento combinante.
  • Corte de bordas. O destino pode remover espaço no início e no fim antes de contar, então uma quebra de linha esquecida no fim da colagem custa um caractere em um lugar e nada em outro.
  • Peso por alfabeto. Alguns serviços cobram mais de uma unidade por caractere fora do alfabeto latino, então uma frase em japonês consome mais do orçamento que uma frase latina do mesmo tamanho.
  • Substituição. Links costumam ser medidos com tamanho fixo, seja qual for a URL real, porque o serviço pretende reescrevê-los na saída.
  • Caracteres invisíveis. Junções de largura zero, hífens opcionais e seletores de variação não ocupam largura nenhuma na tela e mesmo assim tomam um lugar em quase todo esquema de contagem.

Onde o limite de caracteres realmente aperta

Orçamento de caractere vem em dois tipos. Uns são impostos: o campo recusa a próxima tecla, ou a mensagem se parte e você paga em dobro. Outros são estéticos: nada recusa o seu texto, ele só é cortado na frente de quem você queria alcançar. O segundo tipo faz mais estrago, porque nada avisa que aconteceu.

Onde um orçamento de caracteres costuma valer
OndeFaixa de trabalhoO que acontece se passar
Meta descriptionEntre 150 e 160A busca corta o texto, quase sempre no meio da frase
Título no resultado de buscaEntre 55 e 60O fim do título vira reticências
Mensagem de SMS160 ou 70 por segmentoDivide em segmentos, cada um cobrado à parte
Campo com maxlengthO que a pessoa que programou definiuA digitação para em silêncio; a colagem é cortada no teto
Bio de perfilDefinido pela plataforma e revisado com o tempoO campo recusa o texto ou a página o corta
Resumo de artigo ou congressoDefinido na chamada de trabalhosO sistema de submissão rejeita o campo
O corte no resultado de busca é decidido pela largura disponível em pixels, não por contagem, então uma linha de maiúsculas e letras largas é cortada antes de uma linha de minúsculas estreitas. As faixas acima são aproximações de trabalho, não regras.

SMS: como um emoji transforma 160 caracteres em 70

O SMS é o caso mais claro de um teto que não é sobre caractere nenhum. A mensagem é codificada antes de sair, e a codificação é que define o teto.

A codificação padrão é o GSM-7, um alfabeto compacto de cerca de 128 símbolos mais um pequeno conjunto de extensão. Ele cobre letras latinas sem acento, dígitos, pontuação comum e uma lista curta e específica de letras acentuadas — "é" e "à" estão nela; "á", "ã", "õ" e "ê" não estão. Uma mensagem que fica dentro desse alfabeto cabe em 160 caracteres num único segmento.

No instante em que um único caractere fica de fora, a mensagem inteira passa para UCS-2, que gasta dois bytes em tudo. Não no caractere problemático: na mensagem toda. O teto cai para 70.

Capacidade do SMS por codificação
CodificaçãoMensagem únicaPor segmento quando divide
GSM-7160 caracteres153 caracteres
UCS-2 (emoji, acentos fora do conjunto GSM, alfabetos não latinos)70 caracteres67 caracteres
A mensagem dividida cede parte da capacidade a um cabeçalho que diz ao aparelho como remontá-la, e por isso 160 vira 153 em vez de continuar 160. Alguns caracteres do GSM-7 — o sinal de euro, colchetes, chaves, a barra invertida e o til entre eles — ocupam dois lugares cada.

Com espaços, sem espaços e quem pede cada um

Os dois totais aparecem porque cada pessoa pede um, e quase ninguém deixa claro qual.

Com espaços é o padrão certo para tudo que envolve caber. O espaço ocupa largura na linha, no campo e dentro do segmento de SMS, então todo limite que descreve quanto texto vai fisicamente entrar em algum lugar conta o espaço. Meta description, campo de formulário, bio e mensagem são tetos com espaços.

Sem espaços aparece quando o número está no lugar de "quanto conteúdo existe" e não de "quanto espaço isso ocupa". Algumas tabelas de tradução e de diagramação cobram assim, e certos critérios de avaliação pedem dessa forma. Se o enunciado diz apenas "caracteres" e para por aí, ele quer com espaços — mas a diferença entre os dois totais em prosa comum é de mais ou menos um sexto do texto, o bastante para valer uma pergunta antes de escrever para o número errado.

Três coisas inflam a contagem com espaços sem parecer que deveriam. O espaço duplo depois do ponto final, mantido por hábito ou herdado de um documento antigo. O espaço não separável, que o editor insere para impedir uma quebra de linha feia e que nenhuma tecla distingue de um espaço comum. E o hífen opcional, marca invisível de onde a palavra pode ser partida, que chega aos montes quando você cola de um PDF. Os três contam. Só o primeiro dá para ver.

Por que aqui não tem uma tabela de limites de plataforma

Seria a seção mais fácil de escrever e a mais rápida de apodrecer. Os tetos de redes sociais, plataformas de anúncio e sistemas de conteúdo mudam no calendário de quem é dono deles, e ninguém avisa as páginas que citaram o número antigo. Um limite desatualizado é pior que limite nenhum, porque quem encontra o número aqui não tem motivo para duvidar nem como conferir sem sair da página.

Em vez disso, o contador recebe os tetos de você. Dê nome à meta, defina o número e ela passa a ser acompanhada sobre o que estiver na caixa. Várias podem rodar ao mesmo tempo, que é o caso normal — um mesmo texto costuma virar título em um lugar, resumo em outro e legenda em um terceiro.

Chegar a um teto confiável leva mais ou menos um minuto:

  • Abra o campo de destino do texto: o editor de verdade, o painel administrativo ou o formulário de submissão, não uma captura de tela deles.
  • Leia o contador que ele mostra, ou cole um texto de enchimento e observe onde ele para de aceitar. Esse ponto de recusa é o único teto garantidamente real.
  • Registre esse número aqui como meta nomeada.
  • Tire uma pequena margem se o destino corta espaços ou reescreve links, para que uma surpresa de dois caracteres no dia do envio não leve embora a última oração.

Um exemplo prático

A frase "Olá! 👋🏽 Tudo bem?" medida de três formas:

Caracteres (com espaços)
16
Caracteres (sem espaços)
13
Unidades UTF-16 (o que .length informa)
19

O emoji de mão acenando com modificador de tom de pele é um caractere para o leitor e quatro unidades de código para o computador. Este contador informa o número do leitor.

Perguntas frequentes

Por que a contagem difere da que aparece na rede social?

As plataformas aplicam regras próprias — algumas pesam alfabetos não latinos de forma diferente, outras contam um link com tamanho fixo, independentemente do tamanho real. Use este número como a contagem exata do texto e o campo da própria plataforma como palavra final.

Quantos caracteres tem um emoji?

Um, aqui. Um emoji composto, como uma família ou uma bandeira, é um único cluster de grafema — e é isso que o leitor vê.

Quebra de linha conta como caractere?

Conta no total "com espaços" e é excluída do total "sem espaços", junto com tabulações e espaços não separáveis.

Dá para acompanhar mais de um limite ao mesmo tempo?

Sim. Adicione quantas metas quiser — título, resumo e legenda podem ser acompanhados sobre o mesmo texto de uma vez.

Devo contar com ou sem espaços?

Com espaços, a menos que tenham pedido o contrário. Todo limite que descreve quanto texto vai caber em algum lugar conta o espaço, porque espaço ocupa lugar. A contagem sem espaços aparece em algumas tabelas de preço de tradução e em certos critérios de correção, e quando é isso que se quer o enunciado costuma dizer com todas as letras.

Por que um emoji faz o SMS custar três vezes mais?

O emoji tira a mensagem inteira do alfabeto compacto GSM-7 e a joga no UCS-2, que derruba a capacidade de 160 para 70 por segmento. Uma mensagem de 158 caracteres que cabia em um segmento vira 159 unidades num formato que aceita 67 por segmento, ou seja, três segmentos. Não se cobra pelo emoji: cobra-se por recodificar tudo o que está em volta dele.

Qual o tamanho ideal de uma meta description?

A faixa de trabalho fica entre 150 e 160 caracteres, mas quem manda é a largura em pixels, não a contagem, então letras largas e maiúsculas são cortadas antes das estreitas. Coloque nos primeiros 120 caracteres aquilo que precisa sobreviver e trate o resto como bônus. Confira a página numa pré-visualização de resultado de busca em vez de confiar em um número só.

Letra com acento conta como um ou dois caracteres?

Um, aqui, não importa como esteja guardada. O Unicode permite escrever "á" como um caractere pré-composto ou como um "a" seguido de acento combinante, e a contagem por cluster de grafema devolve um nos dois casos. Sistemas que contam pontos de código informam dois na forma decomposta, e essa é uma origem comum de diferenças que ninguém consegue explicar.

A contagem subiu depois que colei um texto de PDF. Por quê?

PDF e editor de texto carregam caracteres invisíveis que sobrevivem à colagem: hífen opcional marcando onde a palavra pode quebrar, espaço não separável e, às vezes, junção de largura zero. Nenhum deles aparece na tela e todos contam. Colar antes num editor de texto puro, ou redigitar um trecho curto, limpa isso.