Contador de tokens de LLM

Cole qualquer prompt ou documento e veja exatamente quantos tokens ele usa — com os mesmos tokenizadores que GPT, Qwen, GLM, Kimi e MiniMax realmente utilizam. Inspecione a divisão token por token, alterne entre codificações e faça seu planejamento considerando as janelas de contexto. Seu texto nunca sai do navegador.

tokens

o200k_base · Para GPT-5 · GPT-4o · o-series
Codificação

Conte tokens com precisão usando os vocabulários oficiais de GPT, Qwen, GLM, Kimi e MiniMax, inspecione a divisão e os IDs token a token — tudo localmente no seu navegador.

No navegador

Como usar Contador de tokens de LLM

Etapa 1

Cole ou digite qualquer texto

Etapa 2

Escolha a codificação: as duas da OpenAI ou a da Qwen/GLM/Kimi/MiniMax

Etapa 3

Veja a contagem em tempo real e a divisão colorida de tokens

Recursos

Vocabulários oficiais para GPT e Qwen/GLM/Kimi/MiniMax, não uma aproximação

Divisão token por token com IDs

veja onde cada token é usado

Funciona localmente no seu navegador; nada é enviado

Contagens exatas de tokens com seis vocabulários oficiais

O guia completo para contagem de tokens

O que esta ferramenta faz

O contador de tokens divide o texto usando as mesmas codificações BPE usadas pelos modelos da OpenAI e conta o resultado. Tokens são a moeda comum do universo dos LLMs — as APIs cobram por eles, as janelas de contexto os limitam e os modelos leem por meio deles. Seja para escrever prompts, dividir conteúdo para RAG ou estimar custos, o primeiro passo é saber quanto seu texto realmente custa em tokens.

Como usá-la

  1. Cole seu textoPrompts, documentos ou código — quanto mais longo, mais vale a pena contar primeiro.
  2. Escolha a codificação corretao200k_base for GPT-5/4o/o-series, cl100k_base for GPT-4/3.5.
  3. Veja a contagemA contagem é atualizada em tempo real enquanto você digita; a tabela de codificações é carregada uma vez e permanece disponível.
  4. Inspecione a divisão coloridaOs tokens adjacentes alternam entre cores — veja rapidamente o que se fragmenta e o que permanece inteiro.
  5. Verifique os IDs dos tokens, se necessárioMude para a visualização de IDs para ver a sequência inteira que o modelo recebe.

Especificações e limites

Entrada
Nenhum upload de arquivo
Codificações
OpenAI ×2 · Qwen3.5 · GLM-5.2 · Kimi · MiniMax-M3
Base da contagem
BPE real, não estimado
Visualização dividida
Primeiros 1500 tokens coloridos
Limite de contagem
Nenhum (texto completo)
Funciona off-line
Após o carregamento da tabela

As contagens são exatas com base nos vocabulários oficiais da OpenAI (família GPT), além de Qwen3.5, GLM-5.2, Kimi e MiniMax-M3. Claude e Gemini mantêm seus tokenizadores privados, portanto considere essas contagens uma estimativa. Os vocabulários têm de 1 a 4 MB, são baixados uma vez no primeiro uso e ficam armazenados em cache depois disso.

Dicas para obter os melhores resultados

  • Chinês custa mais que inglêsO mesmo significado geralmente usa 1,5–2× mais tokens em chinês — calcule o orçamento por idioma em aplicativos multilíngues.
  • O código se fragmenta em partesIndentação, símbolos e camelCase adicionam tokens — conte antes de colar um arquivo grande.
  • Deixe espaço na janelaA entrada e a saída compartilham a janela de contexto; um prompt no limite não deixa espaço para a resposta.
  • Prompts de sistema também são cobradosEles são reenviados a cada solicitação — um prompt de sistema longo é um custo recorrente oculto.
  • Divida o RAG por tokensDividir por tokens em vez de caracteres mantém os trechos recuperados consistentemente densos.
  • Fique atento aos tokens estruturaisA formatação do chat adiciona alguns tokens estruturais, então o uso real fica ligeiramente acima da contagem de texto.

Por que escolher a Tosea.ai

Estimativa: caracteres ÷ 4

Funciona apenas razoavelmente para inglês e fica muito errado para chinês e código.

Campo de uso da API

Exato, mas custa uma chamada paga — inútil enquanto você redige um prompt.

Tosea.ai counter

Mesmas codificações, precisão exata e processamento local, atualizado em tempo real enquanto você digita e grátis.

Trate os tokens como um orçamento e seus prompts ficarão mais precisos e econômicos. Combine esta ferramenta com o verificador de impressão digital de APIs de LLM para confirmar se seu endpoint é legítimo ou converta PDFs em apresentações com IA — crie e verifique seu fluxo de trabalho de IA em um só lugar.

Ferramentas relacionadas

FAQ

Contador de tokens de LLM FAQ

Estas respostas explicam o que a ferramenta faz, quais arquivos ela aceita e quais são os limites atuais.

O que exatamente é um token?
Tokens são os fragmentos que um modelo de linguagem realmente lê — geralmente alguns caracteres, às vezes uma palavra inteira. Palavras comuns em inglês costumam corresponder a um token, enquanto palavras raras, código e textos em alfabetos não latinos são divididos em mais tokens. Os preços das APIs e os limites de contexto são medidos em tokens.
Qual codificação devo escolher?
o200k_base abrange GPT-5, GPT-4o e a série o; cl100k_base abrange GPT-4 e GPT-3.5. Para Qwen, GLM, Kimi e MiniMax, basta escolher o vocabulário com o mesmo nome. Se estiver em dúvida, use o200k_base.
A contagem se aplica ao Claude ou ao Gemini?
Qwen3.5, GLM-5.2, Kimi e MiniMax-M3 incluem seus vocabulários oficiais, portanto as contagens são exatas. Claude e Gemini mantêm seus tokenizadores privados — considere esses números uma estimativa: os orçamentos aproximados de tokens ainda podem ser aplicados entre modelos.
Meu texto é enviado para um servidor?
Não. O tokenizador é executado inteiramente no seu navegador. A tabela de codificação é baixada uma vez como um arquivo estático, e seu texto nunca sai do dispositivo.