Your session has been flagged for unusual activity.
Confirme que você é uma pessoa para continuar.
Conte os tokens de GPT-4, Claude, Gemini e Grok antes de enviar um prompt. Seu texto nunca sai do seu dispositivo — o tokenizador roda localmente.
Tokens
0
Caracteres
0
Palavras
0
Caract. / token
—
Custo estimado
Digite algo para ver o custo aproximado nos principais modelos.
Os grandes modelos de linguagem não leem caracteres ou palavras diretamente — eles leem tokens. Um token é um pedaço de texto que o modelo aprendeu a tratar como uma unidade. Em inglês, um token tem em média cerca de quatro caracteres: uma palavra curta como "the" é um token, enquanto "tokenization" pode ser dois ou três.
Os tokens importam por três motivos práticos. Primeiro, todo modelo tem um número máximo de tokens que consegue processar de uma vez — sua janela de contexto. Segundo, os provedores de API cobram por token, separadamente para entrada e saída. Terceiro, a velocidade de resposta depende da quantidade de tokens: mais tokens significa mais processamento e mais espera.
Saber sua contagem de tokens antes de enviar um prompt ajuda você a ficar dentro da janela, prever o custo e cortar texto que não agrega valor.
Para os modelos de chat da OpenAI que usam esse tokenizador, esta ferramenta usa o tiktoken com a codificação cl100k_base — igual ao tokenizador usado no servidor pela API. A contagem é exata byte a byte.
Claude, Gemini e Grok usam tokenizadores proprietários que não são totalmente públicos. Nós os estimamos a partir de estatísticas textuais: o Claude tokeniza o inglês a cerca de 0,95× a taxa do GPT, o Gemini a 0,90×, e o Grok fica praticamente empatado com o GPT. Espere uma margem de 5 a 10% em relação à contagem real — precisão suficiente para planejar a janela de contexto e estimar custos.
Não. O tokenizador roda inteiramente no seu navegador — sem chamadas de rede, sem registro, sem armazenamento.
Os tokenizadores dividem palavras longas ou incomuns em partes. "Unbelievable" é uma palavra só, mas geralmente vira três tokens. Código, emojis e escritas fora do inglês são tokenizados de forma ainda mais pesada.
Sim. Cada byte que você envia — mensagem de sistema, mensagem do usuário, histórico da conversa — é tokenizado e cobrado.
Sim — e costumam ser mais caros que os tokens de entrada. Este contador mede apenas a entrada. Use nossa calculadora de custo para estimar o gasto total.
No MultipleChat você roda o mesmo prompt em todos os principais modelos — e a contagem de tokens é feita automaticamente.
Experimente o MultipleChat Grátis