LLM Token Counter & Cost Estimator

Estima tokens e API cost pra GPT-4o, Claude, Gemini e Llama

🔒 100% no browser🆓 Grátis pra sempre⚡ Sem sign-up
Nota: A interface da ferramenta abaixo por enquanto está só em inglês. Estamos traduzindo uma por uma. Ver essa ferramenta em inglês →
Characters
0
Words
0
Tokens (est.)
0
Context used
0.00%
Estimated cost per call
Input (0 × $2.5/1M)$0.000000
Output (500 × $10/1M)$0.005000
Total per call$0.005000
× 1,000 calls$5.00
× 1,000,000 calls$5000.00

Token counts are estimates based on average characters-per-token (~4 for GPT-4o). Actual counts from the model's tokenizer may differ by 5–15%. Prices reflect published rates and may change - check the provider's pricing page for authoritative numbers.

Como funciona

  1. 1
    Cola seu prompt

    Solta o prompt inteiro - system message, user message ou um contexto RAG longo.

  2. 2
    Pick um modelo

    Escolha GPT-4o, Claude, Gemini ou Llama. Cada um tem seu price e tokenizer ratio.

  3. 3
    Seta output tokens esperados

    Adiciona o response length que você espera. A tool mostra cost per-call e totais de 1K / 1M calls.

Sobre LLM Token Counter & Cost Estimator

LLM token counter e cost calculator grátis online. Cola qualquer prompt pra estimar o token count pra GPT-4o, GPT-4o mini, Claude Opus/Sonnet/Haiku, Gemini 2.0 e Llama 3, mais o API cost per-call e per-1M-call. Roda inteiro no seu browser. LLM Token Counter & Cost Estimator no 712 Tools roda inteiro dentro do seu browser via APIs nativas de JavaScript - nenhum server vê seus dados. Isso significa resultado na hora, privacidade total e nenhum limite de upload.

Seja pra uma sessão de debug, uma checagem rápida ou um incidente em produção, essa ferramenta é grátis e sem limite de uso. Sem watermarks, sem sign-up e sem ads dentro da ferramenta.

Perguntas frequentes

Quão precisos são os token counts?

São estimates baseados em average characters-per-token (~4 pra GPT, ~3.6 pra Claude). Counts reais do tokenizer do modelo costumam diferir em 5-15%.

De onde vêm os prices?

Rates publicados de OpenAI, Anthropic, Google e providers de Llama hosted. Rates mudam - sempre verifica com o provider antes de projetar financeiramente.

Meu prompt é enviado?

Não. Counting e cost math rodam inteiros no seu browser.

Por que context-used % importa?

Se um prompt se aproxima do context window do modelo, o modelo pode truncar ou rejeitar. O gauge te ajuda a ficar bem abaixo do limite.

Leia mais