LLM Token Counter & Cost Estimator

Estimá tokens y API cost para GPT-4o, Claude, Gemini y Llama

🔒 100% en el browser🆓 Gratis para siempre⚡ Sin sign-up
Nota: La interfaz de la herramienta de abajo por ahora solo está en inglés. Estamos traduciéndolas una a una. Ver esta herramienta en inglés →
Characters
0
Words
0
Tokens (est.)
0
Context used
0.00%
Estimated cost per call
Input (0 × $2.5/1M)$0.000000
Output (500 × $10/1M)$0.005000
Total per call$0.005000
× 1,000 calls$5.00
× 1,000,000 calls$5000.00

Token counts are estimates based on average characters-per-token (~4 for GPT-4o). Actual counts from the model's tokenizer may differ by 5–15%. Prices reflect published rates and may change - check the provider's pricing page for authoritative numbers.

Cómo funciona

  1. 1
    Pegá tu prompt

    Soltá el prompt completo - system message, user message o un contexto RAG largo.

  2. 2
    Pick un modelo

    Elegí GPT-4o, Claude, Gemini o Llama. Cada uno tiene su price y tokenizer ratio.

  3. 3
    Seteá output tokens esperados

    Agregá el response length que esperás. La tool muestra cost per-call y totales de 1K / 1M calls.

Sobre LLM Token Counter & Cost Estimator

LLM token counter y cost calculator gratis online. Pegá cualquier prompt para estimar el token count para GPT-4o, GPT-4o mini, Claude Opus/Sonnet/Haiku, Gemini 2.0 y Llama 3, plus el API cost per-call y per-1M-call. Corre entero en tu browser. LLM Token Counter & Cost Estimator en 712 Tools corre entero dentro de tu browser con APIs nativas de JavaScript - ningún server ve tus datos. Eso significa resultados al instante, privacidad total y sin límites de upload.

Ya sea para una sesión de debug, una comprobación rápida o un incidente en producción, esta herramienta es gratis y sin límite de usos. Sin watermarks, sin sign-up y sin ads dentro de la herramienta.

Preguntas frecuentes

¿Qué tan preciso es el token count?

Son estimates basados en average characters-per-token (~4 para GPT, ~3.6 para Claude). Los counts reales del tokenizer del modelo suelen diferir por 5-15%.

¿De dónde salen los prices?

Rates publicados de OpenAI, Anthropic, Google y providers de Llama hosted. Los rates cambian - siempre verificá con el provider antes de proyectar financieramente.

¿Se sube mi prompt?

No. Counting y cost math corren enteros en tu browser.

¿Por qué importa el context-used %?

Si un prompt se acerca al context window del modelo, el modelo puede truncar o rechazar. El gauge te ayuda a quedar bien debajo del límite.

Leer más