AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices

Pegá un prompt y compará per-call, per-day y per-month cost across 12 AI models

🔒 100% en el browser🆓 Gratis para siempre⚡ Sin sign-up
Nota: La interfaz de la herramienta de abajo por ahora solo está en inglés. Estamos traduciéndolas una a una. Ver esta herramienta en inglés →
Estimated ~20 input tokens (rough: 4 chars/token).
Cheapest
GPT-4o mini · $0.000303/call
Most expensive
Claude Opus 4 · $0.0378/call
Spread
124.8x
Model$/1M in$/1M outPer callPer dayPer monthFits?
GPT-4o mini
OpenAI · 128k ctx
$0.15$0.6$0.000303$0.3030$9.09✓
Llama 3.3 70B
Meta (via Groq) · 128k ctx
$0.59$0.79$0.000407$0.4068$12.204✓
DeepSeek V3
DeepSeek · 64k ctx
$0.27$1.1$0.000555$0.5554$16.662✓
Gemini 2.5 Flash
Google · 1000k ctx
$0.3$2.5$0.001256$1.256$37.68✓
Claude Haiku 4.5
Anthropic · 200k ctx
$1$5$0.002520$2.52$75.60✓
Mistral Large 2
Mistral · 128k ctx
$2$6$0.003040$3.04$91.20✓
Gemini 2.5 Pro
Google · 1000k ctx
$1.25$10$0.005025$5.025$150.75✓
GPT-4o
OpenAI · 128k ctx
$2.5$10$0.005050$5.05$151.50✓
o1-mini
OpenAI · 128k ctx
$3$12$0.006060$6.06$181.80✓
Claude Sonnet 4.5
Anthropic · 200k ctx
$3$15$0.007560$7.56$226.80✓
o1 (reasoning)
OpenAI · 200k ctx
$15$60$0.0303$30.30$909.00✓
Claude Opus 4
Anthropic · 200k ctx
$15$75$0.0378$37.80$1,134.00✓
Prices are public list pricing per 1M tokens and change often. Token counts are estimated (~4 chars/token in English) - use exact input tokens for precise cost. Cached rate applies to Anthropic/OpenAI/DeepSeek prompt caching where supported.
Solo estimaciones. Los resultados se generan con fórmulas generales a partir de los datos que introduces y son solo informativos. No son consejo financiero, fiscal, legal, médico ni profesional, y no tienen en cuenta tu situación, jurisdicción, impuestos, comisiones ni condiciones de salud. Verifica siempre cifras importantes con un profesional. Al usar esta herramienta aceptas nuestros Términos y Aviso legal.

Cómo funciona

  1. 1
    Pegá tu prompt

    La tool estima input tokens (~4 chars por token en inglés). Ingresá exact token counts a la derecha para números precisos.

  2. 2
    Seteá output tokens esperados y volumen de calls

    Aproximadamente qué tan largas serán las responses y cuántas calls hacés por día.

  3. 3
    Ajustá el cache hit rate

    Si usás prompt caching de Anthropic, OpenAI o DeepSeek, arrastrá el slider para arriba y ve el cost descontado.

  4. 4
    Leé la tabla sorted

    Los modelos vienen sorted cheapest first, con totales per-call, per-day y per-month y si el context window fitea tu prompt.

Sobre AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices

AI model cost comparator gratis. Pegá tu prompt o ingresá input tokens exactos, seteá output length esperado y calls por día, y ve per-call y monthly cost across Claude Opus, Sonnet y Haiku, GPT-4o, o1, Gemini 2.5, Llama 3.3, Mistral Large y DeepSeek V3. Considerá prompt caching. Te ayuda a pickear el modelo correcto para tu budget sin abrir 12 accounts. AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices en 712 Tools corre entero dentro de tu browser con APIs nativas de JavaScript - ningún server ve tus datos. Eso significa resultados al instante, privacidad total y sin límites de upload.

Ya sea para una sesión de debug, una comprobación rápida o un incidente en producción, esta herramienta es gratis y sin límite de usos. Sin watermarks, sin sign-up y sin ads dentro de la herramienta.

Preguntas frecuentes

¿Qué tan precisos son los token estimates?

El estimate character-based está dentro del 10-15% para texto en inglés. Diferentes modelos tokenizan diferente, así que para un budget preciso, usá el exact input token field o corré un sample chico por la API real.

¿Estos precios están vigentes?

Los prices son list prices públicos al momento del último update. Los providers cambian pricing periódicamente; chequeá la pricing page del provider antes de commitear volumen grande.

¿Qué es prompt caching?

Anthropic, OpenAI y DeepSeek ofrecen un discount (~90%) en input tokens que se repiten across calls, como un system prompt largo. Si la mayor parte de tu prompt es un stable prefix, el cache hit rate es alto y el cost cae fuerte.

¿Se sube mi prompt?

No. Todo el cálculo corre en tu browser. Tu prompt no se manda a ningún server.

Leer más