AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices

Cola um prompt e compara per-call, per-day e per-month cost across 12 AI models

🔒 100% no browser🆓 Grátis pra sempre⚡ Sem sign-up
Nota: A interface da ferramenta abaixo por enquanto está só em inglês. Estamos traduzindo uma por uma. Ver essa ferramenta em inglês →
Estimated ~20 input tokens (rough: 4 chars/token).
Cheapest
GPT-4o mini · $0.000303/call
Most expensive
Claude Opus 4 · $0.0378/call
Spread
124.8x
Model$/1M in$/1M outPer callPer dayPer monthFits?
GPT-4o mini
OpenAI · 128k ctx
$0.15$0.6$0.000303$0.3030$9.09✓
Llama 3.3 70B
Meta (via Groq) · 128k ctx
$0.59$0.79$0.000407$0.4068$12.204✓
DeepSeek V3
DeepSeek · 64k ctx
$0.27$1.1$0.000555$0.5554$16.662✓
Gemini 2.5 Flash
Google · 1000k ctx
$0.3$2.5$0.001256$1.256$37.68✓
Claude Haiku 4.5
Anthropic · 200k ctx
$1$5$0.002520$2.52$75.60✓
Mistral Large 2
Mistral · 128k ctx
$2$6$0.003040$3.04$91.20✓
Gemini 2.5 Pro
Google · 1000k ctx
$1.25$10$0.005025$5.025$150.75✓
GPT-4o
OpenAI · 128k ctx
$2.5$10$0.005050$5.05$151.50✓
o1-mini
OpenAI · 128k ctx
$3$12$0.006060$6.06$181.80✓
Claude Sonnet 4.5
Anthropic · 200k ctx
$3$15$0.007560$7.56$226.80✓
o1 (reasoning)
OpenAI · 200k ctx
$15$60$0.0303$30.30$909.00✓
Claude Opus 4
Anthropic · 200k ctx
$15$75$0.0378$37.80$1,134.00✓
Prices are public list pricing per 1M tokens and change often. Token counts are estimated (~4 chars/token in English) - use exact input tokens for precise cost. Cached rate applies to Anthropic/OpenAI/DeepSeek prompt caching where supported.
Só estimativas. Os resultados são gerados por fórmulas gerais a partir dos dados que você informa e servem só como informação. Não são conselho financeiro, fiscal, jurídico, médico ou profissional, e não consideram sua situação, jurisdição, impostos, taxas ou condições de saúde. Sempre verifique valores importantes com um profissional qualificado. Ao usar essa ferramenta você concorda com os nossos Termos e Aviso legal.

Como funciona

  1. 1
    Cola seu prompt

    A tool estima input tokens (~4 chars por token em inglês). Digita exact token counts à direita pra números precisos.

  2. 2
    Seta output tokens esperados e volume de calls

    Aproximadamente quão longas serão as responses e quantas calls você faz por dia.

  3. 3
    Ajusta o cache hit rate

    Se você usa prompt caching de Anthropic, OpenAI ou DeepSeek, arrasta o slider pra cima pra ver o cost com desconto.

  4. 4
    Lê a tabela sorted

    Modelos vêm sorted cheapest first, com totais per-call, per-day e per-month e se o context window fita seu prompt.

Sobre AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices

AI model cost comparator grátis. Cola seu prompt ou digita input tokens exatos, seta output length esperado e calls por dia, e vê per-call e monthly cost across Claude Opus, Sonnet e Haiku, GPT-4o, o1, Gemini 2.5, Llama 3.3, Mistral Large e DeepSeek V3. Considera prompt caching. Ajuda a pickar o modelo certo pro seu budget sem abrir 12 accounts. AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices no 712 Tools roda inteiro dentro do seu browser via APIs nativas de JavaScript - nenhum server vê seus dados. Isso significa resultado na hora, privacidade total e nenhum limite de upload.

Seja pra uma sessão de debug, uma checagem rápida ou um incidente em produção, essa ferramenta é grátis e sem limite de uso. Sem watermarks, sem sign-up e sem ads dentro da ferramenta.

Perguntas frequentes

Quão precisos são os token estimates?

O estimate character-based fica dentro de 10-15% pra texto em inglês. Modelos diferentes tokenizam diferente, então pra budget preciso, usa o exact input token field ou roda um sample pequeno pela API real.

Esses prices tão atuais?

Prices são list prices públicos no momento do último update. Providers mudam pricing periodicamente; confere a pricing page do provider antes de committar volume grande.

O que é prompt caching?

Anthropic, OpenAI e DeepSeek oferecem um desconto (~90%) em input tokens que são repetidos across calls, tipo um system prompt longo. Se a maior parte do seu prompt é um stable prefix, o cache hit rate é alto e o cost cai forte.

Meu prompt é enviado?

Não. Todo o cálculo roda no seu browser. Seu prompt não é enviado pra nenhum server.

Leia mais