AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices
Cola um prompt e compara per-call, per-day e per-month cost across 12 AI models
| Model | $/1M in | $/1M out | Per call | Per day | Per month | Fits? |
|---|---|---|---|---|---|---|
GPT-4o mini OpenAI · 128k ctx | $0.15 | $0.6 | $0.000303 | $0.3030 | $9.09 | ✓ |
Llama 3.3 70B Meta (via Groq) · 128k ctx | $0.59 | $0.79 | $0.000407 | $0.4068 | $12.204 | ✓ |
DeepSeek V3 DeepSeek · 64k ctx | $0.27 | $1.1 | $0.000555 | $0.5554 | $16.662 | ✓ |
Gemini 2.5 Flash Google · 1000k ctx | $0.3 | $2.5 | $0.001256 | $1.256 | $37.68 | ✓ |
Claude Haiku 4.5 Anthropic · 200k ctx | $1 | $5 | $0.002520 | $2.52 | $75.60 | ✓ |
Mistral Large 2 Mistral · 128k ctx | $2 | $6 | $0.003040 | $3.04 | $91.20 | ✓ |
Gemini 2.5 Pro Google · 1000k ctx | $1.25 | $10 | $0.005025 | $5.025 | $150.75 | ✓ |
GPT-4o OpenAI · 128k ctx | $2.5 | $10 | $0.005050 | $5.05 | $151.50 | ✓ |
o1-mini OpenAI · 128k ctx | $3 | $12 | $0.006060 | $6.06 | $181.80 | ✓ |
Claude Sonnet 4.5 Anthropic · 200k ctx | $3 | $15 | $0.007560 | $7.56 | $226.80 | ✓ |
o1 (reasoning) OpenAI · 200k ctx | $15 | $60 | $0.0303 | $30.30 | $909.00 | ✓ |
Claude Opus 4 Anthropic · 200k ctx | $15 | $75 | $0.0378 | $37.80 | $1,134.00 | ✓ |
Como funciona
- 1Cola seu prompt
A tool estima input tokens (~4 chars por token em inglês). Digita exact token counts à direita pra números precisos.
- 2Seta output tokens esperados e volume de calls
Aproximadamente quão longas serão as responses e quantas calls você faz por dia.
- 3Ajusta o cache hit rate
Se você usa prompt caching de Anthropic, OpenAI ou DeepSeek, arrasta o slider pra cima pra ver o cost com desconto.
- 4Lê a tabela sorted
Modelos vêm sorted cheapest first, com totais per-call, per-day e per-month e se o context window fita seu prompt.
Sobre AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices
AI model cost comparator grátis. Cola seu prompt ou digita input tokens exatos, seta output length esperado e calls por dia, e vê per-call e monthly cost across Claude Opus, Sonnet e Haiku, GPT-4o, o1, Gemini 2.5, Llama 3.3, Mistral Large e DeepSeek V3. Considera prompt caching. Ajuda a pickar o modelo certo pro seu budget sem abrir 12 accounts. AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices no 712 Tools roda inteiro dentro do seu browser via APIs nativas de JavaScript - nenhum server vê seus dados. Isso significa resultado na hora, privacidade total e nenhum limite de upload.
Seja pra uma sessão de debug, uma checagem rápida ou um incidente em produção, essa ferramenta é grátis e sem limite de uso. Sem watermarks, sem sign-up e sem ads dentro da ferramenta.
Perguntas frequentes
Quão precisos são os token estimates?
O estimate character-based fica dentro de 10-15% pra texto em inglês. Modelos diferentes tokenizam diferente, então pra budget preciso, usa o exact input token field ou roda um sample pequeno pela API real.
Esses prices tão atuais?
Prices são list prices públicos no momento do último update. Providers mudam pricing periodicamente; confere a pricing page do provider antes de committar volume grande.
O que é prompt caching?
Anthropic, OpenAI e DeepSeek oferecem um desconto (~90%) em input tokens que são repetidos across calls, tipo um system prompt longo. Se a maior parte do seu prompt é um stable prefix, o cache hit rate é alto e o cost cai forte.
Meu prompt é enviado?
Não. Todo o cálculo roda no seu browser. Seu prompt não é enviado pra nenhum server.
Leia mais
Ferramentas relacionadas
Percentage Calculator
Quanto é X% de Y, X é qual % de Y, aumento, decrease e variação percentual
Calculadora de financiamento
Calcula parcelas mensais, juros totais e amortização
Calculadora de empréstimo
Calcula parcelas, juros e amortização pra qualquer loan
BMI Calculator
Calcula seu IMC em unidades métricas ou imperiais
Calculadora de idade
Calcula sua idade exata em anos, meses, semanas e dias
Date Calculator
Calcula dias entre duas datas, ou soma/subtrai dias, semanas, meses ou anos de qualquer data