AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices

Prompt paste करें और 12 AI models में per-call, per-day और per-month cost compare करें

🔒 100% in-browser🆓 Free forever⚡ No sign-up
Note: नीचे दिया गया tool interface अभी सिर्फ़ English में available है। हम tools के UI एक-एक करके translate कर रहे हैं। इस tool को English में देखें →
Estimated ~20 input tokens (rough: 4 chars/token).
Cheapest
GPT-4o mini · $0.000303/call
Most expensive
Claude Opus 4 · $0.0378/call
Spread
124.8x
Model$/1M in$/1M outPer callPer dayPer monthFits?
GPT-4o mini
OpenAI · 128k ctx
$0.15$0.6$0.000303$0.3030$9.09✓
Llama 3.3 70B
Meta (via Groq) · 128k ctx
$0.59$0.79$0.000407$0.4068$12.204✓
DeepSeek V3
DeepSeek · 64k ctx
$0.27$1.1$0.000555$0.5554$16.662✓
Gemini 2.5 Flash
Google · 1000k ctx
$0.3$2.5$0.001256$1.256$37.68✓
Claude Haiku 4.5
Anthropic · 200k ctx
$1$5$0.002520$2.52$75.60✓
Mistral Large 2
Mistral · 128k ctx
$2$6$0.003040$3.04$91.20✓
Gemini 2.5 Pro
Google · 1000k ctx
$1.25$10$0.005025$5.025$150.75✓
GPT-4o
OpenAI · 128k ctx
$2.5$10$0.005050$5.05$151.50✓
o1-mini
OpenAI · 128k ctx
$3$12$0.006060$6.06$181.80✓
Claude Sonnet 4.5
Anthropic · 200k ctx
$3$15$0.007560$7.56$226.80✓
o1 (reasoning)
OpenAI · 200k ctx
$15$60$0.0303$30.30$909.00✓
Claude Opus 4
Anthropic · 200k ctx
$15$75$0.0378$37.80$1,134.00✓
Prices are public list pricing per 1M tokens and change often. Token counts are estimated (~4 chars/token in English) - use exact input tokens for precise cost. Cached rate applies to Anthropic/OpenAI/DeepSeek prompt caching where supported.
सिर्फ़ estimates। Results आपके दिए हुए inputs पर general formulas से generate होते हैं और सिर्फ़ information के लिए हैं। ये financial, tax, legal, medical या professional advice नहीं हैं और आपकी individual situation, jurisdiction, taxes, fees या health conditions को consider नहीं करते। Important figures हमेशा किसी qualified professional से verify करें। इस tool का use करके आप हमारे Terms & Disclaimer.

यह कैसे काम करता है

  1. 1
    अपना prompt paste करें

    Tool input tokens estimate करती है (~4 characters per token English में)। Precise numbers के लिए right पर exact token counts enter करें।

  2. 2
    Expected output tokens और call volume set करें

    Roughly responses कितनी long होंगी, और आप per day कितनी calls करते हैं।

  3. 3
    Cache hit rate adjust करें

    अगर आप Anthropic, OpenAI या DeepSeek prompt caching use करते हैं, slider ऊपर drag करें discounted cost देखने के लिए।

  4. 4
    Sorted table पढ़ें

    Models cheapest first sorted हैं, per-call, per-day और per-month totals और आपके prompt के लिए context window fit होता है या नहीं के साथ।

AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices के बारे में

Free AI model cost comparator। अपना prompt paste करें या exact input tokens enter करें, expected output length और per day calls set करें, और Claude Opus, Sonnet और Haiku, GPT-4o, o1, Gemini 2.5, Llama 3.3, Mistral Large और DeepSeek V3 में per-call और monthly cost देखें। Prompt caching factor करें। बिना 12 accounts खोले अपने budget के लिए right model pick करने में help करता है। 712 Tools पर AI Model Cost Comparator - Compare GPT, Claude, Gemini and Llama Prices पूरी तरह आपके browser के अंदर modern JavaScript APIs use करके चलता है - कोई server आपका data कभी नहीं देखता। मतलब instant results, full privacy और कोई upload limits नहीं।

Debugging session, quick sanity check या production incident - जब भी आपको prompt paste करें और 12 ai models में per-call, per-day और per-month cost compare करें करना हो, यह tool जितनी बार चाहें use कर सकते हैं, free में। कोई watermarks नहीं, कोई sign-up नहीं और tool के अंदर कोई ads नहीं।

अक्सर पूछे जाने वाले सवाल

Token estimates कितने accurate हैं?

Character-based estimate English text के लिए 10 से 15% के अंदर है। Different models थोड़ा differently tokenize करते हैं, इसलिए precise budget के लिए, exact input token field use करें या real API के through small sample run करें।

क्या ये prices current हैं?

Prices last update के time public list prices हैं। Providers pricing periodically change करते हैं; large volumes commit करने से पहले provider's pricing page check करें।

Prompt caching क्या है?

Anthropic, OpenAI और DeepSeek discount (roughly 90%) offer करते हैं उन input tokens पर जो calls के across repeated होते हैं, जैसे long system prompt। अगर आपके prompt का अधिकांश stable prefix है, cache hit rate high है और cost sharply drop होता है।

क्या मेरा prompt कहीं upload होता है?

नहीं। सारी calculation आपके browser में चलती है। आपका prompt text किसी server पर नहीं भेजा जाता।

और पढ़ें