मॉडल कीमतें

AI मॉडल की कीमतें

यहाँ दी गई हर दर 22 अगस्त 2026 को खुद प्रदाता के प्राइसिंग पेज से पढ़ी गई है। 11 प्रदाताओं के 56 मॉडलों की इनपुट, कैश और आउटपुट कीमतें साथ-साथ देखें — और अपनी टोकन संख्या भरकर जानें कि हर मॉडल पर एक रिक्वेस्ट का क्या खर्च आएगा।

  • 56 मॉडल
  • 11 प्रदाता
  • 22 अगस्त 2026 को जाँचा गया
रिक्वेस्ट की लागत निकालें
तयशुदा मान

क्रम बदलने के लिए कॉलम के शीर्षक पर क्लिक करें।

56 AI मॉडलों की प्रति दस लाख टोकन इनपुट, कैश-इनपुट और आउटपुट कीमतें, साथ में हर मॉडल की कॉन्टेक्स्ट विंडो, टोकन गिनती की सटीकता और प्रति रिक्वेस्ट अनुमानित लागत
प्रति 1Mप्रति 1Mप्रति 1Mगिनतीप्रति रिक्वेस्ट
GPT-5.6 Sol1OpenAI$4.00$0.400$20.001Mसटीक$0.060
GPT-5.6 Terra1OpenAI$2.00$0.200$12.001Mसटीक$0.032
GPT-5.6 Luna1OpenAI$0.200$0.020$1.201Mसटीक$0.00320
GPT-5.51OpenAI$5.00$0.500$30.001Mसटीक$0.080
GPT-5.41OpenAI$2.50$0.250$15.001Mसटीक$0.040
GPT-5.4 mini1OpenAI$0.750$0.075$4.50400Kसटीक$0.012
GPT-5.4 nano1OpenAI$0.200$0.020$1.25400Kसटीक$0.00325
GPT-5.11OpenAI$1.25$0.125$10.00400Kसटीक$0.022
GPT-4.11OpenAI$2.00$0.500$8.001Mसटीक$0.028
GPT-4o1OpenAI$2.50$1.25$10.00128Kसटीक$0.035
GPT-4o Mini1OpenAI$0.150$0.075$0.600128Kसटीक$0.00210
Claude Fable 52Anthropic$10.00$1.00$50.001Mअनुमान$0.150
Claude Opus 52Anthropic$5.00$0.500$25.001Mअनुमान$0.075
Claude Opus 4.82Anthropic$5.00$0.500$25.001Mअनुमान$0.075
Claude Opus 4.72Anthropic$5.00$0.500$25.001Mअनुमान$0.075
Claude Opus 4.62Anthropic$5.00$0.500$25.001Mअनुमान$0.075
Claude Opus 4.52Anthropic$5.00$0.500$25.00200Kअनुमान$0.075
Claude Sonnet 52Anthropic$2.00$0.200$10.001Mअनुमान$0.030
Claude Sonnet 4.62Anthropic$3.00$0.300$15.001Mअनुमान$0.045
Claude Sonnet 4.52Anthropic$3.00$0.300$15.00200Kअनुमान$0.045
Claude Haiku 4.52Anthropic$1.00$0.100$5.00200Kअनुमान$0.015
Gemini 3.1 Pro3Google$2.00$0.200$12.001Mअनुमान$0.032
Gemini 3.7 FlashGoogle$0.750$0.075$3.751Mअनुमान$0.011
Gemini 3.5 FlashGoogle$1.50$0.150$9.001Mअनुमान$0.024
Gemini 3.5 Flash-LiteGoogle$0.300$0.030$2.501Mअनुमान$0.00550
Gemini 2.5 Pro3Google$1.25$0.125$10.001Mअनुमान$0.022
Grok 4.64xAI$2.00$0.500$6.00500Kअनुमान$0.026
Grok 4.54xAI$2.00$0.300$6.00500Kअनुमान$0.026
Grok 4.34xAI$1.25$0.200$2.501Mअनुमान$0.015
Grok Build 0.14xAI$1.00$0.200$2.00256Kअनुमान$0.012
DeepSeek V4 Pro5DeepSeek$1.32$0.044$3.961Mअनुमान$0.017
DeepSeek V4 Flash5DeepSeek$0.440$0.014$1.321Mअनुमान$0.00572
LLaMA 3.3 70B6Meta (via API)$1.04$1.04128Kअनुमान$0.011
Qwen3.7 Max1617Alibaba$2.50$0.250$7.501Mअनुमान$0.033
Sonar7918Perplexity$1.00$1.00अनुमान$0.011
Sonar Pro7918Perplexity$3.00$15.00अनुमान$0.045
Sonar Reasoning Pro918Perplexity$2.00$8.00अनुमान$0.028
Sonar Deep Research8918Perplexity$2.00$8.00अनुमान$0.028
Kimi K310Moonshot AI$3.00$0.300$15.001Mअनुमान$0.045
Kimi K2.7 Code1011Moonshot AI$0.950$0.190$4.00262Kअनुमान$0.013
Kimi K2.610Moonshot AI$0.950$0.160$4.00262Kअनुमान$0.013
MiniMax M31213MiniMax$0.300$0.060$1.201Mअनुमान$0.00420
MiniMax M2.714MiniMax$0.300$0.060$1.20205Kअनुमान$0.00420
MiniMax M2.5MiniMax$0.300$0.030$1.20205Kअनुमान$0.00420
GLM-5.315Z.ai$1.40$0.280$4.401Mअनुमान$0.018
GLM-5.215Z.ai$1.40$0.280$4.401Mअनुमान$0.018
GLM-515Z.ai$1.00$0.200$3.20200Kअनुमान$0.013
GLM-5-Turbo15Z.ai$1.20$0.240$4.00200Kअनुमान$0.016
GLM-4.715Z.ai$0.600$0.120$2.20200Kअनुमान$0.00820
GLM-4.7-FlashX15Z.ai$0.070$0.014$0.400200Kअनुमान$0.00110
GLM-4.5-Air15Z.ai$0.200$0.040$1.10128Kअनुमान$0.00310
GLM-4.5-X1518Z.ai$2.20$0.440$8.90अनुमान$0.031
Qwen3.7 Plus1617Alibaba$0.400$0.040$1.601Mअनुमान$0.00560
Qwen3.6 Flash1617Alibaba$0.250$0.025$1.501Mअनुमान$0.00400
Qwen3.5 Flash17Alibaba$0.100$0.010$0.4001Mअनुमान$0.00140
Qwen3 Coder Plus1617Alibaba$1.00$0.100$5.001Mअनुमान$0.015

टिप्पणियाँ

  1. 272K इनपुट टोकन से बड़े प्रॉम्प्ट पर OpenAI ऊँची दर लेता है; यहाँ दिखाई गई दर स्टैंडर्ड टियर की है।
  2. कैश कॉलम में Anthropic की कैश-हिट रीड दर है। कैश में लिखने की लागत सामान्य इनपुट से अधिक है।
  3. 200K इनपुट टोकन से बड़े प्रॉम्प्ट पर Google लगभग इन दरों का दोगुना लेता है।
  4. 200K प्रॉम्प्ट टोकन से आगे xAI पूरी रिक्वेस्ट पर इन इनपुट, कैश और आउटपुट दरों का दोगुना लगाता है।
  5. स्टैंडर्ड (पीक) दरें। UTC 01:00–04:00 और 06:00–10:00 के बीच DeepSeek इनका आधा लेता है।
  6. Meta API की जगह मॉडल वेट जारी करता है, इसलिए यह एक होस्टेड सर्वरलेस दर (Together AI) है, प्रदाता की अपनी कीमत नहीं।
  7. टोकन दरों के अलावा Perplexity सर्च के लिए प्रति रिक्वेस्ट शुल्क लेता है: सर्च कॉन्टेक्स्ट के आकार के अनुसार प्रति 1,000 रिक्वेस्ट 5, 8 या 12 डॉलर।
  8. Deep Research इसके ऊपर प्रति दस लाख साइटेशन टोकन 2 डॉलर, प्रति दस लाख रीज़निंग टोकन 3 डॉलर और प्रति 1,000 सर्च 5 डॉलर लेता है।
  9. Sonar की चैट कम्प्लीशन अब Perplexity की Agent API में चली गई हैं; Sonar मॉडल 27 सितंबर 2026 तक समर्थित हैं।
  10. Moonshot ये दरें कर के बिना बताता है।
  11. "-highspeed" वैरिएंट इनपुट और आउटपुट पर इन दरों का दोगुना लेता है।
  12. 512K इनपुट टोकन तक स्टैंडर्ड सर्विस टियर। इससे ऊपर पूरी रिक्वेस्ट दोगुनी दर पर चढ़ती है, और प्रायोरिटी टियर लगभग 1.5 गुना महँगा है।
  13. MiniMax इसे स्थायी 50% छूट के रूप में सूचीबद्ध करता है; बिना छूट वाली सूची कीमत दोगुनी है।
  14. "-highspeed" वैरिएंट इन दरों का दोगुना लेता है।
  15. Z.ai कैश-हिट रीड पर इनपुट दर का पाँचवाँ हिस्सा लेता है।
  16. Alibaba रिक्वेस्ट के आकार के हिसाब से टियर लगाता है: इनपुट की सीमा पार करने पर (ज़्यादातर मॉडलों में 256K, Qwen3 Coder Plus में 32K) पूरी रिक्वेस्ट की कीमत बदल जाती है — Qwen3.7 Plus पर 1.20 डॉलर इनपुट / 4.80 डॉलर आउटपुट तक, और Qwen3 Coder Plus पर 6.00 / 60.00 डॉलर तक।
  17. Alibaba की सिंगापुर (अंतरराष्ट्रीय) मूल्य सूची। बीजिंग रीजन की बिलिंग अलग और भिन्न है।
  18. इस मॉडल के लिए प्रदाता कोई कॉन्टेक्स्ट विंडो प्रकाशित नहीं करता, इसलिए कॉलम में "—" दिखता है।

सभी दरें प्रति दस लाख टोकन, अमेरिकी डॉलर में।

22 अगस्त 2026 को हर प्रदाता के अपने प्राइसिंग पेज से जाँचा गया।

प्रदाता बिना सूचना कीमतें बदलते हैं, और कई टोकन दर के ऊपर अलग शुल्क भी लेते हैं — बजट बनाने से पहले प्रदाता के पेज पर पुष्टि कर लें।

सबसे सस्ते पहले

प्रति दस लाख टोकन सबसे बेहतर सौदा

इस तालिका की आउटपुट दरें $0.400 से $50.00 प्रति दस लाख टोकन तक फैली हैं — यानी 125 गुना का अंतर, जो किसी भी प्रॉम्प्ट ट्यूनिंग से बड़ा असर डालता है।

सबसे सस्ता इनपुट

  1. 1GLM-4.7-FlashXZ.ai$0.070प्रति दस लाख टोकन
  2. 2Qwen3.5 FlashAlibaba$0.100प्रति दस लाख टोकन
  3. 3GPT-4o MiniOpenAI$0.150प्रति दस लाख टोकन
  4. 4GLM-4.5-AirZ.ai$0.200प्रति दस लाख टोकन
  5. 5GPT-5.6 LunaOpenAI$0.200प्रति दस लाख टोकन

सबसे सस्ता आउटपुट

  1. 1GLM-4.7-FlashXZ.ai$0.400प्रति दस लाख टोकन
  2. 2Qwen3.5 FlashAlibaba$0.400प्रति दस लाख टोकन
  3. 3GPT-4o MiniOpenAI$0.600प्रति दस लाख टोकन
  4. 4SonarPerplexity$1.00प्रति दस लाख टोकन
  5. 5LLaMA 3.3 70BMeta (via API)$1.04प्रति दस लाख टोकन
प्रदाता के अनुसार

इस तालिका के प्रदाता

11 प्रदाता, हर एक उसी प्राइसिंग पेज से जुड़ा है जहाँ से ये आँकड़े लिए गए।

सामान्य प्रश्न

अक्सर पूछे जाने वाले प्रश्न

सबसे सस्ता AI मॉडल कौन सा है?

इनपुट में GLM-4.7-FlashX, $0.070 प्रति दस लाख टोकन; आउटपुट में GLM-4.7-FlashX, $0.400 प्रति दस लाख। आपके लिए कौन सस्ता है, यह आपके ट्रैफ़िक के स्वरूप पर निर्भर करता है: 10,000 टोकन के प्रॉम्प्ट और 1,000 टोकन के उत्तर पर GLM-4.7-FlashX की लागत $0.00110 है और GPT-5.6 Terra की $0.032। ऊपर अपनी संख्याएँ भरें और तालिका उसी हिसाब से क्रम बदल देगी।

मॉडलों की कीमतों की निष्पक्ष तुलना कैसे करें?

इनपुट और आउटपुट को उसी अनुपात में तोलें जिस अनुपात में आप मॉडल इस्तेमाल करते हैं। जो मॉडल लिखता है, उसके लिए प्रदाता आपके भेजे हुए टेक्स्ट से तीन से पाँच गुना तक लेते हैं — GPT-5.6 Terra पर इनपुट $2.00 और आउटपुट $12.00 है। इसलिए बहुत पढ़ने और थोड़ा लिखने वाला सारांश-टूल मॉडलों का क्रम उससे बिल्कुल अलग लगाएगा जो एक कोड जनरेटर लगाता है। सिर्फ़ इनपुट दरें मिलाने की जगह ऊपर दोनों संख्याएँ भरें, और टिप्पणियाँ पढ़ें: कई प्रदाता प्रॉम्प्ट के एक सीमा पार करते ही पूरी रिक्वेस्ट की कीमत बदल देते हैं।

कैश इनपुट प्राइसिंग क्या है?

जब लगातार आने वाली रिक्वेस्ट की शुरुआत एक जैसी हो — सिस्टम प्रॉम्प्ट, कोई दस्तावेज़, या उदाहरणों का लंबा हिस्सा — तो प्रदाता उस हिस्से को कैश से दे सकता है और उसका कम शुल्क लेता है। कैश कॉलम वही कैश-हिट रीड दर है, आमतौर पर स्टैंडर्ड इनपुट दर का 10 से 20 प्रतिशत: Claude Sonnet 5 कैश किया इनपुट $0.200 पर पढ़ता है, जबकि स्टैंडर्ड दर $2.00 है। कैश में लिखना हमेशा मुफ़्त नहीं होता, और डैश का मतलब है कि प्रदाता कोई कैश दर प्रकाशित ही नहीं करता।

ये कीमतें कितनी ताज़ा हैं?

हर आँकड़ा 22 अगस्त 2026 को प्रदाता के अपने प्राइसिंग पेज से पढ़ा गया, और हर प्रदाता कार्ड उसी पेज पर वापस ले जाता है। कुछ भी लाइव नहीं खींचा जाता, इसलिए इसे एक स्नैपशॉट मानें: प्रदाता बिना सूचना दरें बदलते हैं, और जो प्रोमो या ऑफ-पीक कीमतों पर चलते हैं (MiniMax, DeepSeek) वे सबसे जल्दी बदलते हैं।

कुछ खानों में डैश क्यों दिखता है?

क्योंकि प्रदाता वह आँकड़ा प्रकाशित नहीं करता, और अंदाज़ा लगाना खाली छोड़ने से बुरा होता। Perplexity Sonar मॉडलों की कॉन्टेक्स्ट विंडो नहीं बताता, Z.ai GLM-4.5-X के लिए अलग कॉन्टेक्स्ट लंबाई नहीं बताता, और Meta की होस्टेड LLaMA पंक्ति की कोई कैश दर नहीं है। डैश का मतलब हमेशा "प्रकाशित नहीं", कभी "शून्य" नहीं।

यह साइट किन मॉडलों के लिए टोकन ठीक-ठीक गिन सकती है?

56 पंक्तियों में से 11 के लिए — OpenAI के मॉडलों के लिए, क्योंकि OpenAI अपना टोकनाइज़र प्रकाशित करता है और कैलकुलेटर असली BPE शब्दावली (o200k_base) आपके ब्राउज़र में लोड करता है। बाकी सब पर "अनुमान" का निशान है और गिनती प्रति टोकन अक्षरों के अनुमान से होती है; सामान्य गद्य पर यह लगभग 10–15% के भीतर रहती है, पर कोड, JSON और ग़ैर-लातिन लिपियों पर अंतर बढ़ जाता है। कीमतें हर पंक्ति में प्रदाता की अपनी हैं; फ़र्क सिर्फ़ टोकन गिनती के भरोसे में है।

क्या इन कीमतों में सर्च और प्रति रिक्वेस्ट शुल्क शामिल हैं?

नहीं — तालिका में केवल टोकन दरें हैं, और कुछ प्रदाता उनके ऊपर शुल्क लेते हैं। Sonar सर्च के लिए कॉन्टेक्स्ट के आकार के अनुसार प्रति 1,000 रिक्वेस्ट 5 से 12 डॉलर जोड़ता है, Sonar Deep Research साइटेशन टोकन, रीज़निंग टोकन और सर्च का अलग शुल्क लेता है, और होस्टेड ओपन-वेट मॉडलों पर वही लगता है जो होस्ट लेता है, न कि मॉडल बनाने वाले की दर। टिप्पणियाँ हर उस पंक्ति को चिह्नित करती हैं जहाँ टोकन दर पूरा बिल नहीं है।

लंबे प्रॉम्प्ट की असल लागत क्या होती है?

200,000 इनपुट टोकन लें — एक पूरा उपन्यास, या किसी अनुबंध के कुछ सौ पन्ने। यह एक प्रॉम्प्ट GPT-5.6 Terra पर $0.400, Claude Sonnet 5 पर $0.400, Kimi K3 पर $0.600 और Qwen3.5 Flash पर $0.020 का पड़ता है। इस आकार पर टियर की टिप्पणियाँ ध्यान से देखें: Grok 4.6 पर 200K टोकन का प्रॉम्प्ट पूरी रिक्वेस्ट को दिखाई गई दरों से दोगुनी दर पर ले जाता है।

पहले टोकन गिनें

प्रति दस लाख टोकन की कीमत तभी मायने रखती है जब पता हो कि आपके टेक्स्ट में कितने टोकन हैं। टोकन कैलकुलेटर टाइप करते-करते गिनता है और नतीजे की लागत सभी मॉडलों पर निकालता है; फ़ाइल काउंटर वही काम PDF और Word दस्तावेज़ों के लिए करता है।