मुख्य सामग्री पर जाएं

Grok 4.6: फीचर्स, बेंचमार्क, कीमतें, और तुलना

SpaceXAI का नया मॉडल, Grok 4.6, GPT-5.6 Sol के Intelligence Index स्कोर से कम मापी गई कीमत पर मेल खाता है। बेंचमार्क, एजेंट फीचर्स, प्राइसिंग, और यह Grok 4.5 तथा Claude Sonnet 5 से कैसे तुलना करता है, देखें।
अद्यतन 21 अग॰ 2026  · 13 मि॰ पढ़ना

AI के साथ खोजें

ChatGPTClaudePerplexity

अधिकांश पाठक अभी भी Grok के पीछे की लैब को xAI के नाम से जानते हैं। SpaceXAI ने 12 अगस्त, 2026 को Grok 4.6 जारी किया, जो Grok 4.5 के थोड़े ही समय बाद आया, और फोकस कोडिंग, विज़ुअल वेब कार्य, तथा लंबे समय तक चलने वाले एजेंट कार्यों पर रहा।

लॉन्च डेटा कोई एक साधारण रैंकिंग सपोर्ट नहीं करता। Grok, SpaceXAI के कुछ चुने हुए परीक्षणों में आगे है, जबकि GPT-5.6 Sol और Claude Fable 5 अन्य में आगे हैं। Artificial Analysis, Grok को Sol के बराबर रखता है लेकिन कम मिश्रित कीमत पर; फिर भी यह अपग्रेड पहले उत्तर में देर से शुरू होता है और Grok 4.5 की तुलना में प्रति मापित कार्य अधिक महंगा पड़ता है।

यह लेख मॉडल के स्पेक्स, प्राइसिंग, एक्सेस, और Sol व Claude के साथ प्रत्यक्ष तुलना के जरिए उसी ट्रेड-ऑफ को देखता है। हमारी Grok 4.5 कवरेज ने कम टोकन उपयोग पर ध्यान केंद्रित किया था। यहाँ सवाल है कि क्या उच्च स्कोर वाकई बिल बदलता है—जब कैश्ड इनपुट, रीजनिंग टोकन, और अतिरिक्त आउटपुट को भी गिना जाए।

TL;DR: Grok 4.6

संक्षेप में, पाँच अंकों की बढ़त अपने आप में उतनी मायने नहीं रखती जितना लॉन्च पेज संकेत देता है। कीमत का व्यवहार और कार्य का प्रकार तय करेगा कि मॉडल की पसंद बदलेगी या नहीं।

  • high प्रयास पर, Grok 4.6 का स्कोर Artificial Analysis Intelligence Index पर 61 है—जो Sol के max के बराबर है और Opus 5 के max से दो अंक पीछे।

  • बेस इनपुट और आउटपुट दरें $2 और $6 प्रति मिलियन टोकन पर वही रहती हैं, लेकिन कैश्ड इनपुट, पहले टोकन की देरी, और प्रति कार्य मापी गई लागत Grok 4.5 से बढ़ गई हैं।

  • AA-Briefcase में, Grok ने Opus 5 की तुलना में कम टर्न और इनपुट टोकन लिए; Sol टर्मिनल परीक्षणों में आगे है, जबकि Sonnet 5 बिना लंबी-प्रॉम्प्ट सरचार्ज के दोगुना कॉन्टेक्स्ट देता है।

नीचे दी गई तुलनाएँ प्रदाता के दावों और Artificial Analysis के परिणामों को अलग रखती हैं। यह इसलिए महत्वपूर्ण है क्योंकि प्रयास स्तर या टेस्ट सेटअप बदलने पर किसी मॉडल की स्थिति भी बदल सकती है।

Grok 4.6 क्या है?

Grok 4.6, SpaceXAI का स्वामित्व वाला रीजनिंग मॉडल है। API और Cursor एक जैसे कॉन्टेक्स्ट लिमिट नहीं दिखाते, और लंबी कॉन्टेक्स्ट की ऊँची दर API लिमिट से काफी पहले शुरू हो जाती है। नीचे दी गई तालिका में इन बाधाओं को इनपुट प्रकारों, टूल्स, और नॉलेज कटऑफ के साथ रखा गया है।

स्पेसिफिकेशन

Grok 4.6

कॉन्टेक्स्ट विंडो

500,000 टोकन (API); 256,000 टोकन Cursor के अंदर

इनपुट / आउटपुट

टेक्स्ट और इमेज इन; टेक्स्ट आउट

रीजनिंग प्रयास

Low, medium, high (डिफ़ॉल्ट), xhigh

नॉलेज कटऑफ

1 फरवरी, 2026

टूल्स

फ़ंक्शन कॉलिंग, वेब सर्च, X सर्च, कोड एक्ज़ीक्यूशन, कलेक्शंस सर्च (RAG), रिमोट MCP

मानक प्राइसिंग

$2 / मिलियन इनपुट टोकन, $0.50 कैश्ड, $6 / मिलियन आउटपुट

लंबी-कॉन्टेक्स्ट प्राइसिंग

जब प्रॉम्प्ट 200,000 टोकन तक पहुँचता है तो $4 / $1 / $12, और यह पूरी रिक्वेस्ट पर लागू होता है

SpaceXAI अब भी किसी भी मॉडल के लिए पैरामीटर काउंट प्रकाशित नहीं करता। कुछ रिपोर्टों में 1.5 ट्रिलियन का जो आंकड़ा है, वह SpaceXAI से नहीं आया, इसलिए वह पुष्ट स्पेक नहीं है।

Grok 4.6 में नया क्या है?

SpaceXAI का कहना है कि यह जमीन से नया प्रशिक्षित मॉडल नहीं है। इसके बजाय, Grok 4.5 को और ट्रेनिंग दी गई, खासकर AI एजेंट कार्यों पर अतिरिक्त ध्यान के साथ। रिपोर्ट किए गए बदलाव लंबे एजेंट रन, विज़ुअल बिल्ड्स, और पोस्ट-ट्रेनिंग में आते हैं।

लंबे एजेंट कार्य

SpaceXAI के अनुसार Grok 4.6 लंबे और कई-चरण वाले कार्यों—जैसे रिसर्च, कोडबेस में काम करना, और एक एप्लिकेशन बनाना—के दौरान ट्रैक पर रहता है। रिपोर्ट के मुताबिक मॉडल एक ही पास में सब कुछ करने के बजाय अपना काम अधिक बार जाँचता है।

यह मॉडल टेस्टिंग में व्यापक बदलाव से मेल खाता है। अगर कई टूल कॉल के बाद मॉडल पहले के निर्णय भूल जाता है तो अच्छा पहला उत्तर कम मायने रखता है। GitHub की आंतरिक टेस्टिंग ने भी पाया कि Grok 4.6 लंबे कार्यों में रीजनिंग और टूल्स का उपयोग जारी रखता है।

API में इस दावे से जुड़े फीचर्स हैं। Grok 4.6 रीजनिंग समरी स्ट्रीम कर सकता है, जो Grok 4.5 में उपलब्ध नहीं है, और xAI लंबे एजेंट लूप्स के लिए स्टिकी context compaction विथ prompt_cache_key की सिफारिश करता है। कॉम्पैक्शन पुरानी हिस्ट्री को एक आइटम में छोटा करता है, लेकिन यह फिर भी टोकन उपयोग करता है, और कॉम्पैक्शन चलने से पहले रिक्वेस्ट को कॉन्टेक्स्ट विंडो में फिट होना चाहिए।

विज़ुअल और इंटरैक्टिव वेब डेवलपमेंट

SpaceXAI और Cursor दोनों विज़ुअल प्रोजेक्ट्स पर बेहतर पहले प्रयास की रिपोर्ट करते हैं। एक बाहरी टेस्ट में, Grok 4.6 ने iPod Mini के पुराने प्रोडक्ट पेज को एक 3D साइट के रूप में फिर से बनाया, जिसमें काम करता हुआ कलर व्हील और स्क्रॉल एनीमेशन था। डेमो काम करता था, लेकिन एक टेस्ट व्यापक दावे को साबित नहीं करता।

Grok 4.6 को कैसे पोस्ट-ट्रेन किया गया

यदि आपको केवल बेंचमार्क और प्राइसिंग की परवाह है, तो यह उपखंड छोड़ दें। यह बताता है कि SpaceXAI के अनुसार बढ़त कहाँ से आई।

SpaceXAI ने Grok 4.5 की तुलना में अधिक ट्रेनिंग चलाई। इसने AI-निर्मित रीजनिंग उदाहरण और इंजीनियरिंग उदाहरण उपयोग किए, मॉडल-आधारित जांच के साथ कमजोर उदाहरण हटाए, और फिर रीइन्फोर्समेंट लर्निंग का उपयोग कोडिंग, ऑफिस कार्य, वेब डेवलपमेंट, कर्नेल ट्यूनिंग, और कंप्यूटर डिज़ाइन के लिए किया। SpaceXAI यह भी कहता है कि Grok 4.5 ने अलग-अलग रीजनिंग सेटिंग्स और विषयों में नए ट्रेनिंग उदाहरण बनाए। कंपनी बढ़त का श्रेय अधिक ट्रेनिंग और सख्त डेटा चयन को देती है, न कि नई आर्किटेक्चर को।

बाहरी टीमें इन विवरणों की जाँच नहीं कर सकतीं, और SpaceXAI ने ट्रेनिंग दोहराने लायक पर्याप्त जानकारी साझा नहीं की है। यह कंपनी का अपना विवरण है, न कि किसी और द्वारा जाँचा गया परिणाम।

Grok 4.6 बेंचमार्क: आधिकारिक और स्वतंत्र परिणाम

SpaceXAI की लॉन्च तालिका दिखाती है कि कहाँ स्कोर बढ़े, लेकिन इसके प्रतिस्पर्धी स्कोर "स्व-रिपोर्टेड या सार्वजनिक परिणामों में से सर्वश्रेष्ठ" हैं। एक ही टीम ने हर मॉडल को एक जैसे सेटअप में नहीं चलाया। नीचे रीजनिंग प्रयास शामिल है क्योंकि यह स्कोर को प्रभावित करता है।

बेंचमार्क

Grok 4.6 (high)

Grok 4.5 (high)

GPT-5.6 Sol (max)

Claude Fable 5 (max)

AA Intelligence Index

61

56

61

62

GDPVal-AA v2 (Elo)

1,753

1,526

1,728

1,741

DeepSWE 1.1

65.9%

54.0%

73.0%

70.0%

Terminal-Bench 3.0

26.0%

15.7%

34.6%

34.1%

APEX-Agents

57.5%

47.1%

56.7%

59.2%

CursorBench v3.2

69.9%

66.7%

67.2%

70.5%

Grok 4.6 पूरे टेबल में Grok 4.5 पर सुधार दिखाता है। Sol के सबसे बड़े अंतर DeepSWE और Terminal-Bench पर दिखते हैं, जबकि Fable 3 पंक्तियों में आगे है। SpaceXAI की अपनी तालिका भी किसी एक विजेता की ओर इशारा नहीं करती।

स्वतंत्र बेंचमार्क परिणाम

Artificial Analysis ने अपना Intelligence Index इस तुलना के छह मॉडलों पर चलाया। इसके परिणाम SpaceXAI के आँकड़ों के करीब हैं, समान नहीं।

Grok 4.6, Grok 4.5, GPT-5.6 Sol, Claude Opus 5, Claude Sonnet 5, और Gemini 3.7 Flash की फ्रंटियर इंटेलिजेंस बनाम ब्लेंडेड कीमत की स्कैटर चार्ट तुलना

Grok 4.6 बनाम पाँच फ्रंटियर प्रतिद्वंद्वी। चित्र: लेखक द्वारा।

चार्ट Grok को इंटेलिजेंस पर Sol के बराबर रखता है, लेकिन मिश्रित कीमत पर बहुत नीचे। Artificial Analysis यह कीमत 7:2:1 के मिश्रण—कैश्ड इनपुट, अनकैश्ड इनपुट, और आउटपुट—से गणना करता है। प्रति पूर्ण इंडेक्स कार्य लागत में भी वही अंतर दिखता है: Grok के लिए $0.84, Sol के लिए $1.23, और Opus 5 के लिए $2.34।

पहले उत्तर के टोकन तक पहुँचने का समय Grok 4.5 के 14.62 सेकंड से बढ़कर 40.44 सेकंड हो गया, जबकि प्रति कार्य लागत $0.36 से बढ़कर $0.84 हो गई। Grok 4.6 ने उन्हीं परीक्षणों पर लगभग 20% अधिक आउटपुट टोकन उपयोग किए, इसलिए अपरिवर्तित सूची मूल्य का मतलब अपरिवर्तित कार्य लागत नहीं है। प्रति पूर्ण कार्य लागत API की प्राइस कार्ड से बेहतर तस्वीर देती है क्योंकि यह काम पूरा करने में उपयोग हुई अतिरिक्त रीजनिंग का कुछ हिस्सा भी शामिल करती है।

GPT-5.6 Sol और Claude Sonnet 5 की तुलना में, Grok 4.6 अपना पहला उत्तर टोकन जल्दी भेजता है। Sol max प्रयास पर 213.52 सेकंड लेता है, और Sonnet 5 184.48 सेकंड, जबकि Grok 40.44 लेता है। Grok केवल कम-विलंबता मॉडलों जैसे Gemini 3.7 Flash के मुकाबले धीमा लगता है।

ये बेंचमार्क तुलना कितनी भरोसेमंद हैं?

ये सापेक्ष ताकतें पहचानने में उपयोगी हैं, लेकिन क्रॉस-मॉडल रैंकिंग के लिए भरोसेमंद नहीं। रीजनिंग प्रयास स्कोर और प्रतिक्रिया समय बदलता है: GPT-5.6 Sol ने high प्रयास पर 57 और max पर 61 स्कोर किया। बेंचमार्क नाम भी अलग वर्ज़न का संकेत दे सकते हैं, इसलिए xAI का Terminal-Bench 3.0 और Artificial Analysis का Terminal-Bench 2.1 आपस में तुलनीय नहीं हैं।

Grok 4.5 से क्या बदला?

Grok 4.5 उपयोगकर्ताओं के लिए निर्णय यह नहीं है कि 4.6 "बेहतर" है या नहीं। बल्कि यह कि क्या उच्च स्कोर अलग लेटेंसी और टोकन-उपयोग प्रोफाइल की भरपाई करता है। नीचे तालिका इन्हें एक ही आधार पर रखती है।

माप

Grok 4.5 (high)

Grok 4.6 (high)

AA Intelligence Index

56

61

प्रति इंडेक्स कार्य लागत

$0.36

$0.84

पहले उत्तर टोकन तक समय

14.62s

40.44s

कैश्ड इनपुट कीमत

$0.30 / M

$0.50 / M 

इंडेक्स चलाने में उपयोग किए आउटपुट टोकन

60M

72M

बेस इनपुट / आउटपुट कीमत

$2 / $6

$2 / $6 (अपरिवर्तित)

हालाँकि, "समान कीमत" केवल बेस सूची दर का वर्णन करती है। Grok 4.5 उपयोगकर्ताओं के लिए एक और बदलाव मायने रखता है: कैश्ड इनपुट 67% बढ़कर $0.30 से $0.50 प्रति मिलियन टोकन हो गया। ऊँची कैश दर, प्राइस कार्ड और पूर्ण कार्य लागत के बीच के अंतर को बढ़ाती है।

प्रतिस्पर्धा के मुकाबले Grok 4.6

अब जब अपने पूर्ववर्ती से तुलना स्पष्ट हो गई, तो देखते हैं Grok 4.6, OpenAI और Anthropic के अन्य अत्याधुनिक मॉडलों की तुलना में कैसा है।

Grok 4.6 बनाम GPT-5.6 Sol

इंडेक्स पर टाई एक साफ़ विभाजन को छुपाती है। DeepSWE पर Sol, Grok से 7.1 अंक और Terminal-Bench पर 8.6 अंक आगे है, जो टर्मिनल-हेवी कोडिंग को इसका सबसे मजबूत केस बनाता है। बाकी तीन कार्य पंक्तियों में Grok का स्कोर अधिक है।

OpenAI के अपने परीक्षण उस टर्मिनल परिणाम को वेब ब्राउज़िंग और कंप्यूटर उपयोग तक बढ़ाते हैं। ये नियंत्रित तुलना नहीं, बल्कि विक्रेता-चयनित प्रमाण हैं, फिर भी दिशा वही है: Sol का सबसे मजबूत केस वह काम है जो टर्मिनल, ब्राउज़र, या बार-बार टूल कॉल पर निर्भर करता है।

OpenAI ने Sol के लिए Ultrafast मोड का प्रीव्यू भी दिखाया है, जो कथित तौर पर 14 गुना तक तेज़ चलता है। अभी इसकी कीमत प्रकाशित नहीं है, इसलिए यह लागत तुलना में शामिल नहीं है।

Grok 4.6 $2 इनपुट और $6 आउटपुट प्रति मिलियन टोकन से शुरू होता है। Sol की मानक दर $5 इनपुट और $30 आउटपुट है, जो Grok के आउटपुट मूल्य का पाँच गुना है। 272,000 टोकन से ऊपर, Sol इनपुट कीमत दोगुनी कर देता है और आउटपुट को $45 तक बढ़ा देता है।

इसका यह मतलब नहीं कि हर Grok कार्य पाँच गुना सस्ता होगा। रीजनिंग-टोकन उपयोग, कैश हिट्स, और टर्न की संख्या अंतिम बिल बदलते हैं। Grok का मूल्य लाभ तब सबसे स्पष्ट होता है जब टोकन उपयोग अनुमानित हो। टर्मिनल-हेवी काम के लिए, Sol के ऊँचे बेंचमार्क स्कोर सूची-मूल्य अंतर से अधिक मायने रख सकते हैं।

Grok 4.6 बनाम Claude Sonnet 5

Sonnet 5 और Grok 4.6 दोनों $2 प्रति मिलियन इनपुट टोकन से शुरू होते हैं, जिससे उनकी कीमतों की तुलना आसान हो जाती है। Sonnet 5 का डिफ़ॉल्ट कॉन्टेक्स्ट विंडो 1 मिलियन टोकन है—Grok के 500,000 का दोगुना—और लंबी प्रॉम्प्ट के लिए कोई ऊँची दर नहीं। आउटपुट की कीमत Grok के $6 के मुकाबले $10 प्रति मिलियन है।

Grok 4.6 के लॉन्च से दो दिन पहले, Anthropic ने $2/$10 प्राइसिंग को स्थायी कर दिया और नियोजित $3/$15 बढ़ोतरी वापस ले ली। यह पुराने प्राइस शीट—हमारे पुराने एक सहित—से तुलना करते समय मायने रखता है।

Artificial Analysis इंडेक्स पर, Sonnet 5 का स्कोर max प्रयास पर 55 है—Grok 4.6 से छह अंक कम। इसने परीक्षणों के लिए 300 मिलियन आउटपुट टोकन उपयोग किए, जबकि Grok ने 72 मिलियन, जिससे इसकी प्रति कार्य लागत $1.72 बैठती है। इसका टोकनाइज़र समान टेक्स्ट के लिए Sonnet 4.6 की तुलना में लगभग 30% अधिक टोकन बनाता है। इससे उन दोनों Sonnet वर्ज़न के बीच कीमत तुलना कठिन हो जाती है। Sonnet 5, Anthropic का शीर्ष मॉडल भी नहीं है।

Grok 4.6 बनाम Claude Opus 5 और Fable 5

Opus 5, $5 इनपुट और $25 आउटपुट पर, 63 के स्कोर के साथ इंडेक्स में सबसे ऊपर है। Fable 5, $10 इनपुट और $50 आउटपुट पर, 62 स्कोर करता है। Fable के इंडेक्स स्कोर पर एक टिप्पणी भी ज़रूरी है: Artificial Analysis ने कुछ कठिन प्रॉम्प्ट पर सेफ्टी फॉलबैक दर्ज किए, इसलिए स्कोर उस मॉडल को दर्शाता है जिसे लोग उपयोग कर सकते हैं, न कि वह अनरिस्ट्रिक्टेड वर्ज़न जिसे Anthropic पेश नहीं करता।

Artificial Analysis के लंबे एजेंट कार्यों के AA-Briefcase बेंचमार्क पर, Grok 4.6 ने लगभग 53 टर्न में पूरा किया और 0.5 बिलियन इनपुट टोकन उपयोग किए। Opus 5 को लगभग 103 टर्न और 2 बिलियन टोकन लगे। इसका अर्थ यह नहीं कि कुल मिलाकर Grok अधिक शक्तिशाली है। इसका मतलब है कि इस टेस्ट सेट पर Grok ने कम स्टेप और कम इनपुट टोकन लिए, जबकि अन्य परीक्षणों में ऊपर बताई गई तरह Claude आगे रहा।

Grok 4.6 प्राइसिंग

200,000-टोकन प्रॉम्प्ट सीमा वह हिस्सा है जिस पर मैं नज़र रखूंगा: यह रिक्वेस्ट के हर टोकन को ऊँचे टियर में ले जाती है। तालिका में प्रायोरिटी और टूल चार्ज भी शामिल हैं।

आइटम

दर

इनपुट टोकन, 200K प्रॉम्प्ट से कम

$2.00 / मिलियन

कैश्ड इनपुट, 200K प्रॉम्प्ट से कम

$0.50 / मिलियन

आउटपुट टोकन, 200K प्रॉम्प्ट से कम

$6.00 / मिलियन

इनपुट / कैश्ड / आउटपुट (200K प्रॉम्प्ट से ऊपर)

$4.00 / $1.00 / $12.00

तेज़ या प्रायोरिटी प्रोसेसिंग

मानक दर का 2x

वेब सर्च, X सर्च, कोड एक्ज़ीक्यूशन

$5 प्रति 1,000 कॉल

टूल चार्ज टोकन चार्ज से अलग होते हैं। कोई रिक्वेस्ट जो वेब सर्च करती है और फिर कोड चलाती है, वह अंतिम टेक्स्ट बिलिंग से पहले दोनों टूल फीस लगा सकती है। कोई अलग grok-4.6-fast मॉडल नाम नहीं है। डायरेक्ट API में एक प्रायोरिटी विकल्प है, जो प्रतिक्रिया में प्रायोरिटी उपयोग की पुष्टि होने पर 2x पर बिल होता है। Cursor समान 2x दर पर अलग "Grok 4.6 (Fast)" विकल्प दिखाता है।

Cursor मॉडल पिकर जिसमें Grok 4.6 Fast मोड और extra-high रीजनिंग सक्षम दिख रहा है

Cursor के अंदर Grok 4.6 Fast चयनित। चित्र: लेखक द्वारा।

मैं Grok 4.6 तक कैसे पहुँचूँ?

Grok 4.6 प्रथम-पक्ष रूप में उपलब्ध है: 

  • SpaceXAI API
  • Cursor
  • Grok Build
  • थर्ड-पार्टी गेटवे (OpenRouter, Vercel, Cloudflare, Google Cloud Vertex AI)
  • अन्य कोडिंग टूल (GitHub Copilot, VS Code, JetBrains, Xcode, और Eclipse)

रोलआउट में Pro, Pro+, Max, Business, और Enterprise प्लान शामिल हैं। Business और Enterprise एडमिन्स को मॉडल ऑन करना होगा क्योंकि यह डिफ़ॉल्ट रूप से ऑफ होता है। Grok 4.6 SpaceXAI के Batch API पर सपोर्टेड नहीं है, इसलिए कोई डिस्काउंटेड बैच विकल्प नहीं है।

एंटरप्राइज़ से जुड़ी एक जानकारी मॉडल उपलब्धता से अलग है। प्रतिक्रियाएँ डिफ़ॉल्ट रूप से स्टेटफुल होती हैं और SpaceXAI कहता है कि हिस्ट्री 30 दिनों तक स्टोर होती है। Zero Data Retention के तहत, टीमें स्टोर की गई प्रतिक्रिया-चेन या डिफर्ड कम्प्लीशन का उपयोग नहीं कर सकतीं; xAI इसके बजाय एन्क्रिप्टेड रीजनिंग रिप्ले और WebSocket Responses की ओर इशारा करता है। प्रत्येक प्रतिक्रिया में एक हेडर होता है जो दिखाता है कि ZDR सक्रिय था या नहीं।

Grok 4.6 का लॉन्च वीक: मॉडल्स, Copilot, और Cursor

उस हफ्ते मुझे जो सबसे अलग दिखा, वह था कि कैसे मॉडल लॉन्च और डिस्ट्रीब्यूशन डील्स तेज़ी से Grok 4.6 के आसपास इकट्ठी हो गईं।

Grok 4.6 लॉन्च टाइमलाइन, छह AI प्रोडक्ट और डिस्ट्रीब्यूशन घटनाओं को चार माइलस्टोन में समूहित करती हुई

Grok 4.6 का लॉन्च वीक, बेंचमार्क से परे। चित्र: लेखक द्वारा।

Grok Bot ने मॉडल लॉन्च से पहले ही टोन सेट कर दिया था। शुरुआती-बेटा क्लाउड एजेंट को SuperGrok Heavy के साथ $300/माह या Cursor Ultra के साथ $200/माह पर बांधा गया था, अलग से नहीं बेचा गया—यानी एक्सेस को प्रीमियम प्लान से जोड़ा गया। फिर Grok 4.6 ने वही एजेंट फोकस API, Cursor, और Grok Build में आगे बढ़ाया।

Google के Gemini 3.7 Flash लॉन्च और OpenAI के GPT-5.6 Sol Ultrafast प्रीव्यू ने हफ्ते को और भी व्यस्त बना दिया। इसी दौरान, Copilot रोलआउट और Cursor का SpaceX से जुड़ना ने Grok के वितरण का दायरा बढ़ाया। Cursor ने इस प्रक्रिया को उसी वर्ष पहले हुई अपनी SpaceXAI साझेदारी तक जोड़ा और इस कदम को मॉडल स्कोर के बजाय SpaceX के GPUs तक पहुँच के इर्द-गिर्द फ्रेम किया। इसके पोस्ट में कहा गया है कि यह पहुँच, इसे कम लागत पर मॉडल बनाने में मदद करेगी।

मेरी पढ़ाई यह है कि SpaceXAI, Grok को उन टूल्स के अंदर लाना चाहता है जिन्हें लोग पहले से उपयोग करते हैं। Grok 4.5 Cursor के साथ संयुक्त रूप से प्रशिक्षिता, और Grok 4.6 लगभग तुरंत Copilot में चला गया। इससे पार्टनर डिस्ट्रीब्यूशन रिलीज़ का हिस्सा बनता है, बाद की सोच नहीं।

आपको Grok 4.6 कब उपयोग करना चाहिए?

Grok 4.6 वहाँ फिट बैठता है जहाँ API कीमत और लंबे एजेंट कार्य, पहले-टोकन लेटेंसी से अधिक मायने रखते हैं। जब Sol के ऊँचे टर्मिनल स्कोर या Sonnet 5 की बड़ी कॉन्टेक्स्ट विंडो कार्य से अधिक मेल खाती है, तो इसकी फिटिंग कमजोर पड़ती है।

Grok 4.6 इन स्थितियों में उपयुक्त है:

  • API कीमत प्राथमिक बाधा है। यह सूची-मूल्य और प्रति कार्य लागत पर Sol, Opus 5, और Fable 5 से सस्ता बैठता है
  • काम लंबे, बहु-चरण एजेंट कार्यों के रूप में चलता है, जहाँ इसकी टर्न दक्षता (AA-Briefcase पर Opus 5 की तुलना में कम टर्न और इनपुट टोकन) फायदा देती है
  • कार्य नॉलेज वर्क या लीगल रीजनिंग है, जहाँ यह बेंचमार्क तालिका में आगे है
  • पहले-टोकन लेटेंसी मायने नहीं रखती। लंबी रन में धीमी शुरुआत शोर है, लेकिन इंटरैक्टिव चैट में पूरा अनुभव

इन स्थितियों में बेहतर विकल्प हो सकते हैं:

  • काम टर्मिनल-हेवी कोडिंग है → GPT-5.6 Sol (ऊँचे DeepSWE और Terminal-Bench स्कोर)
  • कार्य को बड़े कॉन्टेक्स्ट विंडो की ज़रूरत है → Claude Sonnet 5 (1M कॉन्टेक्स्ट, लंबी-प्रॉम्प्ट सरचार्ज नहीं)
  • आपको इंटरैक्टिव उपयोग के लिए सबसे कम लेटेंसी चाहिए → Gemini 3.7 Flash
  • आप केवल उच्चतम-स्तर की इंटेलिजेंस पर खरीद रहे हैं → Opus 5 (63) या Fable 5 (62) इंडेक्स में शीर्ष पर हैं

Grok 4.6 पर अंतिम विचार

Grok 4.6 एक असहज मध्य में आता है। यह इंडेक्स में पाँच अंक ऊपर जाता है और सूची-मूल्य पर Sol और Opus 5 से नीचे रहता है, फिर भी Grok 4.5 की तुलना में धीरे शुरू होता है और प्रति मापित कार्य अधिक महंगा पड़ता है। "समान कीमत, बेहतर मॉडल" रिलीज़ का आधा हिस्सा छोड़ देता है।

वह हिस्सा जो मैं अब भी देखना चाहता हूँ, वह है एक बहु-घंटे का रन जहाँ कोडबेस, टूल्स, और निर्देश लगातार बदलते रहें। Cursor और GitHub Copilot अब वह सेटिंग प्रदान करते हैं। यदि वहाँ करेक्शन और फेल्योर रेट कम रहते हैं, तो एजेंट-ट्रेनिंग के दावे को फिक्स्ड टेस्ट से परे प्रमाण मिलता है; यदि नहीं, तो पाँच-अंकों की बढ़त बस वही रह जाती है।

xAI API पर बिल्ड करने वाले पाठकों के लिए, हमारा Grok 4 API ट्यूटोरियल Python क्लाइंट और रिक्वेस्ट फ्लो को कवर करता है।

Grok 4.6 FAQs

क्या Grok 4.6, Grok 4.5 की जगह लेता है?

आधिकारिक तौर पर नहीं। SpaceXAI ने Grok 4.5 के लिए रिटायरमेंट तिथि की घोषणा नहीं की है, और यह अभी भी API और Cursor दोनों में सूचीबद्ध है। अभी 4.6 पर जबरन माइग्रेशन नहीं है।

क्या मैं Grok 4.6 को स्वयं होस्ट कर सकता/सकती हूँ?

नहीं। जैसा कि ऊपर बताया गया, कोई ओपन वेट्स और कोई प्रकाशित पैरामीटर काउंट नहीं है, इसलिए आपके अपने हार्डवेयर पर डाउनलोड करके चलाने के लिए कुछ नहीं है। हर एक्सेस रूट, डायरेक्ट API सहित, SpaceXAI के इन्फ्रास्ट्रक्चर या उसके रीसेलिंग पार्टनर के माध्यम से जाता है।

GitHub Copilot, Grok 4.6 का बिलिंग कैसे करता है?

Copilot, Grok 4.6 उपयोग को GitHub AI Credits में कन्वर्ट करता है, प्रदाता की सूची-मूल्य पर, जहाँ एक सेंट एक क्रेडिट के बराबर होता है। सामान्य कोड कम्प्लीशन और अगला-एडिट सुझाव AI Credits में बिल नहीं होते। चैट या एजेंट कार्यों में मॉडल उपयोग Copilot के उपयोग नियमों का पालन करता है।

क्या Grok 4.6 EU में उपलब्ध है?

हाँ, लेकिन प्रोसेसिंग US में होती है। EU उपयोगकर्ता Grok 4.6 तक पहुँच सकते हैं (साझा Grok 4.5 बेस EU AI Act पास कर चुका है और जुलाई में EU उपयोगकर्ताओं के लिए खुला था, और 4.6 Cursor में EU भर में शिप होता है), लेकिन EU डेटा रेजिडेंसी नहीं है। xAI के मॉडल पेज में केवल us-east-1 और us-west-2 सूचीबद्ध हैं, इसलिए रिक्वेस्ट US में चलती हैं। भरोसा करने से पहले प्रत्येक सरफेस (API कंसोल, Cursor, गेटवे) पर पुष्टि करें।

क्या Grok 4.6, Cursor की US डेटा रेजिडेंसी के साथ काम करता है?

Grok 4.6 अब Cursor में उपलब्ध है (इसका अपना मॉडल पेज है), लेकिन US-ओनली डेटा रेजिडेंसी एक एंटरप्राइज़ फीचर है जो केवल सपोर्टेड मॉडलों को कवर करता है, कुछ अपवादों के साथ। इसलिए भरोसा करने से पहले पुष्टि करें कि 4.6 Cursor की मौजूदा सपोर्टेड-मॉडल सूची में है।

विषय

DataCamp के साथ AI सीखें!

Track

एआई मूलभूत बातें

10 घंटा
AI की मूल बातें जानें, काम के लिए AI का प्रभावी उपयोग करना सीखें, और ChatGPT जैसे मॉडल्स में गहराई से उतरकर गतिशील AI परिदृश्य को समझें।
विस्तृत जानकारी देखेंRight Arrow
कोर्स शुरू करें

course

डेवलपर्स के लिए AI-असिस्टेड कोडिंग

1 घंटा 30 मिनट
8.5K
AI से अपनी कोडिंग को बेहतर बनाएं—अपने कोडिंग असिस्टेंट को कोड लिखने, टेस्ट करने और दस्तावेज़ीकरण करने के लिए प्रभावी ढंग से मार्गदर्शन करें।
और देखेंRight Arrow