Grok 4.6 का परिचय
आज हम SpaceXAI के साथ मिलकर Grok 4.6 जारी कर रहे हैं।
Grok 4.6, Grok 4.5 पर आधारित है और इसमें लंबे समय तक चलने वाले एजेंट्स तथा अधिक महत्वाकांक्षी इंटरैक्टिव और विज़ुअल कार्यों पर विशेष ध्यान दिया गया है। यह कई चरणों वाले जटिल कार्यों को पूरा करने में सक्षम है—चाहे किसी विषय पर अनुसंधान करना हो, जानकारी का विश्लेषण करना हो, किसी कोडबेस पर काम करना हो, या किसी विचार को एक परिष्कृत ऐप या कार्य आर्टिफ़ैक्ट में बदलना हो।
Grok 4.6 कई एजेंटिक कोडिंग और नॉलेज वर्क बेंचमार्क में अत्याधुनिक इंटेलिजेंस हासिल करता है। यह Artificial Analysis Intelligence Index पर GPT-5.6 Sol के बराबर है, जो नौ बेंचमार्क का संयुक्त स्कोर है।

Grok 4.6 आज Cursor और Grok Build में उपलब्ध है। पहले सप्ताह के लिए हम Cursor और Grok Build में 2x शामिल उपयोग दे रहे हैं।
Grok 4.6 का प्रशिक्षण
Grok 4.6 को Grok 4.5 की तुलना में अधिक लंबा अनुपूरक प्रशिक्षण दिया गया। इसमें तर्क और उन्नत तकनीकी अवधारणाओं के लिए क्यूरेट किया गया मॉडल-जनित डेटा, उच्च-गुणवत्ता वाला इंजीनियरिंग डेटा, और एक बेहतर ऑप्टिमाइज़र व प्रशिक्षण रेसिपी शामिल थे। इससे बाद के SFT और RL चरणों के लिए अधिक मज़बूत आधार तैयार हुआ।
इसके बाद हमने तर्क के विभिन्न प्रयास स्तरों, एजेंट हार्नेस और STEM, सॉफ़्टवेयर इंजीनियरिंग व नॉलेज वर्क जैसे डोमेन में SFT ट्रैजेक्टरीज़ को फिर से जनरेट करने के लिए Grok 4.5 का उपयोग किया। हमने मॉडल-आधारित जाँचों की मदद से समस्याग्रस्त ट्रेस हटा दिए। परिणामी SFT चेकपॉइंट मज़बूत प्रदर्शन और बेहतर व्यवहार दिखाता है।
Grok 4.6 को एजेंटिक RL कार्यों की एक विस्तृत शृंखला पर प्रशिक्षित किया गया है, जिसमें नॉलेज वर्क, सामान्य कोडिंग और कर्नेल अनुकूलन, वेब विकास, कंप्यूटर-सहायित डिज़ाइन आदि के लिए डोमेन-विशिष्ट परिवेश शामिल हैं।
महत्वाकांक्षी विचारों को कार्यशील प्रोजेक्ट्स में बदलना
हमने Grok 4.6 का परीक्षण ऐसे प्रोजेक्ट्स पर किया, जो इसकी क्षमताओं की सीमा और कई चरणों में लगातार काम करने की इसकी योग्यता को परखने के लिए डिज़ाइन किए गए थे। हमने पाया कि यह मॉडल किसी व्यापक उत्पाद विचार को एक कार्यशील शुरुआती संस्करण में बदलने में विशेष रूप से सक्षम है। यह अपरिचित डोमेनों पर अनुसंधान कर सकता है, ऐप की संरचना तैयार कर सकता है, मुख्य इंटरैक्शन लागू कर सकता है और फ़ीडबैक के कई दौरों के दौरान परिणाम को लगातार बेहतर बना सकता है।
लंबी ट्रैजेक्टरीज़ में, हमने अधिक स्व-परीक्षण और सत्यापन भी देखा, जहाँ मॉडल आगे बढ़ने से पहले अपने काम की जाँच करता है।
Grok 4.6 विज़ुअल और इंटरैक्टिव प्रोजेक्ट्स पर Grok 4.5 की तुलना में अधिक मजबूत शुरुआती परिणाम देता है। किसी ठोस उत्पाद विचार के साथ, यह एक ही प्रयास में ऐप की संरचना और विज़ुअल भाषा स्थापित कर सकता है। इससे यह उन प्रोजेक्ट्स के लिए विशेष रूप से उपयोगी बन गया है, जहाँ अच्छे परिणाम तक पहुँचने का सबसे तेज़ मार्ग किसी ठोस चीज़ से शुरू करना और फिर लूप में उस पर पुनरावृत्ति करना था।
सेफ़्टी और क्षमताएँ
Grok 4.6 के सुरक्षा उपायों को मॉडल की क्षमताओं के अनुरूप बेहतर बनाया और कैलिब्रेट किया गया है।
हमारा सेफ़्टी स्टैक वैध उपयोग के मामलों में उपयोगिता और सुरक्षा को अधिकतम करने के लिए डिज़ाइन किया गया है, ताकि Grok 4.6 भेद्यता पैचिंग, इंजीनियरिंग डिज़ाइन चक्र को तेज़ करने और AI अनुसंधान को सशक्त बनाने जैसे डोमेन में उपयोगी और सुरक्षित हो सके।
हमारा सुरक्षा उपाय evaluation कार्य Grok 4.6 की विस्तृत क्षमताओं को दर्शाता है। इसमें क्षमताओं और सुरक्षा उपायों के कैलिब्रेशन के लिए अब तक का हमारा सबसे व्यापक प्री-डिप्लॉयमेंट टेस्टिंग सुइट, साथ ही व्यापक पोस्ट-डिप्लॉयमेंट तृतीय-पक्ष टेस्टिंग शामिल है।
Grok 4.6 के साथ शुरू करें
Grok 4.6 आज Cursor और Grok Build में उपलब्ध है। यह SpaceXAI API के साथ-साथ OpenRouter, Vercel और Cloudflare सहित पार्टनरों के ज़रिए भी उपलब्ध है।
मूल्य निर्धारण 6 प्रति मिलियन आउटपुट टोकन से शुरू होता है। एक तेज़ रूपांतर दोगुनी कीमत पर उपलब्ध है।
हम पहले सप्ताह के लिए Cursor और Grok Build में 2x उपयोग शामिल कर रहे हैं।