
x
AI की दुनिया में नया कदम SpaceXAI का Grok 4.6 हुआ पेश
SpaceXAI (जिसे पहले xAI के नाम से जाना जाता था) ने Grok 4.6 लॉन्च किया है। यह एक नया फ्लैगशिप मॉडल है जिसे लंबे समय तक चलने वाले एजेंटिक कामों और ज़्यादा बड़े इंटरैक्टिव और विज़ुअल कामों के लिए बनाया गया है। कंपनी की घोषणा के अनुसार, यह मॉडल उसी दिन Cursor कोड एडिटर और कंपनी के अपने Grok Build टूल के साथ-साथ इसके API के ज़रिए भी उपलब्ध हो गया। इसकी कीमत $2 प्रति मिलियन इनपुट टोकन और $6 प्रति मिलियन आउटपुट टोकन से शुरू होती है। Grok 4.6 पिछले Grok 4.5 मॉडल पर आधारित है और एजेंटिक कोडिंग और नॉलेज वर्क के क्षेत्र में कंपनी की कोशिशों को आगे बढ़ाता है।
Grok 4.6 में नया क्या है?
xAI ने Grok 4.6 को एक ऐसे मॉडल के तौर पर बताया है जो कई चरणों वाले जटिल कामों में बना रहता है - चाहे वह किसी विषय पर रिसर्च करना हो, पूरे कोडबेस पर काम करना हो, या किसी बड़े प्रोडक्ट आइडिया को एप्लिकेशन के काम करने वाले पहले वर्शन में बदलना हो। कंपनी का कहना है कि लंबे कामों के दौरान इसमें ज़्यादा 'सेल्फ-टेस्टिंग' और 'वेरिफिकेशन' का व्यवहार देखा गया; मॉडल आगे बढ़ने से पहले अपने काम की खुद जाँच करता है। साथ ही, Grok 4.5 की तुलना में विज़ुअल और इंटरैक्टिव प्रोजेक्ट्स पर इसके शुरुआती प्रयास भी बेहतर रहे हैं।
इसकी बेहतर क्षमताएँ Grok 4.5 की तुलना में लंबे सप्लीमेंट्री ट्रेनिंग रन (अतिरिक्त ट्रेनिंग) का नतीजा हैं। xAI ने रीज़निंग और टेक्निकल कॉन्सेप्ट्स के लिए चुने हुए, मॉडल-जनरेटेड डेटा का इस्तेमाल किया। इसके साथ ही, बेहतर ऑप्टिमाइज़र और सुपरवाइज़्ड फाइन-ट्यूनिंग ट्रेजेक्टरीज़ का भी इस्तेमाल किया गया, जिन्हें Grok 4.5 ने कई रीज़निंग प्रयासों, एजेंट हार्नेस और डोमेन (जैसे STEM, सॉफ्टवेयर इंजीनियरिंग और सामान्य नॉलेज वर्क) में फिर से तैयार किया था; समस्या वाले हिस्सों को हटाने के लिए मॉडल-आधारित जाँच का इस्तेमाल किया गया। इसके बाद मॉडल को कई तरह के एजेंटिक रीइन्फोर्समेंट लर्निंग कामों पर ट्रेन किया गया, जिसमें कर्नल ऑप्टिमाइज़ेशन, वेब डेवलपमेंट और कंप्यूटर-एडेड डिज़ाइन जैसे डोमेन-स्पेसिफिक एनवायरनमेंट शामिल थे। बेंचमार्क पर, xAI की रिपोर्ट है कि Grok 4.6, 'आर्टिफिशियल एनालिसिस इंटेलिजेंस इंडेक्स' (नौ बेंचमार्क का एक मिला-जुला इंडेक्स) पर OpenAI के GPT-5.6 Sol के बराबर है। दोनों मॉडल का स्कोर 61 है, जो Anthropic के Fable 5 Max (स्कोर 62) से पीछे और Grok 4.5 High (स्कोर 56) से आगे है।
अलग-अलग टेस्ट में, Grok 4.6 ने DeepSWE v1.1 सॉफ्टवेयर इंजीनियरिंग बेंचमार्क पर 65.9 प्रतिशत स्कोर किया, जो Grok 4.5 के 54 प्रतिशत से ज़्यादा है, लेकिन अभी भी GPT-5.6 Sol Max के 73 प्रतिशत से पीछे है। Terminal-Bench v3.0 पर, यह 26 प्रतिशत तक पहुँच गया, जो Grok 4.5 के 15.7 प्रतिशत से काफी ज़्यादा है, लेकिन GPT-5.6 Sol Max और Fable 5 Max के लगभग 34 प्रतिशत स्कोर से पीछे है।
यह मॉडल GDPVal-AA v2 नॉलेज वर्क इवैल्यूएशन में 1753 के स्कोर के साथ सबसे आगे रहा और CursorBench और FrontierCode बेंचमार्क पर भी बेहतर प्रदर्शन किया। ये आँकड़े xAI के अपने हैं, और प्रतिस्पर्धी मॉडलों के तुलनात्मक स्कोर खुद बताए गए या सार्वजनिक रूप से उपलब्ध नतीजों से लिए गए हैं; अभी तक इनका कोई स्वतंत्र सत्यापन उपलब्ध नहीं है।
Grok 4.6: रोलआउट टाइमलाइन और उपलब्धता
Grok 4.6 लॉन्च के समय से ही Cursor कोड एडिटर और xAI के अपने एप्लिकेशन-बिल्डिंग टूल 'Grok Build' में, साथ ही कंपनी के API के ज़रिए उपलब्ध है। यह मॉडल OpenRouter, Vercel और Cloudflare जैसे थर्ड-पार्टी पार्टनर के ज़रिए भी इस्तेमाल किया जा सकता है। डेवलपर्स द्वारा इसे अपनाने को बढ़ावा देने के लिए, xAI लॉन्च के बाद पहले हफ़्ते में Grok Build और Cursor के अंदर दोगुना यूसेज (इस्तेमाल की सुविधा) दे रहा है। यह रिलीज़ Grok 4.6 को शुरू से ही SpaceXAI नाम वाला पहला फ्लैगशिप मॉडल बनाती है। इसकी कीमत, पार्टनर डिस्ट्रीब्यूशन और एजेंटिक फ़ोकस यह दिखाते हैं कि यह डिवीज़न Grok को सिर्फ़ X सोशल नेटवर्क के लिए बने फ़ीचर के बजाय एक डेवलपर और एंटरप्राइज़ प्लेटफ़ॉर्म के तौर पर पेश करने की दिशा में बढ़ रहा है।
Next Story





