Google और Meta ने बुधवार को कुछ घंटों के अंतर में अपने लेटेस्ट फ्रंटियर AI मॉडल्स लॉन्च किए। Google ने Gemini 3.8 Flash को एक साइबरसिक्रिटी वेरिएंट के साथ जारी किया, वहीं Meta ने Muse Spark 1.3 को लॉन्च किया।
दोनों लॉन्च की वजह से डायरेक्ट तुलना के मौके बन गए हैं। Artificial Analysis द्वारा किए गए स्वतंत्र टेस्ट ने नतीजे बांट दिए हैं। Meta एजेंटिक नॉलेज वर्क और साइंटिफिक रीजनिंग में आगे है, जबकि Google फैक्टुअल रिकॉल और टर्मिनल कोडिंग में आगे है।
एक ही दिन आए दो फ्रंटियर रिलीज़
Gemini 3.8 Flash, Google का तीसरा Flash रिलीज पिछले छह हफ्तों में है। इस मॉडल की कीमत है $0.75 प्रति 1 मिलियन इनपुट टोकन और $3.75 प्रति 1 मिलियन आउटपुट टोकन।
लेटेस्ट न्यूज़ के लिए हमें X पर फॉलो करें
यह शुरुआती कीमत 31 दिसंबर 2026 तक लागू रहेगी। इसके बाद, दाम दोगुने होकर $1.50 और $7.50 प्रति 1 मिलियन टोकन हो जाएंगे।
Google ने जनरल मॉडल के साथ Gemini 3.8 Flash Cyber भी लॉन्च किया। यह मॉडल चुनिंदा ट्रस्टेड डिफेंडर्स को उपलब्ध है। इसने CyberGym टेस्ट में 86.2% स्कोर किया, जो वल्नरेबिलिटीज ढूंढने का बेंचमार्क है।
साइबर वेरिएंट ने CWE-Bench, जो पैचिंग बेंचमार्क है, उसमें भी 47.2% हासिल किया। Google का कहना है कि यह मॉडल बड़े कमर्शियल मॉडल्स की तुलना में Chrome वल्नरेबिलिटीज के लिए 2.6 गुना ज्यादा सही पैचेस बना सका।
एक्सेस Fairwind Program के तहत दी गई है, जिससे मॉडल सिर्फ सरकारी अथॉरिटीज और जरूरी इंफ्रास्ट्रक्चर ऑपरेटर्स के लिए सीमित रहता है। OpenAI ने एक दिन पहले Astra नाम के अपने मॉडल पर भी ऐसा ही क्रिटिकल साइबरसिक्रिटी लिमिट लगाया था, जो पहली बार इस स्तर पर आंका गया है।
वहीं, Meta ने Muse Spark 1.3 को Muse Code और Meta Model API के जरिए रोलआउट किया। कंपनी इंजीनियर्स ने नोट किया कि इसमें वर्जन 1.2 की तुलना में लगभग 20% कम टूल कॉल्स हो रही हैं।
Gemini 3.8 Flash vs Muse Spark 1.3: स्वतंत्र बेंचमार्क्स ने नतीजे बांटे
Artificial Analysis ने मॉडल्स का टेस्ट किया, और रिजल्ट्स से पता चलता है कि यह कैसे रैंक करते हैं। Muse Spark 1.3 ने मैक्स मोड में GDPval-AA v2 पर 1,754 Elo स्कोर किया। Gemini 3.8 Flash (high) ने 1,545 स्कोर किया।
Meta ने Sierra Research बैंकिंग एजेंट टेस्ट (52.4% बनाम 44.9%) और CritPt फिजिक्स रीजनिंग दोनों में लीड किया है। वहीं, Gemini 3.8 Flash ने Terminal-Bench 2.1 पर 87.6%, AA-LCR लॉन्ग कॉन्टेक्स्ट पर 81% और AA-Omniscience एक्युरेसी में 55% स्कोर किया।
Gemini 3.8 Flash ने टेस्ट किए गए सभी मॉडल्स में सबसे अधिक GPQA Diamond स्कोर हासिल किया, जो 95% रहा। Humanity’s Last Exam में ये दोनों केवल एक पॉइंट के फर्क के साथ रहे।
Meta का टॉप स्कोरर फिलहाल उपलब्ध नहीं है। कंपनी ने कहा है कि अधिकतम reasoning वेरिएंट सेफ्टी टेस्टिंग पूरी होने के बाद उपलब्ध कराया जाएगा। अभी xhigh वेरिएंट यूज़र्स के लिए उपलब्ध है।
इस वर्ज़न ने Artificial Analysis Intelligence Index पर 61 स्कोर किया, जो Muse Spark 1.2 से 4 पॉइंट ज्यादा है। हालांकि, यह Claude Fable 5.1 के 66 और Claude Opus 5 के 63 से पीछे है।
नई रिलीज़ की लाइन लग चुकी है। Elon Musk ने कहा है कि Grok 4.7 जल्दी लॉन्च होगा, जिससे अगले दो हफ्तों में चार फ्रंटियर लॉन्च देखने को मिल सकते हैं।
हमारे YouTube चैनल को सब्सक्राइब करें – जानें लीडर्स और जर्नलिस्ट्स की एक्सपर्ट राय









