Hindi

Zuckerberg का Muse Code, Meta की अपनी बेंचमार्क charts पर Anthropic से पीछे

  • Zuckerberg ने Muse Code लॉन्च किया, Meta की चार्ट्स में Claude Opus 5 पहले नंबर पर
  • Meta ने अपनी बेंचमार्क तुलना में OpenAI के टॉप कोडिंग मॉडल को शामिल नहीं किया
  • स्वतंत्र टेस्टिंग में रियल लीडर ने 89.5% स्कोर किया, हर Meta आंकड़े से ऊपर

Mark Zuckerberg ने बुधवार को Muse Code का बीटा वर्ज़न लॉन्च किया, जो Meta का पहला artificial intelligence (AI) कोडिंग एजेंट है। Meta के लॉन्च के समय जारी की गई सभी चार तुलना में Anthropic का Claude Opus 5 इससे आगे निकल गया।

इसके बावजूद Meta ने ये चार्ट जारी किए। कंपनी बेहतर टूल की जगह एक सस्ता ऑप्शन बेच रही है। इंडिपेंडेंट टेस्ट डेटा बताता है कि अंतर Meta के दिखाए चार्ट्स से कहीं ज्यादा बड़ा है।

हमारे साथ X पर जुड़ें और लेटेस्ट न्यूज़ तुरंत पाएं।

Meta के खुद के चार्ट्स हर राउंड में Anthropic को विनर दिखाते हैं

Muse Spark 1.2, Muse Code के अंदर का मॉडल है। इसने Terminal-Bench 2.1 पर 82.9% स्कोर किया।

वहीं, Claude Opus 5 ने इसी टेस्ट में 86.7% स्कोर किया। Terminal-Bench, Laude Institute और Stanford के रिसर्चर्स का टूल है। इसमें सिस्टम रिपेयर, डेटा वर्क और सिक्योरिटी जैसे 89 रियल जॉब्स शामिल हैं।

दूसरा स्थान सम्मानजनक है। Muse Code ने OpenAI के Codex (81.8%) और Grok Build (81.6%) को हरा दिया।

Muse Spark 1.2 के लिए बेंचमार्क तुलना चार्ट
Muse Spark 1.2 के लिए बेंचमार्क तुलना चार्ट, स्रोत: Zuckerberg

अगला चार्ट और भी चुनौतीपूर्ण था। DeepSWE 1.1 में 113 कोडिंग टास्क्स हैं, जिसमें इंटरनेट एक्सेस टेस्टिंग के दौरान बंद रहता है। Muse Spark 1.2 तीसरे नंबर पर गिर गया, स्कोर सिर्फ 59.3% रहा।

Meta ने फिर एक खुद का टेस्ट जारी किया, जिसे कंपनी के इंजीनियरों द्वारा बनाए गए 440 रियल पुल रिक्वेस्ट से लिया गया था। Muse Spark 1.2 ने यहां 70.6% स्कोर किया, Opus 5 से लगभग नौ पॉइंट पीछे।

Muse Spark 1.2 ने NVIDIA Hopper पर 24 घंटों तक कर्नेल ऑप्टिमाइज़ेशन टास्क चलाया — 1,000 से ज़्यादा टूल कॉल्स — और शुरुआती एक्सप्लोरेशन फेज के बाद भी बार-बार असली स्पीडअप्स ढूंढता रहा।
Muse Spark 1.2 ने NVIDIA Hopper पर 24 घंटे तक कर्नेल ऑप्टिमाइज़ेशन टास्क चलाया — 1,000 से ज्यादा टूल कॉल्स किए — और शुरुआती फेज के बाद भी असली स्पीडअप्स ढूंढता रहा।

यह स्कोर सिर्फ 2.3 पॉइंट ऊपर है Muse Spark 1.1 से, जो Meta ने जुलाई में रिलीज किया था।

वो मॉडल जिसे Meta ने अपने कोडिंग चार्ट्स में नहीं दिखाया

Meta ने खुद की तुलना GPT-5.6 Terra से की। OpenAI एक और भी मजबूत मॉडल Sol बेचता है, जिसे Meta ने सभी तीन कोडिंग चार्ट्स में शामिल नहीं किया।

Sol, independent Terminal-Bench 2.1 लीडरबोर्ड पर 89.5% के साथ टॉप पर है। Opus 5 दूसरे नंबर पर 89.1% के साथ है।

ये दोनों आंकड़े Opus 5 के लिए Meta द्वारा बताए गए 86.7% से ज्यादा हैं। Meta ने अपने सबसे मजबूत प्रतिद्वंद्वी का कमजोर सेटिंग चुना फिर भी पीछे रहा।

असल लीडर Sol के मुकाबले, Muse Spark 1.2 सीधे 6.6 पॉइंट पीछे है, न कि 3.8 से।

Meta ने एक जगह Sol को जरूर शामिल किया। एक ग्राफिक्स प्रोसेसिंग यूनिट (GPU) kernel टास्क में, जहाँ 1,000 से ज्यादा टूल कॉल्स हुईं, Sol ने बेसलाइन से 71.2% बेहतर प्रदर्शन किया। Muse Spark 1.2 ने 68.7% स्कोर किया और छह में चौथे नंबर पर रहा।

लेकिन एक महत्वपूर्ण बात यह है कि Muse Spark 1.2 अभी उस पब्लिक लीडरबोर्ड पर नहीं है, जहाँ 183 में से सिर्फ 26 मॉडल्स की टेस्टिंग हुई है। इसका 82.9% स्कोर सिर्फ Meta का अपना आंकड़ा है।

“Muse Spark 1.2 हमारा अगला स्टेप है, जिससे हम frontier की ओर बढ़ रहे हैं। इसके बाद और भी बड़े और सक्षम मॉडल्स जल्द आने वाले हैं,” Zuckerberg ने अपने पोस्ट में कहा

Zuckerberg जल्द ही अपने को मात देने वाला मॉडल होस्ट कर सकते हैं

खबरों के मुताबिक, Meta Anthropic को अपनी compute lease देने की बातचीत कर रही है। यह डील दो साल में $10 बिलियन तक पहुँच सकती है। Meta के डेटा सेंटर्स तब Claude मॉडल्स को रन करने में मदद करेंगे, जिनको हटाने के लिए Muse Code बनाया गया है।

Muse Code के पीछे की टीम काफी महंगी थी। Zuckerberg ने जून 2025 में Scale AI और उसके फाउंडर Alexandr Wang को $14.3 बिलियन में खरीदा था। अब Wang, Meta Superintelligence Labs के हेड हैं।

Wang के पास अब प्राइस ही एक बड़ा ऑप्शन है। रेट्स, Meta के पहले paid API के जुलाई लॉन्च के साथ मेल खाते हैं: $1.25 प्रति मिलियन input tokens और $4.25 प्रति मिलियन output tokens।

Contributor tier की कीमत 10 गुना से भी कम है। डिवेलपर्स इसके लिए क्वालिफाई कर सकते हैं अगर वे Meta को अपने काम पर ट्रेनिंग करने दें। Wang ने Muse Spark लाइन के एडॉप्शन नंबर शेयर करने से मना कर दिया।

Meta के अकाउंट्स से यह डिस्काउंट समझ आता है। पिछली तिमाही में रेवेन्यू 28% बढ़कर $60.8 बिलियन हो गया, फिर भी ऑपरेटिंग प्रॉफिट 8% गिरकर $18.8 बिलियन हो गया।

ऑपरेटिंग मार्जिन एक साल पहले के 43% से घटकर 31% रह गया। इस तिमाही में Meta ने सिर्फ कैपिटल प्रोजेक्ट्स पर $31.08 बिलियन खर्च किए और पूरे साल के लिए यह $145 बिलियन तक पहुँच सकता है।

Muse Code, ऐसे engineering फीचर्स ऑफर करता है जो Claude Code में नहीं हैं। Background एजेंट्स सेशन के दौरान कॉन्टेक्स्ट बनाए रखते हैं। Sub-agents किसी repository की isolated copies में काम करते हैं।

Meta ने एक मजबूत दूसरा बेस्ट कोडर तैयार किया है और इसे बजट ऑप्शन की तरह प्राइस किया है। बीटा यह दिखाएगा कि क्या डेवलपर्स थोड़ी एक्युरेसी कम लेकर भी बिल का करीब दसवां हिस्सा चुनते हैं या नहीं।


BeInCrypto से नवीनतम क्रिप्टोक्यूरेंसी बाजार विश्लेषण पढ़ने के लिए, यहाँ क्लिक करें

अस्वीकरण

हमारी वेबसाइट पर सभी जानकारी अच्छे इरादे से और केवल सामान्य सूचना के उद्देश्य से प्रकाशित की जाती है, ताकि पाठक जागरूक रह सकें। हमारी वेबसाइट पर दी गई जानकारी के आधार पर पाठक द्वारा की गई प्रत्येक कार्रवाई पूरी तरह से उनके अपने जोखिम पर होती है। कृपया हमारी नियम और शर्तें, गोपनीयता नीति और अस्वीकरण पढ़ें।