Mark Zuckerberg ने बुधवार को Muse Code का बीटा वर्ज़न लॉन्च किया, जो Meta का पहला artificial intelligence (AI) कोडिंग एजेंट है। Meta के लॉन्च के समय जारी की गई सभी चार तुलना में Anthropic का Claude Opus 5 इससे आगे निकल गया।
इसके बावजूद Meta ने ये चार्ट जारी किए। कंपनी बेहतर टूल की जगह एक सस्ता ऑप्शन बेच रही है। इंडिपेंडेंट टेस्ट डेटा बताता है कि अंतर Meta के दिखाए चार्ट्स से कहीं ज्यादा बड़ा है।
हमारे साथ X पर जुड़ें और लेटेस्ट न्यूज़ तुरंत पाएं।
Meta के खुद के चार्ट्स हर राउंड में Anthropic को विनर दिखाते हैं
Muse Spark 1.2, Muse Code के अंदर का मॉडल है। इसने Terminal-Bench 2.1 पर 82.9% स्कोर किया।
वहीं, Claude Opus 5 ने इसी टेस्ट में 86.7% स्कोर किया। Terminal-Bench, Laude Institute और Stanford के रिसर्चर्स का टूल है। इसमें सिस्टम रिपेयर, डेटा वर्क और सिक्योरिटी जैसे 89 रियल जॉब्स शामिल हैं।
दूसरा स्थान सम्मानजनक है। Muse Code ने OpenAI के Codex (81.8%) और Grok Build (81.6%) को हरा दिया।
अगला चार्ट और भी चुनौतीपूर्ण था। DeepSWE 1.1 में 113 कोडिंग टास्क्स हैं, जिसमें इंटरनेट एक्सेस टेस्टिंग के दौरान बंद रहता है। Muse Spark 1.2 तीसरे नंबर पर गिर गया, स्कोर सिर्फ 59.3% रहा।
Meta ने फिर एक खुद का टेस्ट जारी किया, जिसे कंपनी के इंजीनियरों द्वारा बनाए गए 440 रियल पुल रिक्वेस्ट से लिया गया था। Muse Spark 1.2 ने यहां 70.6% स्कोर किया, Opus 5 से लगभग नौ पॉइंट पीछे।
यह स्कोर सिर्फ 2.3 पॉइंट ऊपर है Muse Spark 1.1 से, जो Meta ने जुलाई में रिलीज किया था।
वो मॉडल जिसे Meta ने अपने कोडिंग चार्ट्स में नहीं दिखाया
Meta ने खुद की तुलना GPT-5.6 Terra से की। OpenAI एक और भी मजबूत मॉडल Sol बेचता है, जिसे Meta ने सभी तीन कोडिंग चार्ट्स में शामिल नहीं किया।
Sol, independent Terminal-Bench 2.1 लीडरबोर्ड पर 89.5% के साथ टॉप पर है। Opus 5 दूसरे नंबर पर 89.1% के साथ है।
ये दोनों आंकड़े Opus 5 के लिए Meta द्वारा बताए गए 86.7% से ज्यादा हैं। Meta ने अपने सबसे मजबूत प्रतिद्वंद्वी का कमजोर सेटिंग चुना फिर भी पीछे रहा।
असल लीडर Sol के मुकाबले, Muse Spark 1.2 सीधे 6.6 पॉइंट पीछे है, न कि 3.8 से।
Meta ने एक जगह Sol को जरूर शामिल किया। एक ग्राफिक्स प्रोसेसिंग यूनिट (GPU) kernel टास्क में, जहाँ 1,000 से ज्यादा टूल कॉल्स हुईं, Sol ने बेसलाइन से 71.2% बेहतर प्रदर्शन किया। Muse Spark 1.2 ने 68.7% स्कोर किया और छह में चौथे नंबर पर रहा।
लेकिन एक महत्वपूर्ण बात यह है कि Muse Spark 1.2 अभी उस पब्लिक लीडरबोर्ड पर नहीं है, जहाँ 183 में से सिर्फ 26 मॉडल्स की टेस्टिंग हुई है। इसका 82.9% स्कोर सिर्फ Meta का अपना आंकड़ा है।
“Muse Spark 1.2 हमारा अगला स्टेप है, जिससे हम frontier की ओर बढ़ रहे हैं। इसके बाद और भी बड़े और सक्षम मॉडल्स जल्द आने वाले हैं,” Zuckerberg ने अपने पोस्ट में कहा।
Zuckerberg जल्द ही अपने को मात देने वाला मॉडल होस्ट कर सकते हैं
खबरों के मुताबिक, Meta Anthropic को अपनी compute lease देने की बातचीत कर रही है। यह डील दो साल में $10 बिलियन तक पहुँच सकती है। Meta के डेटा सेंटर्स तब Claude मॉडल्स को रन करने में मदद करेंगे, जिनको हटाने के लिए Muse Code बनाया गया है।
Muse Code के पीछे की टीम काफी महंगी थी। Zuckerberg ने जून 2025 में Scale AI और उसके फाउंडर Alexandr Wang को $14.3 बिलियन में खरीदा था। अब Wang, Meta Superintelligence Labs के हेड हैं।
Wang के पास अब प्राइस ही एक बड़ा ऑप्शन है। रेट्स, Meta के पहले paid API के जुलाई लॉन्च के साथ मेल खाते हैं: $1.25 प्रति मिलियन input tokens और $4.25 प्रति मिलियन output tokens।
Contributor tier की कीमत 10 गुना से भी कम है। डिवेलपर्स इसके लिए क्वालिफाई कर सकते हैं अगर वे Meta को अपने काम पर ट्रेनिंग करने दें। Wang ने Muse Spark लाइन के एडॉप्शन नंबर शेयर करने से मना कर दिया।
Meta के अकाउंट्स से यह डिस्काउंट समझ आता है। पिछली तिमाही में रेवेन्यू 28% बढ़कर $60.8 बिलियन हो गया, फिर भी ऑपरेटिंग प्रॉफिट 8% गिरकर $18.8 बिलियन हो गया।
ऑपरेटिंग मार्जिन एक साल पहले के 43% से घटकर 31% रह गया। इस तिमाही में Meta ने सिर्फ कैपिटल प्रोजेक्ट्स पर $31.08 बिलियन खर्च किए और पूरे साल के लिए यह $145 बिलियन तक पहुँच सकता है।
Muse Code, ऐसे engineering फीचर्स ऑफर करता है जो Claude Code में नहीं हैं। Background एजेंट्स सेशन के दौरान कॉन्टेक्स्ट बनाए रखते हैं। Sub-agents किसी repository की isolated copies में काम करते हैं।
Meta ने एक मजबूत दूसरा बेस्ट कोडर तैयार किया है और इसे बजट ऑप्शन की तरह प्राइस किया है। बीटा यह दिखाएगा कि क्या डेवलपर्स थोड़ी एक्युरेसी कम लेकर भी बिल का करीब दसवां हिस्सा चुनते हैं या नहीं।









