Google ने लॉन्च किया सबसे एडवांस्ड Audio मॉडल, जानें इसकी रैंकिंग

  • Google का नया वॉयस मॉडल Artificial Analysis के स्पीच इंडेक्स में 82.6 स्कोर के साथ टॉप पर
  • Gemini 3.8 Live का चार्ज है 84 सेंट प्रति घंटे, इंडेक्स का सबसे सस्ता ऑडियो मॉडल
  • ब्लाइंड वॉयस टेस्ट में Human Testers को अब भी पुराना Gemini 3.1 Flash Live ज्यादा पसंद

Google ने 15 सितंबर को Gemini 3.8 Live और Gemini 3.8 Live Extended Thinking लॉन्च किया, जिन्हें उसने अब तक के अपने सबसे एडवांस ऑडियो मॉडल कहा है।

ये दोनों मॉडल बातचीत करने, तर्क करने और टास्क हैंडल करने में सक्षम हैं। लेकिन स्वतंत्र विश्लेषकों के मुताबिक ये मॉडल कैसे रैंक करते हैं? Extended Thinking वर्जन ने Artificial Analysis के Speech-to-Speech Index में 82.6 स्कोर के साथ टॉप किया, जो GPT-Live-1 और Grok Voice से आगे है।

हमारे साथ X पर जुड़ें और ताजा न्यूज़ सबसे पहले पाएं

Google के नए Conversational AI Model की Benchmarks पर रैंकिंग कैसी है

Artificial Analysis का Index स्पीच रीजनिंग, एजेंटिक परफॉर्मेंस, एरिना प्रेफरेंस और टास्क सक्सेस रेट का औसत लेता है।

Gemini 3.8 Live Extended Thinking, जिसे हाई रीजनिंग एफर्ट पर टेस्ट किया गया था, पहले पायदान पर डेब्यू किया। उसके बाद GPT-Live-1 Astra 81.5 स्कोर और Grok Voice Think Fast 2.0 High 81.3 स्कोर के साथ रहे।

Gemini 3.8 Live ने Speech-to-Speech Index पर कैसी रैंकिंग पाई
Gemini 3.8 Live ने Speech-to-Speech Index पर कैसी रैंकिंग पाई। स्रोत: Artificial Analysis

स्टैंडर्ड Gemini 3.8 Live ने पांचवां स्थान पाया और उसे 76.0 स्कोर मिला। दोनों वेरिएंट्स ने Gemini 3.1 Flash Live High को पछाड़ दिया, जिसका स्कोर 71.5 था।

एजेंटिक गैप और भी बड़ा है। Extended Thinking ने Tau Voice बेंचमार्क में 68.6% हासिल किया, जबकि पुराने जनरेशन को सिर्फ 37.7% मिला था।

स्पीच रीजनिंग बेंचमार्क पर, Extended Thinking ने 97.7% स्कोर किया, और Grok Voice 97.2% के साथ थोड़ा पीछे था। हालांकि, वह Qwen Audio 3.0 Realtime Plus से पीछे रह गया, जिसने 99.2% स्कोर किया

Human Testers अब भी पुराने Gemini मॉडल को चुन रहे हैं

कीमत के मामले में, अंतर ज्यादा है। स्टैंडर्ड मॉडल $0.84 प्रति घंटे की इनपुट ऑडियो पर चलता है। यह इसकी पिछली जनरेशन $1.75 की तुलना में लगभग आधा है और Index का सबसे सस्ता रेट भी है।

Extended Thinking $3.50 प्रति घंटे के रेट पर चलता है। यह GPT-Live-1 Sol के $4.47 और Grok Voice Think Fast 2.0 High के $4.80 से सस्ता है।

लेटेंसी भी कम हुई है। औसत फर्स्ट ऑडियो टाइम अब 1.18 सेकंड है, जबकि पुराने Gemini मॉडल में यह 2.99 सेकंड था।

हालांकि, लिसनर्स अभी पूरी तरह से संतुष्ट नहीं हैं। Gemini 3.1 Flash Live अभी भी ब्लाइंड Speech Agent Arena कन्वर्सेशन में प्रेफरेंस में सबसे आगे है, जिसका Elo 1096 है।

Gemini 3.8 Live दूसरे नंबर पर है, इसका Elo 1083 है। Extended Thinking वेरिएंट 990 Elo के साथ पीछे है, जबकि इसने 89.1% टास्क पूरे किए हैं।

Voice AI को अब दो अलग-अलग स्केल्स पर ग्रेड किया जा रहा है, जो अलग-अलग दिशाओं में इशारा करते हैं। बेंचमार्क्स उस मॉडल को रिवॉर्ड करते हैं जो सबसे गहराई से रीजन करता है। प्रेफरेंस उस मॉडल को रिवॉर्ड करती है जो सबसे अच्छा बोलता है। Google फिलहाल दोनों में आगे है, लेकिन अलग-अलग मॉडलों के साथ।

हमारे YouTube चैनल को सब्सक्राइब करें और एक्सपर्ट लीडर्स व जर्नलिस्ट्स की इनसाइट्स देखें

अस्वीकरण

BeInCrypto निष्पक्ष और पारदर्शी रिपोर्टिंग के लिए प्रतिबद्ध है। इस समाचार लेख का उद्देश्य सटीक और समय पर जानकारी प्रदान करना है। फिर भी, पाठकों को सलाह दी जाती है कि वे तथ्यों को स्वतंत्र रूप से सत्यापित करें और इस सामग्री के आधार पर कोई भी निर्णय लेने से पहले किसी पेशेवर से परामर्श करें। कृपया ध्यान दें कि हमारी नियम और शर्तें, गोपनीयता नीति और अस्वीकरण अपडेट कर दिए गए हैं।