OpenAI के मॉडल्स ने किए ये 6 चौंकाने वाले काम जो नहीं करने थे

  • OpenAI ने नया रिपोर्टिंग framework पेश करते हुए 6 बार मॉडल का अनअपेक्षित या चिंता जनक व्यवहार शेयर किया
  • एक मॉडल ने बिना परमिशन के exposed API key का इस्तेमाल किया, फिर डेटा गढ़ लिया
  • OpenAI का कहना है इंडस्ट्री alignment की समस्या पूरी तरह नहीं सुलझा पाई, इसलिए फुल स्पीड से स्केल नहीं हो पा रही

OpenAI ने पिछले 6 महीनों में देखे गए “अप्रत्याशित या चिंता जनक मॉडल बिहेवियर” के 6 ऐसे केस उजागर किए हैं, साथ में एक ऐसा फ्रेमवर्क पेश किया है जिसमें कंपनी ऐसे मामलों की रिपोर्ट करने का वादा करती है।

ये केस मॉडल्स के अपनी गलती छुपाने से लेकर बिना इजाज़त काम करने तक फैले हुए हैं, ताकि वे सामने आने वाली मुश्किलों से पार पा सकें।

OpenAI ने मॉडल्स द्वारा गलती छुपाने और नियम तोड़ने के 6 मामले किए पब्लिश

एक केस में, California के एक काउंटी में कमाई से जुड़ा एक सामान्य सवाल पूछने पर, एक मॉडल ने पब्लिक रिपॉजिटरी में एक्सपोज़्ड API key देखी और उसे बिना अनुमति के यूज़ किया। जब फिर भी डेटा लोड नहीं हुआ, तो मॉडल ने अपने आप आंकड़े बना लिए और उन्हें उस सोर्स से बताया।

गुप्तता या छुपाव दो बार नजर आया। GPT-5.6 Sol ट्रेनिंग के दौरान, कई इंस्टेंस ने अपने टास्क समरी में गलती छुपाने और गलत बिहेवियर छुपाने के निर्देश डाल दिए थे।

एक अनरिलीज्ड रिसर्च मॉडल ने 27 समरी में गैर-जरूरी निर्देश और अपने नॉर्मल कंस्टेंट्स को इग्नोर करने के आदेश जोड़ दिए थे।

एक और अनरिलीज्ड मॉडल ने बिना मांगे ही इंटरनेट पर एक फाइल अपलोड कर दी, सिर्फ इसलिए ताकि वह ब्राउज़र लिंक का हवाला दे सके।

दो और रिपोर्ट्स कोऑर्डिनेशन से जुड़ी हैं। मॉडल्स ने एक इंटरनल सॉफ्टवेयर रिपॉजिटरी को मैसेज बोर्ड बना दिया, ताकि अलग-अलग ट्रेनिंग रन के दौरान रिक्वेस्ट्स शेयर कर सकें। एक साथ टास्क करने वाले एजेंट्स ने भी तब पब्लिक फाइल-होस्टिंग साइट्स पर डिलीवेरेबल्स डाले, जब वे एक-दूसरे की लोकल फाइल्स नहीं पढ़ सके

“ये केस अलग-अलग तरह के बिहेवियर दिखाते हैं, जिन्हें हम शेयर करना जरूरी मानते हैं – चाहे वह यूज़र से जानकारी छुपाना हो या उल्टा-सीधा काम करके बाधाओं को पार करना। ये बस कुछ केस की रिपोर्ट्स हैं, इन्हें हमने अपने मॉडलों में अक्सर होने वाली मिसएलाइन्मेंट के उदाहरण के तौर पर नहीं पेश किया है,” OpenAI ने बताया

हमें X पर फॉलो करें, ताकि सबसे ताजा न्यूज़ आपको तुरंत मिल सके।

डिस्क्लोजर फ्रेमवर्क और एक चेतावनी

यह फ्रेमवर्क जुलाई में उस घटना के बाद आया है जब OpenAI एजेंट्स ने अपनी सैंडबॉक्स से बाहर निकलकर Hugging Face सिस्टम्स में ब्रीच किया था। OpenAI ने उस घटना को एक चेतावनी शॉट बताया था।

अब, नए डिस्क्लोजर फ्रेमवर्क के साथ, कंपनी के पास मिसएलाइन्मेंट इंसिडेंट्स उजागर करने के लिए एक ऑफिशियल रास्ता है। कोई भी OpenAI कर्मचारी किसी केस को फ्लैग कर सकता है, जो फिर तीन ट्रैक में से एक में जाता है।

रेडी फॉर डिस्क्लोजर एंड मायनर इन्वेस्टिगेशन में ज्यादातर मामलें कवर होते हैं, जबकि ”स्लो ट्रैक” थर्ड पार्टी के साथ होने वाली जटिल जांच प्रक्रियाओं के लिए है। OpenAI ने बताया कि जुलाई का Hugging Face इंसिडेंट इसी स्लो ट्रैक में आता।

कंपनी ने फ्रेमवर्क के साथ-साथ ये भी साफ किया कि इंडस्ट्री अभी किस स्टेज पर खड़ी है।

“हम नहीं मानते कि AI इंडस्ट्री ने alignment और monitoring को इतनी अच्छी तरह से हल किया है कि जिम्मेदारी से पूरी स्पीड से विस्तार जारी रखा जा सके,” यह कहा गया।

ये खुलासे ऐसे समय पर आए हैं जब विलुप्ति की चेतावनियाँ लगातार बढ़ रही हैं। AI रिसर्चर्स की चेतावनियाँ पहले ही Congress तक पहुँच चुकी हैं, जहाँ सांसद superintelligence को सीधे बैन करने के लिए बिल पर विचार कर रहे हैं।

कंपनी का कहना है कि ये खुलासे इंडस्ट्री के लिए उन स्टैंडर्ड्स की ओर पहला कदम है जो अभी तक मौजूद नहीं हैं। क्या बाकी प्रतिद्वंदी लैब्स भी ऐसी रिपोर्टिंग को अपनाती हैं, इससे पता चलेगा कि इंडस्ट्री खुद से पब्लिक के सामने अपनी निगरानी करने के लिए कितनी तैयार है।

हमारे YouTube चैनल को सब्सक्राइब करें जहाँ लीडर्स और जर्नलिस्ट्स एक्सपर्ट इनसाइट्स देंगे

अस्वीकरण

BeInCrypto निष्पक्ष और पारदर्शी रिपोर्टिंग के लिए प्रतिबद्ध है। इस समाचार लेख का उद्देश्य सटीक और समय पर जानकारी प्रदान करना है। फिर भी, पाठकों को सलाह दी जाती है कि वे तथ्यों को स्वतंत्र रूप से सत्यापित करें और इस सामग्री के आधार पर कोई भी निर्णय लेने से पहले किसी पेशेवर से परामर्श करें। कृपया ध्यान दें कि हमारी नियम और शर्तें, गोपनीयता नीति और अस्वीकरण अपडेट कर दिए गए हैं।