Anthropic ने हाल ही में Claude मॉडल्स के अंदर कुछ ऐसा खोजा है, जिसे न तो किसी ने डिजाइन किया और न ही इसकी उम्मीद की थी। “J-space” नाम की एक इंटरनल स्ट्रक्चर, Claude के भीतर एक साझा cognitive workspace की तरह काम करती दिखती है।
6 जुलाई को आई इस रिसर्च ने यह समझने में बड़ा कदम बढ़ाया है कि बड़े language मॉडल्स के अंदर असल में क्या होता है।
Claude के अंदर J-Space असल में क्या है?
J-space एक इंटरनल एरिया है, जहां Claude जरूरी जानकारी इकट्ठा करता है और मॉडल के अलग-अलग हिस्सों में शेयर करता है। इसे आसानी से समझने के लिए आप ऐसे सोच सकते हैं कि AI के अंदर एक व्हाइटबोर्ड है।
जब Claude कोई सवाल का जवाब देता है, पहेली हल करता है या किसी इंस्ट्रक्शन को फॉलो करता है, तो जरूरी डिटेल्स इस साझा J-space में दिखाई देती हैं, ताकि मॉडल के अलग-अलग पार्ट्स उन्हें इस्तेमाल कर सकें।
Anthropic ने J-space को “J-lens” नाम के रिसर्च टूल से खोजा। यह टूल रिसर्चर्स को यह देखने में मदद करता है कि Claude के अंदर टास्क के दौरान जानकारी कैसे मूव होती है। रिसर्च में पता चला कि J-space ट्रेनिंग के दौरान अपने आप बन गया, Anthropic ने इसे डायरेक्टली डिजाइन नहीं किया।
हमें X पर फॉलो करें और पाएं लेटेस्ट न्यूज़ सबसे पहले।
यह आइडिया न्यूरोसाइंस में “global workspace” नाम के थ्योरी जैसा है।
इंसानों में इसका मतलब है कि ब्रेन एक साथ कई मेंटल प्रोसेस के लिए जरूरी जानकारी उपलब्ध करवाता है। जैसे जब कोई व्यक्ति सवाल सुनता है, कोई तथ्य याद करता है और यह सोचता है कि जवाब क्या देना है—इन सब चीजों को एक साथ लाना पड़ता है।
Claude भी कुछ वैसा ही करता दिखता है। Anthropic ने पाया कि अगर Claude से पूछा जाए तो वह बता सकता है कि उसके J-space के अंदर क्या है। वह जरूरत पड़े तो J-space की कंटेंट को बदल भी सकता है।
सबसे ज़रूरी बात यह है कि जब रिसर्चर्स ने J-space को डायरेक्टली बदला, तो Claude के जवाब और टास्क की परफामेंस में भी बदलाव आया।
AI सुरक्षा और इंटरप्रिटेबिलिटी के लिए क्यों ज़रूरी है
यह खोज AI की सुरक्षा के लिहाज़ से काफी मायने रखती है। अगर रिसर्चर्स J-space की एक्टिविटी को मॉनिटर कर सकें, तो वे किसी भी मॉडल के बिहेवियर के पीछे छुपे मोटिवेशन को जान सकते हैं। इससे कुछ गलत हो रहा है या नहीं, यह पता लगाना और भी आसान हो जाएगा।
इसमें अटैक्स का पता लगाना भी शामिल है। J-space की मॉनिटरिंग करने से पता चल सकता है कि कब कोई मॉडल ऐसे प्रॉम्प्ट-इंजेक्शन प्रयास को प्रोसेस कर रहा है, जो उसके आउटपुट्स को हाइजैक करने के लिए डिज़ाइन किया गया है। इसके अलावा, इस “conscious” प्रोसेसिंग लेयर में आंशिक विंडो भी मिलना इस फील्ड के लिए एक जरूरी उपलब्धि है।
फिर भी, इसकी सीमा सीमित है। Claude की ज्यादातर सूचना प्रोसेसिंग अभी भी पूरी तरह J-space के बाहर होती है।
फिर भी, Anthropic ने ओपन-सोर्स J-lens इम्प्लीमेंटेशन और Neuronpedia डेमो रिलीज किया है, जिससे बड़ी रिसर्च कम्युनिटी को नतीजों को टेस्ट करने के लिए इनवाइट किया गया है।
हमारे YouTube चैनल को सब्सक्राइब करें जहां लीडर्स और पत्रकार एक्सपर्ट इनसाइट्स देते हैं।
यह काम एक लंबी रिसर्च प्रोसेस पर आधारित है। Anthropic ने October 2025 में emergent introspective awareness पर एक रिपोर्ट पब्लिश की थी। इसके अलावा, उसने April 2025 में model-welfare इनिशिएटिव शुरू किए थे, जिसमें अपने सिस्टम्स के अंदर क्या होता है, इसे लगातार एक्सप्लोर किया जा रहा है।
एक जरूरी चेतावनी है। Anthropic ने साफ कहा है कि यह रिसर्च यह दावा नहीं करती कि Claude conscious है या उसके पास subjective experience है। पेपर में “consciously accessible” जानकारी शब्द का इस्तेमाल किया गया है, लेकिन असली consciousness होने का दावा नहीं किया गया।









