OpenAI यूरोपीय संघ में चैटजीपीटी चैटबॉट की टेक्स्ट और Codex कोडिंग आउटपुट पर एक इनविज़िबल वॉटरमार्क जोड़ रहा है। लेकिन, खुद की टेस्टिंग में, अगर किसी टेक्स्ट के एक चौथाई शब्दों को समानार्थी शब्दों से बदल दिया जाए तो डिटेक्शन सिर्फ 17% रह जाती है।
यह कदम EU AI Act का जवाब है, जो यूरोपीय संघ के AI नियमों का Rulebook है, जो AI जनरेटेड टेक्स्ट पर मशीन-रीडेबल लेबल की मांग करता है। फिर भी, OpenAI का मानना है कि यह टेक्नोलॉजी अभी mature नहीं है, इसलिए फिलहाल इसका डिटेक्टर पब्लिक के लिए उपलब्ध नहीं होगा।
अगर कोई ChatGPT वॉटरमार्क वाले टेक्स्ट को एडिट करता है तो उसका असर कितना मजबूत रहता है?
घोषणा के मुताबिक, सिस्टम को textGrain कहा जाता है, जो मॉडल के शब्दों की सिलेक्शन में subtle statistical पैटर्न छोड़ने के लिए डिज़ाइन किया गया है। एक अलग डिटेक्टर उस पैटर्न को ढूंढने के लिए टेक्स्ट को स्कैन करता है।
OpenAI अपनी FAQ में बताता है कि वॉटरमार्क सीधे शब्दों में मौजूद रहता है। इसमें कोई हिडन कैरेक्टर, इनविज़िबल स्पेस या अजीब पंक्चुएशन नहीं होती। इसलिए छुपे हुए कैरेक्टर को रिमूव करने वाली कोई भी ट्रिक यहां असर नहीं करती।
लंबाई मैटर करती है। OpenAI टेक्स्ट को टोकन में मापता है, जो AI मॉडल्स द्वारा प्रोसेस किए जाने वाले शब्दांश होते हैं। एक टोकन लगभग तीन-चौथाई इंग्लिश शब्द के बराबर होता है।
OpenAI की टेस्टिंग में, लगभग 150 शब्दों के अनएडिटेड आंसर में डिटेक्टर ने 66% मामले पकड़ लिए। जब टेक्स्ट करीब 300 शब्द का था, तब डिटेक्शन रेट करीब 92% तक पहुंच गया।
हल्की एडिटिंग भी ChatGPT वॉटरमार्क को कमजोर कर देती है। 300 शब्द वाले टेक्स्ट में अगर हर 10 में से 1 शब्द को समानार्थी से बदल दिया जाए, तो डिटेक्शन 92% से गिरकर 66% रह जाती है। हर 4 में से 1 शब्द को बदलने पर यह दर सिर्फ 17% हो जाती है।
OpenAI के लेटेस्ट Frontier मॉडल GPT-6 Astra के लिए वॉटरमार्क ने बेंचमार्क स्कोर पर कोई खास असर नहीं डाला।
OpenAI पब्लिक को डिटेक्टर चलाने की परमिशन क्यों नहीं देगा?
पब्लिक टूल देने की बजाय OpenAI सिर्फ अप्रूव रिसर्चर्स और एक्सपर्ट organizations से एप्लिकेशन ले रहा है। कंपनी बताती है कि पॉजिटिव रिजल्ट में यूज़र, प्रॉम्प्ट या कन्वर्सेशन की कोई जानकारी सामने नहीं आती।
नेगेटिव रिजल्ट भी कोई पक्की बात नहीं जताता। शॉर्ट, एडिटेड या ट्रांसलेटेड टेक्स्ट डिटेक्टर से बच सकते हैं। इसी तरह, दूसरा AI टूल्स का आउटपुट भी पकड़ा नहीं जा सकता।
पानी के निशान (watermark) का पता न चलने से यह साबित नहीं होता कि वह इंसान द्वारा ही बनाया गया है।
स्रोत: OpenAI
इमेज और ऑडियो अलग तरह से काम करते हैं। कोई भी इन फाइल्स को OpenAI के पब्लिक वेरिफाइ टूल पर अपलोड कर सकता है और उसमें SynthID watermark को चेक कर सकता है।
यूरोप के बाहर, ChatGPT watermark डिफ़ॉल्ट रूप से बंद रहता है। हालांकि, अब API कस्टमर्स दुनियाभर में अपने प्रोजेक्ट या ऑर्गनाइज़ेशन सेटिंग्स से चुनिंदा मॉडल्स के लिए इसमें ऑप्ट-इन कर सकते हैं।
यह रोलआउट EU के अगस्त में AI Act ट्रांसपेरेंसी लागू करने के बाद शुरू हुआ है। क्रिप्टो के लिए यह और भी जरूरी है, क्योंकि क्रिमिनल AI एडॉप्शन में साल-दर-साल 40% की बढ़त TRM Labs के मुताबिक दर्ज हुई है।
इसलिए, रेग्युलेटर्स जो मांगते हैं और डिटेक्टर्स जो साबित कर सकते हैं, उनके बीच का फर्क तय करेगा कि हर बड़ी AI लैब कंप्लायंस को कैसे हैंडल करेगी।









