जबकि दुनिया इस बात पर स्पष्टता की मांग कर रही है कि क्या मानवीय है और क्या मशीन, ओपनएआई (OpenAI) ने अभी एक ऐसा टूल लॉन्च किया है जो पारदर्शिता का वादा तो करता है लेकिन बहुत ही नाजुक परिणाम देता है। कंपनी ने हाल ही में घोषणा की है कि चैटजीपीटी (ChatGPT) अब यूरोपीय संघ के उपयोगकर्ताओं के लिए डिफ़ॉल्ट रूप से अपने टेक्स्ट आउटपुट पर वॉटरमार्क लगाएगा। यह परिवर्तन ईयू एआई अधिनियम (EU AI Act) की आवश्यकताओं का पालन करता है, जो यह अनिवार्य करता है कि एआई-जनरेटेड सामग्री का पता लगाया जा सके। हालांकि, वास्तविकता यह बताती है कि यह नया डिजिटल सील किसी स्थायी ब्रांड की तरह नहीं बल्कि एक हल्के पेंसिल के निशान जैसा है जिसे एक बच्चा एक झटके में मिटा सकता है।
ओपनएआई अपनी नई पद्धति को टेक्स्टग्रेन (textGrain) कहता है। सरल शब्दों में, यह एक मालिकाना प्रणाली है जो एआई द्वारा चुने गए शब्दों में सांख्यिकीय पैटर्न एम्बेड करती है। औसत उपयोगकर्ता के लिए, टेक्स्ट किसी भी अन्य प्रतिक्रिया के समान ही दिखता है। व्याकरण ठीक है, लहजा सुसंगत है, और जानकारी भी वही है। लेकिन एक विशेष डिटेक्टर टूल के लिए, वे शब्द चयन एक फिंगरप्रिंट की तरह कार्य करते हैं। यह प्रणाली एक अथक इंटर्न की तरह काम करती है जिसे मेमो लिखते समय समानार्थी शब्दों के एक विशिष्ट सेट का उपयोग करने के लिए कहा गया हो। यदि आप पैटर्न जानते हैं, तो आप इंटर्न की पहचान कर सकते हैं। यदि आप पैटर्न नहीं जानते हैं, तो मेमो बिल्कुल सामान्य दिखता है।
बड़ी तस्वीर को देखें तो, textGrain की प्रभावशीलता पूरी तरह से इस बात पर निर्भर करती है कि टेक्स्ट अछूता रहे। ओपनएआई का अपना डेटा एक चौंकाने वाली कमजोरी को उजागर करता है जिसे अधिकांश कॉर्पोरेट प्रेस विज्ञप्तियां छिपाना पसंद करेंगी। आदर्श परिस्थितियों में, टूल के पास अपने स्वयं के लेखन की पहचान करने में 92 प्रतिशत सफलता दर है। यह तब तक प्रभावशाली लगता है जब तक आप इसमें थोड़ा सा मानवीय प्रयास नहीं जोड़ते।
जनरेट किए गए टेक्स्ट में केवल 10 प्रतिशत बदलाव करने से डिटेक्शन रेट लगभग 30 प्रतिशत तक गिर जाता है। यदि कोई उपयोगकर्ता 20 प्रतिशत शब्दों को बदल देता है—शायद कुछ विशेषणों को बदलकर या कुछ वाक्यों को फिर से लिखकर—तो सफलता दर लगभग 75 प्रतिशत तक गिर जाती है। व्यावहारिक रूप से, थिसॉरस (शब्दकोश) की बुनियादी समझ रखने वाला कोई भी व्यक्ति सेकंडों में इस प्रणाली को बायपास कर सकता है। यह वॉटरमार्क को जनता के लिए एक विश्वसनीय सुरक्षा जाल के बजाय नियामकों के लिए एक अनुपालन उपकरण बनाता है। यह एआई धोखे की व्यापक समस्या को वास्तव में हल किए बिना यूरोपीय संघ के कानून की शर्तों को पूरा करता है।
बाजार की दृष्टि से, ओपनएआई और उसके प्राथमिक प्रतिस्पर्धी, एंथ्रोपिक (Anthropic) के बीच का अंतर स्पष्ट है। एंथ्रोपिक ने इस साल की शुरुआत में अपना वॉटरमार्किंग सिस्टम पेश किया था, लेकिन इसे वैश्विक स्तर पर सभी उपयोगकर्ताओं के लिए सक्षम करने का विकल्प चुना। ओपनएआई ने अधिक चयनात्मक रास्ता अपनाया है, इस सुविधा को केवल वहीं डिफ़ॉल्ट रूप से चालू किया है जहां कानून की मांग है। संयुक्त राज्य अमेरिका, एशिया और अन्य क्षेत्रों के उपयोगकर्ताओं के पास अभी भी "क्लीन" आउटपुट होंगे, जब तक कि वे या उनके संगठन मैन्युअल रूप से एपीआई (API) के माध्यम से इसे नहीं चुनते।
यह क्षेत्रीय विभाजन एक खंडित डिजिटल वातावरण बनाता है। बर्लिन के एक छात्र को डिफ़ॉल्ट रूप से वॉटरमार्क वाले निबंध प्राप्त होंगे, जबकि न्यूयॉर्क के छात्र को नहीं। उपभोक्ता के दृष्टिकोण से, यह बताता है कि ओपनएआई वॉटरमार्किंग को एक भरोसेमंद उत्पाद की आधारभूत विशेषता के बजाय पार करने वाली एक नियामक बाधा के रूप में देखता है। कंपनी यूरोपीय संघ में कानूनी बने रहने के लिए न्यूनतम प्रयास कर रही है, जबकि अन्य जगहों पर अपने उत्पाद को यथासंभव घर्षण मुक्त (frictionless) रख रही है।
| विशेषता | ओपनएआई textGrain | एंथ्रोपिक वॉटरमार्किंग |
|---|---|---|
| डिफ़ॉल्ट क्षेत्र | केवल ईयू | वैश्विक |
| डिटेक्शन दर | 92% (आदर्श) | उच्च (मालिकाना) |
| संपादन संवेदनशीलता | उच्च (20% बदलाव इसे तोड़ देता है) | मध्यम से उच्च |
| पहुंच | सीमित शोधकर्ता | सार्वजनिक/एपीआई |
| मानक | मालिकाना | मालिकाना/C2PA |
पर्दे के पीछे, टेक्स्ट को वॉटरमार्क करना इमेज या वीडियो को वॉटरमार्क करने की तुलना में काफी कठिन है। जब DALL-E या Midjourney जैसा सिस्टम एक इमेज बनाता है, तो वह पिक्सेल में मेटाडेटा छिपा सकता है या शोर पैटर्न (noise patterns) को इस तरह से समायोजित कर सकता है कि वह आंखों के लिए अदृश्य रहे लेकिन कंप्यूटर के लिए स्पष्ट हो। ये पिक्सेल घने होते हैं और सिग्नल छिपाने के लिए हजारों स्थान प्रदान करते हैं।
टेक्स्ट अलग है क्योंकि यह विरल है। एक वाक्य में केवल सीमित शब्द होते हैं, और प्रत्येक शब्द के सीमित समानार्थी होते हैं जो संदर्भ में समझ में आते हैं। यदि एआई वॉटरमार्क बनाए रखने के लिए एक विशिष्ट शब्द चयन को मजबूर करता है, तो यह लेखन को बोझिल या दोहराव वाला बनाने का जोखिम उठाता है। ओपनएआई का दावा है कि textGrain गुणवत्ता कम नहीं करता है, लेकिन सांख्यिकीय समझौता हमेशा मौजूद रहता है। वॉटरमार्क को पहचान योग्य बनाए रखने के लिए, एआई को अपनी रचनात्मक यादृच्छिकता (creative randomness) का एक छोटा हिस्सा त्यागना पड़ता है। यही कारण है कि छोटे संदेशों या अनुवादित टेक्स्ट के लिए डिटेक्शन रेट और भी कम है। तीन वाक्यों वाले ईमेल में एक जटिल गणितीय फिंगरप्रिंट छिपाने के लिए पर्याप्त डेटा नहीं होता है।
रोजमर्रा के उपयोगकर्ता के लिए, textGrain के आगमन को स्वस्थ संदेह के साथ देखा जाना चाहिए। यदि आप एक शिक्षक, एक संपादक, या एक हायरिंग मैनेजर हैं, तो आप एक निश्चित उत्तर प्रदान करने के लिए इन डिटेक्टरों पर भरोसा नहीं कर सकते। इस प्रणाली को धोखा देना बहुत आसान है। एक उपयोगकर्ता चैटजीपीटी आउटपुट ले सकता है, उसे त्वरित पुनर्लेखन के लिए एक अलग, बिना वॉटरमार्क वाले एआई के माध्यम से चला सकता है, और मूल वॉटरमार्क गायब हो जाएगा।
अंततः, यह हमारे डिजिटल प्रमाण को देखने के तरीके में एक प्रणालीगत बदलाव है। हम एक ऐसी दुनिया से दूर जा रहे हैं जहाँ हम जो देखते हैं उस पर भरोसा कर सकते हैं, और एक ऐसी दुनिया की ओर बढ़ रहे हैं जहाँ हमें प्रामाणिकता सत्यापित करने के लिए एक "कुंजी" की आवश्यकता है। ओपनएआई वर्तमान में उस कुंजी को एक मखमली रस्सी के पीछे रख रहा है, जो केवल सीमित संख्या में शोधकर्ताओं और संगठनों को पहुंच प्रदान कर रहा है। यह अपारदर्शिता एक नए प्रकार का शक्ति असंतुलन पैदा करती है। जो कंपनी सामग्री बनाती है, वही एकमात्र ऐसी कंपनी भी है जो इसे मज़बूती से पकड़ सकती है, और तब भी, वे इसे तभी पकड़ सकते हैं जब उपयोगकर्ता आलसी हो।
व्यावहारिक रूप से, यूरोपीय संघ में textGrain का रोलआउट एक ऐसे भविष्य के लिए बीटा टेस्ट है जहाँ सभी डिजिटल श्रम को टैग किया जाता है। यह एक अनुस्मारक के रूप में कार्य करता है कि हम जिन उपकरणों का उपयोग करते हैं, वे तेजी से अंतरराष्ट्रीय कानून की अदृश्य रीढ़ के अधीन हैं। जबकि ईयू एआई अधिनियम का उद्देश्य नागरिकों को डीपफेक और स्वचालित प्रचार से गुमराह होने से बचाना है, उपलब्ध तकनीकी उपकरण अभी उस लक्ष्य को पूरा करने के लिए पर्याप्त लचीले नहीं हैं।
जैसे-जैसे ये सुविधाएँ रोल आउट होती हैं, उपभोक्ताओं को अपनी आदतों का निरीक्षण करना चाहिए। आप चैटजीपीटी द्वारा अपने उत्तरों को वाक्यांशित करने के तरीके में सूक्ष्म बदलाव देख सकते हैं क्योंकि मॉडल अपने सांख्यिकीय फिंगरप्रिंट को बनाए रखने की कोशिश करता है। आप "एआई-क्लीनर" टूल की वृद्धि भी देख सकते हैं—सरल प्रोग्राम जिन्हें विशेष रूप से इन चिह्नों को हटाने के लिए टेक्स्ट को फिर से लिखने के लिए डिज़ाइन किया गया है। एआई लैब और उपयोगकर्ताओं के बीच चूहे-बिल्ली का खेल एक नए, अधिक स्थानीय चरण में प्रवेश कर रहा है।
जैसे-जैसे हम आगे बढ़ते हैं, ऐसे बैज या स्टैम्प की तलाश करना बंद करें जो कहता हो "एआई द्वारा निर्मित।" ये चिह्न डिजिटल कच्चे तेल का हिस्सा बनते जा रहे हैं जो हमारे ऐप्स को शक्ति प्रदान करते हैं, जो हमारे द्वारा पढ़े जाने वाले वाक्यों के गणित के भीतर गहराई से छिपे होते हैं। लब्बोलुआब यह है कि कोई भी वॉटरमार्क आलोचनात्मक सोच का स्थान नहीं ले सकता। चाहे किसी पैराग्राफ में छिपा हुआ सांख्यिकीय दाना (grain) हो या न हो, तथ्यों और इरादे को सत्यापित करने की जिम्मेदारी अभी भी पाठक पर है। डिजिटल इंटर्न अब अपने काम को टैग कर रहा है, लेकिन काम वास्तव में सही है या नहीं, यह जांचना अभी भी बॉस पर निर्भर है।
स्रोत:



हमारा एंड-टू-एंड एन्क्रिप्टेड ईमेल और क्लाउड स्टोरेज समाधान सुरक्षित डेटा एक्सचेंज का सबसे शक्तिशाली माध्यम प्रदान करता है, जो आपके डेटा की सुरक्षा और गोपनीयता सुनिश्चित करता है।
/ एक नि: शुल्क खाता बनाएं