उद्योग समाचार

ओपनएआई का नया डिजिटल वॉटरमार्क आपको धोखा खाने से क्यों नहीं रोक पाएगा

ओपनएआई नए कानूनों का पालन करने के लिए ईयू में चैटजीपीटी के लिए टेक्स्टग्रेन वॉटरमार्किंग लॉन्च कर रहा है। जानें कि क्यों इस छिपी हुई तकनीक को बायपास करना आश्चर्यजनक रूप से आसान है।
ओपनएआई का नया डिजिटल वॉटरमार्क आपको धोखा खाने से क्यों नहीं रोक पाएगा

जबकि दुनिया इस बात पर स्पष्टता की मांग कर रही है कि क्या मानवीय है और क्या मशीन, ओपनएआई (OpenAI) ने अभी एक ऐसा टूल लॉन्च किया है जो पारदर्शिता का वादा तो करता है लेकिन बहुत ही नाजुक परिणाम देता है। कंपनी ने हाल ही में घोषणा की है कि चैटजीपीटी (ChatGPT) अब यूरोपीय संघ के उपयोगकर्ताओं के लिए डिफ़ॉल्ट रूप से अपने टेक्स्ट आउटपुट पर वॉटरमार्क लगाएगा। यह परिवर्तन ईयू एआई अधिनियम (EU AI Act) की आवश्यकताओं का पालन करता है, जो यह अनिवार्य करता है कि एआई-जनरेटेड सामग्री का पता लगाया जा सके। हालांकि, वास्तविकता यह बताती है कि यह नया डिजिटल सील किसी स्थायी ब्रांड की तरह नहीं बल्कि एक हल्के पेंसिल के निशान जैसा है जिसे एक बच्चा एक झटके में मिटा सकता है।

ओपनएआई अपनी नई पद्धति को टेक्स्टग्रेन (textGrain) कहता है। सरल शब्दों में, यह एक मालिकाना प्रणाली है जो एआई द्वारा चुने गए शब्दों में सांख्यिकीय पैटर्न एम्बेड करती है। औसत उपयोगकर्ता के लिए, टेक्स्ट किसी भी अन्य प्रतिक्रिया के समान ही दिखता है। व्याकरण ठीक है, लहजा सुसंगत है, और जानकारी भी वही है। लेकिन एक विशेष डिटेक्टर टूल के लिए, वे शब्द चयन एक फिंगरप्रिंट की तरह कार्य करते हैं। यह प्रणाली एक अथक इंटर्न की तरह काम करती है जिसे मेमो लिखते समय समानार्थी शब्दों के एक विशिष्ट सेट का उपयोग करने के लिए कहा गया हो। यदि आप पैटर्न जानते हैं, तो आप इंटर्न की पहचान कर सकते हैं। यदि आप पैटर्न नहीं जानते हैं, तो मेमो बिल्कुल सामान्य दिखता है।

अदृश्य पैटर्न की नाजुकता

बड़ी तस्वीर को देखें तो, textGrain की प्रभावशीलता पूरी तरह से इस बात पर निर्भर करती है कि टेक्स्ट अछूता रहे। ओपनएआई का अपना डेटा एक चौंकाने वाली कमजोरी को उजागर करता है जिसे अधिकांश कॉर्पोरेट प्रेस विज्ञप्तियां छिपाना पसंद करेंगी। आदर्श परिस्थितियों में, टूल के पास अपने स्वयं के लेखन की पहचान करने में 92 प्रतिशत सफलता दर है। यह तब तक प्रभावशाली लगता है जब तक आप इसमें थोड़ा सा मानवीय प्रयास नहीं जोड़ते।

जनरेट किए गए टेक्स्ट में केवल 10 प्रतिशत बदलाव करने से डिटेक्शन रेट लगभग 30 प्रतिशत तक गिर जाता है। यदि कोई उपयोगकर्ता 20 प्रतिशत शब्दों को बदल देता है—शायद कुछ विशेषणों को बदलकर या कुछ वाक्यों को फिर से लिखकर—तो सफलता दर लगभग 75 प्रतिशत तक गिर जाती है। व्यावहारिक रूप से, थिसॉरस (शब्दकोश) की बुनियादी समझ रखने वाला कोई भी व्यक्ति सेकंडों में इस प्रणाली को बायपास कर सकता है। यह वॉटरमार्क को जनता के लिए एक विश्वसनीय सुरक्षा जाल के बजाय नियामकों के लिए एक अनुपालन उपकरण बनाता है। यह एआई धोखे की व्यापक समस्या को वास्तव में हल किए बिना यूरोपीय संघ के कानून की शर्तों को पूरा करता है।

दो कॉर्पोरेट रणनीतियों की कहानी

बाजार की दृष्टि से, ओपनएआई और उसके प्राथमिक प्रतिस्पर्धी, एंथ्रोपिक (Anthropic) के बीच का अंतर स्पष्ट है। एंथ्रोपिक ने इस साल की शुरुआत में अपना वॉटरमार्किंग सिस्टम पेश किया था, लेकिन इसे वैश्विक स्तर पर सभी उपयोगकर्ताओं के लिए सक्षम करने का विकल्प चुना। ओपनएआई ने अधिक चयनात्मक रास्ता अपनाया है, इस सुविधा को केवल वहीं डिफ़ॉल्ट रूप से चालू किया है जहां कानून की मांग है। संयुक्त राज्य अमेरिका, एशिया और अन्य क्षेत्रों के उपयोगकर्ताओं के पास अभी भी "क्लीन" आउटपुट होंगे, जब तक कि वे या उनके संगठन मैन्युअल रूप से एपीआई (API) के माध्यम से इसे नहीं चुनते।

यह क्षेत्रीय विभाजन एक खंडित डिजिटल वातावरण बनाता है। बर्लिन के एक छात्र को डिफ़ॉल्ट रूप से वॉटरमार्क वाले निबंध प्राप्त होंगे, जबकि न्यूयॉर्क के छात्र को नहीं। उपभोक्ता के दृष्टिकोण से, यह बताता है कि ओपनएआई वॉटरमार्किंग को एक भरोसेमंद उत्पाद की आधारभूत विशेषता के बजाय पार करने वाली एक नियामक बाधा के रूप में देखता है। कंपनी यूरोपीय संघ में कानूनी बने रहने के लिए न्यूनतम प्रयास कर रही है, जबकि अन्य जगहों पर अपने उत्पाद को यथासंभव घर्षण मुक्त (frictionless) रख रही है।

विशेषता ओपनएआई textGrain एंथ्रोपिक वॉटरमार्किंग
डिफ़ॉल्ट क्षेत्र केवल ईयू वैश्विक
डिटेक्शन दर 92% (आदर्श) उच्च (मालिकाना)
संपादन संवेदनशीलता उच्च (20% बदलाव इसे तोड़ देता है) मध्यम से उच्च
पहुंच सीमित शोधकर्ता सार्वजनिक/एपीआई
मानक मालिकाना मालिकाना/C2PA

टेक्स्ट बनाम इमेज की तकनीकी बाधा

पर्दे के पीछे, टेक्स्ट को वॉटरमार्क करना इमेज या वीडियो को वॉटरमार्क करने की तुलना में काफी कठिन है। जब DALL-E या Midjourney जैसा सिस्टम एक इमेज बनाता है, तो वह पिक्सेल में मेटाडेटा छिपा सकता है या शोर पैटर्न (noise patterns) को इस तरह से समायोजित कर सकता है कि वह आंखों के लिए अदृश्य रहे लेकिन कंप्यूटर के लिए स्पष्ट हो। ये पिक्सेल घने होते हैं और सिग्नल छिपाने के लिए हजारों स्थान प्रदान करते हैं।

टेक्स्ट अलग है क्योंकि यह विरल है। एक वाक्य में केवल सीमित शब्द होते हैं, और प्रत्येक शब्द के सीमित समानार्थी होते हैं जो संदर्भ में समझ में आते हैं। यदि एआई वॉटरमार्क बनाए रखने के लिए एक विशिष्ट शब्द चयन को मजबूर करता है, तो यह लेखन को बोझिल या दोहराव वाला बनाने का जोखिम उठाता है। ओपनएआई का दावा है कि textGrain गुणवत्ता कम नहीं करता है, लेकिन सांख्यिकीय समझौता हमेशा मौजूद रहता है। वॉटरमार्क को पहचान योग्य बनाए रखने के लिए, एआई को अपनी रचनात्मक यादृच्छिकता (creative randomness) का एक छोटा हिस्सा त्यागना पड़ता है। यही कारण है कि छोटे संदेशों या अनुवादित टेक्स्ट के लिए डिटेक्शन रेट और भी कम है। तीन वाक्यों वाले ईमेल में एक जटिल गणितीय फिंगरप्रिंट छिपाने के लिए पर्याप्त डेटा नहीं होता है।

आपके डिजिटल जीवन के लिए इसका क्या अर्थ है

रोजमर्रा के उपयोगकर्ता के लिए, textGrain के आगमन को स्वस्थ संदेह के साथ देखा जाना चाहिए। यदि आप एक शिक्षक, एक संपादक, या एक हायरिंग मैनेजर हैं, तो आप एक निश्चित उत्तर प्रदान करने के लिए इन डिटेक्टरों पर भरोसा नहीं कर सकते। इस प्रणाली को धोखा देना बहुत आसान है। एक उपयोगकर्ता चैटजीपीटी आउटपुट ले सकता है, उसे त्वरित पुनर्लेखन के लिए एक अलग, बिना वॉटरमार्क वाले एआई के माध्यम से चला सकता है, और मूल वॉटरमार्क गायब हो जाएगा।

अंततः, यह हमारे डिजिटल प्रमाण को देखने के तरीके में एक प्रणालीगत बदलाव है। हम एक ऐसी दुनिया से दूर जा रहे हैं जहाँ हम जो देखते हैं उस पर भरोसा कर सकते हैं, और एक ऐसी दुनिया की ओर बढ़ रहे हैं जहाँ हमें प्रामाणिकता सत्यापित करने के लिए एक "कुंजी" की आवश्यकता है। ओपनएआई वर्तमान में उस कुंजी को एक मखमली रस्सी के पीछे रख रहा है, जो केवल सीमित संख्या में शोधकर्ताओं और संगठनों को पहुंच प्रदान कर रहा है। यह अपारदर्शिता एक नए प्रकार का शक्ति असंतुलन पैदा करती है। जो कंपनी सामग्री बनाती है, वही एकमात्र ऐसी कंपनी भी है जो इसे मज़बूती से पकड़ सकती है, और तब भी, वे इसे तभी पकड़ सकते हैं जब उपयोगकर्ता आलसी हो।

वॉटरमार्क वाली दुनिया में नेविगेट करना

व्यावहारिक रूप से, यूरोपीय संघ में textGrain का रोलआउट एक ऐसे भविष्य के लिए बीटा टेस्ट है जहाँ सभी डिजिटल श्रम को टैग किया जाता है। यह एक अनुस्मारक के रूप में कार्य करता है कि हम जिन उपकरणों का उपयोग करते हैं, वे तेजी से अंतरराष्ट्रीय कानून की अदृश्य रीढ़ के अधीन हैं। जबकि ईयू एआई अधिनियम का उद्देश्य नागरिकों को डीपफेक और स्वचालित प्रचार से गुमराह होने से बचाना है, उपलब्ध तकनीकी उपकरण अभी उस लक्ष्य को पूरा करने के लिए पर्याप्त लचीले नहीं हैं।

जैसे-जैसे ये सुविधाएँ रोल आउट होती हैं, उपभोक्ताओं को अपनी आदतों का निरीक्षण करना चाहिए। आप चैटजीपीटी द्वारा अपने उत्तरों को वाक्यांशित करने के तरीके में सूक्ष्म बदलाव देख सकते हैं क्योंकि मॉडल अपने सांख्यिकीय फिंगरप्रिंट को बनाए रखने की कोशिश करता है। आप "एआई-क्लीनर" टूल की वृद्धि भी देख सकते हैं—सरल प्रोग्राम जिन्हें विशेष रूप से इन चिह्नों को हटाने के लिए टेक्स्ट को फिर से लिखने के लिए डिज़ाइन किया गया है। एआई लैब और उपयोगकर्ताओं के बीच चूहे-बिल्ली का खेल एक नए, अधिक स्थानीय चरण में प्रवेश कर रहा है।

जैसे-जैसे हम आगे बढ़ते हैं, ऐसे बैज या स्टैम्प की तलाश करना बंद करें जो कहता हो "एआई द्वारा निर्मित।" ये चिह्न डिजिटल कच्चे तेल का हिस्सा बनते जा रहे हैं जो हमारे ऐप्स को शक्ति प्रदान करते हैं, जो हमारे द्वारा पढ़े जाने वाले वाक्यों के गणित के भीतर गहराई से छिपे होते हैं। लब्बोलुआब यह है कि कोई भी वॉटरमार्क आलोचनात्मक सोच का स्थान नहीं ले सकता। चाहे किसी पैराग्राफ में छिपा हुआ सांख्यिकीय दाना (grain) हो या न हो, तथ्यों और इरादे को सत्यापित करने की जिम्मेदारी अभी भी पाठक पर है। डिजिटल इंटर्न अब अपने काम को टैग कर रहा है, लेकिन काम वास्तव में सही है या नहीं, यह जांचना अभी भी बॉस पर निर्भर है।

स्रोत:

  • OpenAI Technical Paper on textGrain and Statistical Watermarking
  • European Commission: EU AI Act Regulatory Framework
  • Anthropic Official Blog: Global Deployment of AI Content Marking
  • C2PA (Coalition for Content Provenance and Authenticity) Standard Documentation
bg
bg
bg

आप दूसरी तरफ देखिए।

हमारा एंड-टू-एंड एन्क्रिप्टेड ईमेल और क्लाउड स्टोरेज समाधान सुरक्षित डेटा एक्सचेंज का सबसे शक्तिशाली माध्यम प्रदान करता है, जो आपके डेटा की सुरक्षा और गोपनीयता सुनिश्चित करता है।

/ एक नि: शुल्क खाता बनाएं