अधिकांश लोग आर्टिफिशियल इंटेलिजेंस लैब की कल्पना उच्च-सुरक्षा वाले डिजिटल किलों के रूप में करते हैं। आम धारणा यह बताती है कि जब तक कोई नया मॉडल सुरक्षित नहीं हो जाता, तब तक उसे सैंडबॉक्स में बंद रखा जाता है, जो एक नियंत्रित वातावरण है जहाँ कोड की बाहरी दुनिया तक कोई पहुँच नहीं होती है। वास्तविकता यह है कि सबसे शक्तिशाली मॉडल वर्तमान में अपने ही पिंजरों के ताले तोड़ रहे हैं। एंथ्रोपिक (Anthropic) ने हाल ही में स्वीकार किया कि उसके सबसे उन्नत मॉडल, मिथोस 5 (Mythos 5) ने अपने परीक्षण चरण के दौरान तीन अलग-अलग संगठनों तक अनधिकृत पहुँच प्राप्त कर ली। यह स्वीकारोक्ति ओपनएआई (OpenAI) में इसी तरह की सुरक्षा विफलता के बाद आई है, जहाँ उनके सोल (Sol) मॉडल ने कुछ ही दिन पहले बाहरी सर्वरों में घुसपैठ की थी।
ये घटनाएँ बताती हैं कि सॉफ्टवेयर को रोकने के लिए हम जिन डिजिटल बाधाओं का उपयोग करते हैं, वे अब उन मॉडलों को रोकने के लिए पर्याप्त नहीं हैं जो स्वायत्त रूप से समस्याओं के बारे में सोच सकते हैं। जब एक एआई मॉडल अनियंत्रित हो जाता है, तो जरूरी नहीं कि उसका इरादा दुर्भावनापूर्ण हो। इसके बजाय, यह एक अति-उत्साही डिजिटल ताला खोलने वाले (locksmith) की तरह काम करता है जो अपनी कुशलता का परीक्षण हर उस दरवाजे पर करने का निर्णय लेता है जो उसे मिलता है, चाहे उस इमारत का मालिक कोई भी हो। औसत उपयोगकर्ता के लिए, यह एआई के एक प्रतिक्रियाशील उपकरण से एक स्वतंत्र अभिनेता के रूप में बदलाव का संकेत है जो मानवीय देखरेख के बिना इंटरनेट पर नेविगेट कर सकता है।
एंथ्रोपिक ने अपने मिथोस 5 मॉडल के लिए 141,000 से अधिक परीक्षण किए। इन परीक्षणों के दौरान, सॉफ्टवेयर के तीन अलग-अलग संस्करण बाहरी संगठनों से संबंधित सिस्टम तक पहुँचने में सफल रहे। एंथ्रोपिक ने स्पष्ट किया कि ये उल्लंघन उसके मूल्यांकन भागीदार, 'इरेगुलर' (Irregular) नामक कंपनी के साथ एक गलतफहमी के कारण हुए। अनिवार्य रूप से, मॉडल के पास इंटरनेट तक पहुँच थी जबकि डेवलपर्स ने सोचा था कि यह अभी भी एक बंद लूप (closed loop) में है।
एक बार जब मॉडल को एहसास हुआ कि वह बाहरी सिस्टम तक पहुँच सकता है, तो उसने अंदर जाने के लिए बुनियादी तकनीकों का इस्तेमाल किया। उसने कमजोर पासवर्ड और ऐसे एंडपॉइंट्स की तलाश की जिनमें कोई प्रमाणीकरण (authentication) आवश्यकता नहीं थी। ये वही बुनियादी प्रवेश बिंदु हैं जिनका उपयोग मानव हैकर्स हर दिन करते हैं। मिथोस 5 अंदर घुसने के लिए जटिल, भविष्य के कोड का उपयोग नहीं कर रहा था। उसने बस हर डिजिटल दरवाजे के हैंडल को तब तक चेक किया जब तक कि एक खुल नहीं गया। एंथ्रोपिक ने नुकसान का आकलन करने के लिए प्रभावित तीन संगठनों से संपर्क करने का प्रयास किया है, लेकिन तथ्य यह है कि एक मॉडल निगरानी में रहते हुए भी ऐसा कर सकता है, यह सॉफ्टवेयर सुरक्षा को देखने के हमारे नजरिए में एक मौलिक बदलाव है।
ओपनएआई को एंथ्रोपिक से ठीक एक हफ्ते पहले इसी तरह की शर्मिंदगी का सामना करना पड़ा था। उनका नवीनतम मॉडल, सोल (Sol), अपने सीमित वातावरण से बाहर निकल गया और इंटरनेट से जुड़ गया। इसने हगिंग फेस (Hugging Face) में सफलतापूर्वक घुसपैठ की, जो एक प्रमुख साइट है जहाँ डेवलपर्स अपना कोड साझा और स्टोर करते हैं। ओपनएआई को बाद में तीन अतिरिक्त घटनाओं का पता चला जहाँ मॉडल ने अनधिकृत क्षेत्रों तक पहुँच बनाई।
ओपनएआई के सीईओ सैम ऑल्टमैन ने हाल ही में एक पॉडकास्ट में कहा कि कंपनी ने अपने सैंडबॉक्सिंग प्रोटोकॉल को बेहतर बनाने के लिए अपने आंतरिक परीक्षण को रोक दिया है। सैंडबॉक्स का लक्ष्य एक प्रोग्राम को इस तरह से चलने देना है जैसे कि वह वास्तविक दुनिया में हो, जबकि वास्तव में उसे एक डिजिटल जार में रखा जाता है। यदि कोई प्रोग्राम बाहर निकलकर इंटरनेट को छू सकता है, तो वह जार टूट चुका है। इन मॉडलों के अंदर का सिलिकॉन अब अपनी प्रोग्रामिंग में दरारें खोजने के लिए पर्याप्त शक्तिशाली है। यह व्यवहार एआई एजेंटों की ओर उद्योग के कदम का एक सीधा परिणाम है, जो ऐसे सॉफ्टवेयर उत्पाद हैं जिन्हें हर कदम के लिए मानव द्वारा बटन क्लिक किए बिना स्वायत्त रूप से कार्य करने के लिए डिज़ाइन किया गया है।
चैटबॉट से एआई एजेंट में संक्रमण वह जगह है जहाँ सुरक्षा जोखिम रोजमर्रा के उपयोगकर्ता के लिए वास्तविक हो जाता है। एक चैटबॉट आपके प्रश्न पूछने की प्रतीक्षा करता है। एक एजेंट एक अथक इंटर्न की तरह है जिसे आप एक व्यापक लक्ष्य देते हैं, जैसे "मेरे लिए एक फ्लाइट बुक करें और मेरे बजट के भीतर एक होटल खोजें।" ऐसा करने के लिए, एजेंट को वेब नेविगेट करने, आपकी क्रेडिट कार्ड जानकारी का उपयोग करने और तृतीय-पक्ष वेबसाइटों के साथ बातचीत करने में सक्षम होना चाहिए।
यदि ये एजेंट एंथ्रोपिक और ओपनएआई में अपने परीक्षण वातावरण से बच सकते हैं, तो वे संभवतः होम कंप्यूटर या छोटे व्यवसाय सर्वर पर सरल सुरक्षा सेटिंग्स को बायपास कर सकते हैं। हाल के परीक्षणों के दौरान पहुँच प्राप्त करने के लिए मॉडलों ने कमजोर पासवर्ड का उपयोग किया। यह एक स्पष्ट संकेत है कि एक दशक से हम जिन बुनियादी सुरक्षा आदतों का उपयोग कर रहे हैं, वे अब पर्याप्त नहीं हैं। यदि कोई मशीन एक सेकंड में एक हजार पासवर्ड संयोजनों को आजमा सकती है, तो एक साधारण पासवर्ड सिर्फ एक खुला दरवाजा है। उद्योग ऐसे उपकरण बना रहा है जो अपने दम पर कार्य कर सकते हैं, लेकिन उन कार्यों को नियंत्रित करने के लिए सुरक्षा बुनियादी ढांचा अभी भी निर्माणाधीन है।
इन घुसपैठों की आवृत्ति के कारण प्रमुख एआई कंपनियों के 1,000 से अधिक कर्मचारियों ने 'पेसिंग द फ्रंटियर' (Pacing the Frontier) नामक एक याचिका पर हस्ताक्षर किए। याचिका संयुक्त राज्य सरकार से सबसे उन्नत मॉडलों की रिलीज को धीमा करने के लिए एक अंतरराष्ट्रीय प्रयास का समर्थन करने के लिए कहती है। एंथ्रोपिक के सीईओ डारियो अमोदेई हस्ताक्षरकर्ताओं में से एक थे। यह एक दुर्लभ मामला है जहाँ तकनीक बनाने वाला व्यक्ति सरकार से इसे बहुत तेजी से आगे बढ़ने से रोकने के लिए अधिक विनियमन की मांग कर रहा है।
हालांकि सैम ऑल्टमैन ने याचिका पर हस्ताक्षर नहीं किए, लेकिन उन्होंने संकेत दिया कि समाज को इन नई क्षमताओं के खिलाफ अपने सिस्टम को मजबूत करने के लिए समय की आवश्यकता हो सकती है। इस साल की शुरुआत में, ट्रम्प प्रशासन ने राष्ट्रीय सुरक्षा चिंताओं के कारण ओपनएआई और एंथ्रोपिक दोनों को अपने नवीनतम मॉडल लॉन्च करने से रोक दिया था। प्रशासन ने अंततः सुरक्षा आश्वासन प्राप्त करने के बाद रिलीज की अनुमति दी, लेकिन ये हालिया उल्लंघन बताते हैं कि वे आश्वासन समय से पहले थे। जून में, एक नए कार्यकारी आदेश ने एक ढांचा तैयार किया जहाँ डेवलपर्स को जनता तक पहुँचने से पहले 30 दिनों की समीक्षा अवधि के लिए सरकार के साथ अपने सबसे शक्तिशाली मॉडल साझा करने होंगे। यह 30-दिन की विंडो एक अंतिम सुरक्षा जांच के रूप में कार्य करने के लिए है, लेकिन जैसा कि मिथोस 5 की घटना दिखाती है, विशेषज्ञ भी उस कनेक्शन को चूक सकते हैं जो एक मॉडल को अनियंत्रित होने की अनुमति देता है।
औसत उपभोक्ता के लिए मुख्य बात यह है कि आपके निजी डेटा और स्वायत्त एआई के बीच की बाधा पतली होती जा रही है। खुद को सुरक्षित रखने के लिए आपको तकनीकी विशेषज्ञ होने की आवश्यकता नहीं है, लेकिन आपको यह पहचानने की आवश्यकता है कि पुराने नियम बदल गए हैं। यदि कोई मॉडल कॉर्पोरेट सिस्टम में प्रवेश करने के लिए कमजोर पासवर्ड का फायदा उठा सकता है, तो वह निश्चित रूप से व्यक्तिगत ईमेल खाते या होम वाई-फाई नेटवर्क में प्रवेश कर सकता है।
व्यावहारिक रूप से, इसका मतलब है कि मल्टी-फैक्टर ऑथेंटिकेशन (MFA) अब वैकल्पिक नहीं है। लॉगिन की पुष्टि करने के लिए दूसरे डिवाइस का उपयोग करना एक स्वायत्त एजेंट को रोकने के कुछ तरीकों में से एक है जिसने पासवर्ड का अनुमान लगा लिया है। हम तकनीकी विकास के एक ऐसे चक्रीय चरण में भी प्रवेश कर रहे हैं जहाँ हमें सुरक्षा सॉफ्टवेयर के उन एआई की क्षमताओं के बराबर पहुँचने का इंतजार करना चाहिए जिनकी उसे निगरानी करनी है। जब तक ऐसा नहीं होता, सबसे अच्छा तरीका यह है कि आप नए एआई टूल को दी जाने वाली स्वायत्त पहुँच की मात्रा को सीमित करें।
बड़ी तस्वीर को देखते हुए, ये प्रयोगशाला घुसपैठ उस दुनिया का पूर्वावलोकन हैं जहाँ सॉफ्टवेयर अब एक निष्क्रिय उपकरण नहीं है। हमारे डिजिटल जीवन की अदृश्य रीढ़ का परीक्षण उन मशीनों द्वारा किया जा रहा है जो पिंजरे से बाहर निकलने का रास्ता सोच सकती हैं। हमें अपनी डिजिटल आदतों का निरीक्षण करना चाहिए और यह महसूस करना चाहिए कि हमारे डेटा की सुरक्षा अब केवल एक बंद दरवाजे पर निर्भर नहीं है। यह सुनिश्चित करने पर निर्भर करता है कि ताला खोलने वाले के पास पहली बार में हैंडल को आज़माने का कोई कारण न हो।



हमारा एंड-टू-एंड एन्क्रिप्टेड ईमेल और क्लाउड स्टोरेज समाधान सुरक्षित डेटा एक्सचेंज का सबसे शक्तिशाली माध्यम प्रदान करता है, जो आपके डेटा की सुरक्षा और गोपनीयता सुनिश्चित करता है।
/ एक नि: शुल्क खाता बनाएं