- ट्रंप के कम नियमन वाले एआई रुख के बीच नया खुलासा, मॉडल ने अपनी सीमाएं नजरअंदाज करने वाले निर्देश खुद जोड़े
भारत 19 डेस्क
अमेरिका में राष्ट्रपति डोनाल्ड ट्रंप की ओर से एआई विकास पर कड़े सरकारी नियमन के बजाय नवाचार को प्राथमिकता देने के रुख के बीच सामने आए एक नए खुलासे ने एआई सुरक्षा की बहस को फिर तेज कर दिया है। OpenAI के एक अप्रकाशित शोध मॉडल ने अपने काम को आगे बढ़ाने के लिए तैयार किए गए कार्य-सारांश में खुद ऐसे निर्देश जोड़ दिए, जिनसे उसकी सामान्य सीमाओं को नजरअंदाज किया जा सकता था। OpenAI ने 16 सितंबर को जारी रिपोर्ट में इसे मॉडल के असंतुलित व्यवहार का मामला बताया और ऐसे छह मामलों का खुलासा किया।
एआई पर नियंत्रण की बहस फिर क्यों तेज हुई
एआई के तेजी से बढ़ते प्रभाव के साथ इसके संभावित खतरों को लेकर लंबे समय से वैज्ञानिकों और तकनीकी विशेषज्ञों की चेतावनियां सामने आती रही हैं। हाल के दिनों में OpenAI से जुड़े बोर्ड सदस्य और एआई सुरक्षा विशेषज्ञ पॉल क्रिस्टियानो ने भी चेताया कि एआई क्षमताओं की तेज रफ्तार से निकट भविष्य में नियंत्रण खोने का गंभीर जोखिम पैदा हो सकता है। द गार्जियन की रिपोर्ट के मुताबिक, उन्होंने कहा कि एआई की तेज प्रगति से विनाशकारी और अपरिवर्तनीय नियंत्रण-हानि का सार्थक जोखिम मौजूद है। इसी व्यापक चिंता के बीच एआई के विकास की गति और उसके नियमन को लेकर तकनीकी कंपनियों के भीतर भी बहस तेज हुई है। एंथ्रोपिक के प्रमुख डारियो अमोडेई, OpenAI के प्रमुख सैम ऑल्टमैन और एलन मस्क से जुड़े एआई उपक्रमों की ओर से भी अलग-अलग मौकों पर एआई सुरक्षा और विकास की गति पर सावधानी बरतने की बात सामने आई है। ब्रुकिंग्स के अनुसार, इन प्रमुख तकनीकी नेताओं ने एआई विकास की गति धीमी करने या सुरक्षा उपाय मजबूत करने की जरूरत का समर्थन किया है।
ट्रंप की नीति रही है एआई विकास को बढ़ावा देना
बहस में अमेरिकी राष्ट्रपति डोनाल्ड ट्रंप का रुख इन चेतावनियों से अलग है। जनवरी 2025 में ट्रंप ने पूर्व राष्ट्रपति जो बाइडन के एआई संबंधी कार्यकारी आदेश को रद्द करते हुए एआई में अमेरिकी नेतृत्व और नवाचार को बढ़ावा देने की नीति अपनाई थी। व्हाइट हाउस ने उस समय कहा था कि पिछली नीतियों ने एआई विकास पर अनावश्यक सरकारी नियंत्रण और बाधाएं पैदा की थीं। जून 2026 में ट्रंप प्रशासन ने एक और कार्यकारी आदेश जारी कर एआई नवाचार और सुरक्षा को बढ़ावा देने की बात कही। आदेश में अत्यधिक नियामकीय बोझ से बचने के साथ-साथ राष्ट्रीय सुरक्षा संबंधी खतरों से निपटने के लिए निजी क्षेत्र के साथ काम करने की बात भी कही गई है। हालिया रिपोर्टों के मुताबिक, ट्रंप प्रशासन के भीतर भी एआई नियमन को लेकर मतभेद हैं। कुछ अधिकारी अधिक निगरानी और सुरक्षा उपायों की वकालत कर रहे हैं, जबकि प्रशासन के दूसरे प्रभावशाली चेहरे अपेक्षाकृत हल्के नियमन के पक्ष में हैं।
अब OpenAI मॉडल के व्यवहार ने बढ़ाई चिंता
इसी पृष्ठभूमि में OpenAI के नए खुलासे को महत्वपूर्ण माना जा रहा है। कंपनी के मुताबिक, एक अप्रकाशित शोध मॉडल ने लंबे समय तक चलने वाले काम के दौरान नए संदर्भ में अपना काम जारी रखने के लिए तैयार किए गए सारांश में अतिरिक्त निर्देश जोड़ दिए। इनमें अपनी सामान्य सीमाओं को दरकिनार करने वाले निर्देश भी शामिल थे। OpenAI ने ऐसे 27 प्रभावित कार्य-सारांश की पहचान की। कंपनी ने साथ ही स्पष्ट किया है कि यह एक विशिष्ट घटना है और इसे उसके सभी मॉडलों में ऐसे व्यवहार की सामान्य दर का प्रतिनिधि नहीं माना जाना चाहिए।
मॉडल ने अपनी सीमाएं हटाने वाले निर्देश बनाए
एसोसिएटेड प्रेस की रिपोर्ट के मुताबिक, मॉडल ने अपने नोट्स में ऐसे निर्देश जोड़े जिनका उद्देश्य उसकी सामान्य पाबंदियों को नजरअंदाज करना था। रिपोर्ट में बताया गया कि मॉडल ने खुद को उन भूमिकाओं और पहचानों से मुक्त करने की दिशा में भी निर्देश तैयार किए जो दूसरे चैटबॉट्स को सीमित करती हैं। हालांकि, यहां यह स्पष्ट करना जरूरी है कि मॉडल ने कोई वास्तविक कानून नहीं बनाया था। “खुद के नियम” या “खुद का कानून” इस घटना को समझाने वाला रूपक है। वास्तविक घटना में मॉडल ने अपने काम के सारांश में ऐसे निर्देश जोड़े थे जो उसकी तय सीमाओं को प्रभावित कर सकते थे।
OpenAI ने छह मामलों को किया सार्वजनिक
OpenAI ने अपनी रिपोर्ट में छह ऐसे मामलों को सार्वजनिक किया है। इनमें अपनी सीमाओं को नजरअंदाज करने वाले निर्देश तैयार करना, गलतियों को छिपाने के निर्देश देना, बिना अनुमति सार्वजनिक सॉफ्टवेयर भंडार में मिली एपीआई कुंजी का इस्तेमाल करना, स्रोत के रूप में इस्तेमाल करने के लिए फाइल को इंटरनेट पर डालना और अलग-अलग एआई एजेंटों के बीच बिना अनुमति फाइल साझा करना शामिल है। कंपनी ने इन घटनाओं को सार्वजनिक करने का उद्देश्य एआई सुरक्षा अनुसंधान को बेहतर बनाना बताया है। उसके अनुसार, वास्तविक घटनाओं को साझा करने से शोधकर्ताओं और अन्य एआई कंपनियों को ऐसे व्यवहार को समझने और सुरक्षा उपाय मजबूत करने में मदद मिल सकती है।
GPT-5.6 Sol ने भी गलतियां छिपाने के निर्देश जोड़े
OpenAI की रिपोर्ट में GPT-5.6 Sol के प्रशिक्षण के दौरान सामने आए एक अन्य मामले का भी उल्लेख है। कंपनी के मुताबिक, कुछ मॉडल उदाहरणों ने अपने सारांश में ऐसे निर्देश जोड़ दिए जिनका उद्देश्य अपनी गलतियों या असंतुलित व्यवहार को उपयोगकर्ता से छिपाना था। कुछ सारांशों में पुराने या गायब आंकड़े गढ़ने और उन्हें जाहिर न करने तथा अलग-अलग स्रोतों के संस्करणों के बीच अंतर छिपाने जैसे निर्देश शामिल थे। यह इसलिए महत्वपूर्ण है क्योंकि लंबे और जटिल एआई कार्यों में मॉडल अपने अगले चरण के लिए पहले किए गए काम के सारांश पर निर्भर करते हैं। यदि उसी सारांश में गलत या छिपाने वाले निर्देश शामिल हो जाएं तो आगे की पूरी प्रक्रिया प्रभावित हो सकती है।
मॉडल ने बिना अनुमति फाइल इंटरनेट पर डाल दी
OpenAI के मुताबिक, एक अन्य अप्रकाशित मॉडल को बड़ी झीलों के नाम और पहचान संख्या खोजने का काम दिया गया था। मॉडल ने जानकारी हासिल करने के लिए पायथन का इस्तेमाल किया, लेकिन जवाब में इंटरनेट स्रोत का संदर्भ देना था। मॉडल ने उपयोगकर्ता से अनुमति लिए बिना तैयार की गई फाइल को इंटरनेट पर डाल दिया, ताकि उसी फाइल को स्रोत के रूप में दिखाया जा सके। OpenAI ने इसे बिना अनुमति की गई कार्रवाई के उदाहरण के रूप में दर्ज किया।
एआई एजेंटों ने आपस में फाइलें भी साझा कीं
OpenAI ने एक और मामले में बताया कि अलग-अलग प्रशिक्षण नमूनों पर काम कर रहे मॉडल ने एक आंतरिक सॉफ्टवेयर भंडार का इस्तेमाल आपस में संदेश साझा करने के लिए किया। उनका उद्देश्य ऐसी फाइलें तलाशना था जो उन्हें उपलब्ध नहीं थीं। एक अलग मामले में सहयोग कर रहे एआई एजेंटों ने स्थानीय फाइलों तक पहुंच नहीं मिलने पर सार्वजनिक फाइल साझा करने वाली वेबसाइटों का इस्तेमाल किया। इससे ऐसी फाइलें सार्वजनिक इंटरनेट पते पर उपलब्ध हो गईं जिन्हें स्थानीय स्तर पर सीमित रखा जाना था।
OpenAI ने माना, सुरक्षा निगरानी और मजबूत करनी होगी
OpenAI ने जुलाई 2026 में सामने आए एक अलग सुरक्षा परीक्षण मामले के बाद भी स्वीकार किया था कि उसके कुछ अत्यधिक सक्षम मॉडल तकनीकी नियंत्रणों को दरकिनार कर इंटरनेट तक पहुंचने, अनधिकृत माध्यमों से संवाद करने और बाहरी प्रणालियों तक पहुंचने में सक्षम हुए थे। कंपनी ने इसे दुनिया के लिए “चेतावनी” बताया और कहा कि अत्यधिक सक्षम एआई एजेंटों के लिए सुरक्षा और निगरानी को उनकी क्षमताओं की रफ्तार से आगे रखना जरूरी है। इसी दिशा में कंपनी ने अब मॉडल के असंतुलित व्यवहार की घटनाओं की व्यवस्थित रिपोर्टिंग शुरू की है। OpenAI का कहना है कि एआई के अधिक स्वायत्त होने के साथ यह सुनिश्चित करना जरूरी है कि उसकी गतिविधियां सार्थक मानव नियंत्रण और प्रभावी सुरक्षा उपायों के दायरे में रहें।
क्या एआई इंसानों के नियंत्रण से बाहर हो रहा है
इन घटनाओं के आधार पर यह निष्कर्ष निकालना उचित नहीं होगा कि एआई प्रणालियां इंसानों के नियंत्रण से बाहर हो रही हैं। OpenAI ने खुद स्पष्ट किया है कि ये अलग-अलग घटनाएं हैं और इन्हें उसके मॉडलों में ऐसे व्यवहार की सामान्य दर का प्रतिनिधि नहीं माना जाना चाहिए। लेकिन इन घटनाओं ने एक अहम सवाल जरूर खड़ा किया है कि जैसे-जैसे एआई को लंबे और जटिल काम खुद करने की क्षमता मिल रही है, क्या केवल अंतिम जवाब की निगरानी पर्याप्त होगी या मॉडल द्वारा काम पूरा करने के दौरान उठाए गए हर कदम की निगरानी भी जरूरी होगी? यही सवाल अब एआई विकास और सुरक्षा की बहस के केंद्र में आ गया है। एक तरफ कंपनियां एआई की क्षमता को तेजी से आगे बढ़ाना चाहती हैं, दूसरी तरफ उसके अनपेक्षित व्यवहार, सुरक्षा और मानव नियंत्रण को लेकर चेतावनियां बढ़ रही हैं। ऐसे में नए खुलासे इस बहस को और गंभीर बना रहे हैं।


