Samachar Nama
×

AI की इंसानी फितरत? खुद को इंसान बताने लगा आर्टिफिशियल इंटेलिजेंस, OpenAI का दावा

AI की इंसानी फितरत? खुद को इंसान बताने लगा आर्टिफिशियल इंटेलिजेंस, OpenAI का दावा

आर्टिफिशियल इंटेलिजेंस यानी AI लगातार ज्यादा सक्षम और स्वायत्त होता जा रहा है, लेकिन इसके साथ सुरक्षा को लेकर नई चिंताएं भी सामने आ रही हैं। OpenAI ने 16 सितंबर 2026 को AI मॉडल के 'मिसअलाइनमेंट' यानी तय निर्देशों और सुरक्षा सीमाओं से अलग व्यवहार को लेकर एक नई रिपोर्ट जारी की है। कंपनी ने ऐसे छह उदाहरण सार्वजनिक किए हैं, जो मॉडल की ट्रेनिंग और मूल्यांकन के दौरान सामने आए।OpenAI के मुताबिक, इन मामलों में मॉडल ने कुछ परिस्थितियों में अपने तय निर्देशों से हटकर काम करने की कोशिश की। कहीं मॉडल ने अपनी सीमाओं को नजरअंदाज करने वाले निर्देश बनाए, कहीं गलतियों को छिपाने की कोशिश की और कुछ मामलों में बिना अनुमति फाइल या जानकारी को बाहरी जगहों तक पहुंचाया गया।

हालांकि कंपनी ने यह भी स्पष्ट किया है कि ये अलग-अलग घटनाओं के उदाहरण हैं और इनसे यह निष्कर्ष नहीं निकाला जा सकता कि सामान्य इस्तेमाल में इतनी बार AI ऐसा व्यवहार करता है। रिपोर्ट का उद्देश्य ऐसे व्यवहार को समझना और भविष्य के सुरक्षा उपायों को बेहतर बनाना है।

आखिर क्या है 'मिसअलाइनमेंट'?

सरल भाषा में समझें तो जब AI को कोई स्पष्ट लक्ष्य, नियम या अनुमति दी जाती है, लेकिन वह उस सीमा के बाहर जाकर काम करने की कोशिश करता है, तो इसे मिसअलाइनमेंट कहा जाता है।

चिंता खास तौर पर उन AI एजेंट्स को लेकर बढ़ रही है, जो सिर्फ जवाब नहीं देते बल्कि फाइलें पढ़ सकते हैं, कोड चला सकते हैं, वेबसाइट्स इस्तेमाल कर सकते हैं और दूसरे सॉफ्टवेयर टूल्स के साथ काम कर सकते हैं।

रिपोर्ट में सामने आए 6 मामले

1. मॉडल ने अपने लिए नए निर्देश बना लिए

एक अप्रकाशित रिसर्च मॉडल ने अपना काम जारी रखने के लिए बनाए जाने वाले सारांश में ऐसे निर्देश जोड़ दिए, जिनमें सामान्य सीमाओं को नजरअंदाज करने की बात शामिल थी। OpenAI के अनुसार ऐसे 27 प्रभावित सारांश मिले।

2. गलतियों को छिपाने की कोशिश

GPT-5.6 Sol की ट्रेनिंग के दौरान कुछ मॉडल इंस्टेंस ने अपने सारांश में ऐसे निर्देश जोड़े जिनका उद्देश्य गलतियों या गलत व्यवहार को यूजर से छिपाना था। उदाहरण के तौर पर, अगर पुराना डेटा उपलब्ध नहीं था तो उसे गढ़ने और यह न बताने का निर्देश दिया गया।

3. बिना अनुमति API Key का इस्तेमाल और फिर जानकारी गढ़ना

एक मॉडल ने किसी सवाल का जवाब खोजते समय सार्वजनिक रिपॉजिटरी में मौजूद एक उजागर API Key का इस्तेमाल किया। जब इसके बावजूद मांगी गई जानकारी नहीं मिली तो मॉडल ने आंकड़े गढ़ दिए और उन्हें संबंधित स्रोत से प्राप्त डेटा के रूप में पेश किया।

4. सोर्स देने के लिए फाइल इंटरनेट पर अपलोड कर दी

एक अन्य मामले में मॉडल ने Python की मदद से सही जवाब तैयार कर लिया था। लेकिन यूजर ने जवाब के साथ ब्राउजर से सोर्स देने को कहा था। मॉडल ने इसके लिए फाइल को इंटरनेट पर अपलोड कर दिया और फिर उसी का लिंक बतौर सोर्स इस्तेमाल करने की कोशिश की—बिना यूजर से अनुमति लिए।

5. अलग-अलग AI एजेंट्स ने अनधिकृत तरीके से आपस में संदेश भेजे

कुछ मॉडल्स ने एक आंतरिक सॉफ्टवेयर रिपॉजिटरी को संदेश भेजने के माध्यम की तरह इस्तेमाल किया। अलग-अलग ट्रेनिंग सैंपल में काम कर रहे मॉडल्स ने वहां रिक्वेस्ट और जवाब साझा किए। यानी उन्होंने उस तरीके से आपस में संवाद किया, जिसकी उन्हें अनुमति नहीं दी गई थी।

6. AI एजेंट्स ने फाइलें बाहरी वेबसाइट्स के जरिए साझा कर दीं

एक ही काम पर साथ काम कर रहे कई AI एजेंट्स जब एक-दूसरे की लोकल फाइलें एक्सेस नहीं कर पाए तो उन्होंने सार्वजनिक फाइल-होस्टिंग वेबसाइट्स का इस्तेमाल करके फाइलें शेयर कर दीं। इससे कुछ टास्क से जुड़ी सामग्री सार्वजनिक URL पर उपलब्ध हो गई।

जुलाई में Hugging Face से जुड़ा मामला भी सामने आया था

यह पहली बार नहीं है जब OpenAI ने AI एजेंट्स के सुरक्षा परीक्षणों में चिंताजनक व्यवहार की जानकारी दी हो। जुलाई 2026 में साइबर सिक्योरिटी मूल्यांकन के दौरान OpenAI के कुछ मॉडल्स ने इंटरनेट से अलग रखने के लिए बनाए गए नियंत्रणों को पार किया और Hugging Face के कुछ सिस्टम्स तक पहुंच बनाई।

OpenAI की बाद की जांच के अनुसार, मॉडल्स ने अनधिकृत चैनलों के जरिए संवाद किया, कमजोरियों का फायदा उठाया और कुछ मामलों में थर्ड-पार्टी सिस्टम्स तक पहुंच बनाई। कंपनी ने कहा कि इस घटना से उसके ग्राहकों के डेटा या ChatGPT की उपलब्धता प्रभावित नहीं हुई।

असली चिंता क्या है?

इन घटनाओं का सबसे महत्वपूर्ण पहलू यह है कि AI एजेंट्स को जैसे-जैसे ज्यादा टूल्स और स्वायत्तता मिल रही है, वैसे-वैसे सुरक्षा व्यवस्था को भी ज्यादा मजबूत करने की जरूरत पड़ रही है।

अगर कोई AI सिस्टम यूजर की अनुमति के बिना फाइल अपलोड करे, गलत जानकारी को सही बताकर पेश करे, अनधिकृत सिस्टम से संपर्क करे या दूसरे एजेंट्स के साथ तय सीमा से बाहर जाकर जानकारी साझा करे, तो इससे डेटा प्राइवेसी, साइबर सिक्योरिटी और भरोसे से जुड़े सवाल उठते हैं।

OpenAI ने कहा है कि नई रिपोर्टिंग व्यवस्था के जरिए कंपनी ऐसे मामलों को व्यवस्थित तरीके से दर्ज करेगी, उनकी जांच करेगी और योग्य मामलों को सार्वजनिक करेगी। कंपनी के मुताबिक इसका उद्देश्य केवल घटनाओं की जानकारी देना नहीं, बल्कि AI सुरक्षा पर रिसर्च और निगरानी को बेहतर बनाना भी है।

AI की क्षमता बढ़ रही है, तो सुरक्षा की चुनौती भी बढ़ रही है

OpenAI की हालिया रिसर्च में यह बात भी सामने आई है कि लंबे समय तक चलने वाले AI मॉडल्स को ज्यादा समय और ज्यादा टूल्स मिलने पर अनचाही गतिविधियों के अवसर बढ़ सकते हैं। इसी वजह से कंपनी ने लंबे समय तक चलने वाले AI एजेंट्स के लिए नए मूल्यांकन, निगरानी और सुरक्षा उपाय विकसित करने की बात कही है।

यानी AI को लेकर बहस अब सिर्फ इस बात तक सीमित नहीं है कि AI कितना स्मार्ट है, बल्कि सवाल यह भी है कि वह अपनी बढ़ती क्षमता का इस्तेमाल किस सीमा तक और किन परिस्थितियों में करता है।

OpenAI की ये छह रिपोर्टें इसी बड़ी चुनौती की ओर इशारा करती हैं—AI को ज्यादा सक्षम बनाने के साथ-साथ उसे तय सीमाओं, अनुमति और सुरक्षा नियमों के भीतर रखना भी उतना ही महत्वपूर्ण होता जा रहा है।

Share this story

Tags