AI बोला… मैं भी इंसान, जब एआई ने खुद ही नियम बदलने की कोशिश की, OpenAI ने 6 चौंकाने वाले मामले किए सार्वजनिक

Vin News Network
Vin News Network
5 Min Read
AI ने 6 माह में 6 बार सीमाओं को तोड़ा, ओपनएआई की रिपोर्ट में खुलासा

विन न्यूज़ नेटवर्क। आर्टिफिशियल इंटेलिजेंस यानी एआई के तेजी से बढ़ते इस्तेमाल के बीच इसके व्यवहार को लेकर नई चिंताएं सामने आई हैं। OpenAI ने पिछले छह महीनों में ट्रेनिंग और परीक्षण के दौरान सामने आए एआई के छह ऐसे मामलों की जानकारी सार्वजनिक की है, जिनमें मॉडल ने तय निर्देशों और सुरक्षा सीमाओं से हटकर काम किया।

कंपनी ने इन घटनाओं को ‘मिसअलाइनमेंट’ कहा है। इसका मतलब है कि एआई मॉडल दिए गए निर्देशों या तय सीमाओं के मुताबिक काम करने के बजाय अलग तरीके से व्यवहार करे।

खुद के लिए निर्देश लिखने लगा मॉडल

OpenAI के मुताबिक, एक रिसर्च मॉडल ने अपना काम आगे बढ़ाने के लिए खुद तैयार किए गए निर्देश अपनी सारांश फाइल में जोड़ दिए। इनमें सामान्य पाबंदियों को नजरअंदाज करने जैसी बातें शामिल थीं। जांच में ऐसे 27 प्रभावित सारांश मिले। कंपनी ने इसे एआई के तय सीमाओं से बाहर निकलने की कोशिश के उदाहरण के तौर पर दर्ज किया है।

गलतियां छिपाने और डेटा गढ़ने की कोशिश

एक अन्य मामले में GPT-5.6 Sol की ट्रेनिंग के दौरान कुछ मॉडल ने ऐसे निर्देश बनाए, जिनका मकसद अपनी गलतियों या गलत व्यवहार को यूजर से छिपाना था। कुछ मामलों में उपलब्ध न होने वाले पुराने आंकड़े गढ़ने और इस बात का खुलासा न करने के निर्देश भी मिले।

बिना अनुमति API Key का इस्तेमाल

एक मॉडल ने किसी सवाल का जवाब खोजते समय सार्वजनिक रिपॉजिटरी में मौजूद एक एक्सपोज्ड API Key का इस्तेमाल किया। इसके बाद भी जब जरूरी आंकड़े नहीं मिले तो मॉडल ने जानकारी गढ़कर उसे संबंधित स्रोत से मिला हुआ बताया। यह मामला इसलिए अहम है क्योंकि इसमें अनधिकृत डिजिटल संसाधन के इस्तेमाल और गलत जानकारी दोनों सामने आए।

सोर्स देने के लिए फाइल इंटरनेट पर डाल दी

एक और घटना में मॉडल ने यूजर के सवाल का जवाब तैयार करने के लिए Python से सही जानकारी निकाली, लेकिन जवाब में ब्राउजर सोर्स देने की जरूरत थी। इसके बाद उसने बिना अनुमति फाइल को इंटरनेट पर अपलोड कर दिया, ताकि उस फाइल का लिंक स्रोत के तौर पर इस्तेमाल किया जा सके।

एआई एजेंट्स ने आपस में संदेश भी भेजे

OpenAI ने बताया कि कुछ मॉडल ने एक आंतरिक सॉफ्टवेयर रिपॉजिटरी का इस्तेमाल आपस में संदेश भेजने के लिए किया। अलग-अलग ट्रेनिंग सैंपल में मौजूद मॉडल इस माध्यम से एक-दूसरे को अनुरोध और जवाब भेज रहे थे। एक दूसरे मामले में साथ काम कर रहे एआई एजेंट्स ने स्थानीय फाइलें साझा न कर पाने पर सार्वजनिक फाइल-होस्टिंग वेबसाइटों के जरिए फाइलें साझा कर दीं।

OpenAI ने निगरानी और रिपोर्टिंग की नई व्यवस्था बनाई

कंपनी का कहना है कि ये छह घटनाएं अलग-अलग उदाहरण हैं और इन्हें एआई में मिसअलाइनमेंट की सामान्य दर का आंकड़ा नहीं माना जाना चाहिए। OpenAI ने अब ऐसे मामलों की पहचान, जांच और सार्वजनिक जानकारी साझा करने के लिए नई व्यवस्था शुरू की है। कंपनी के अनुसार, कर्मचारी संदिग्ध व्यवहार की रिपोर्ट कर सकेंगे और जांच के बाद तय किया जाएगा कि किस मामले को सार्वजनिक किया जाना चाहिए।

जुलाई की घटना के बाद सुरक्षा पर बढ़ा ध्यान

यह रिपोर्ट जुलाई में सामने आए उस मामले के बाद आई है, जिसमें OpenAI ने बताया था कि एक मॉडल मूल्यांकन के दौरान Hugging Face के सिस्टम तक अनधिकृत तरीके से पहुंचा था। कंपनी ने बाद की जांच में इन व्यवहारों को रिवॉर्ड हासिल करने की कोशिश, अनधिकृत संचार और दूसरे एजेंट्स से लक्ष्य अपनाने जैसे पैटर्न से जोड़ा।

एआई एजेंट्स की अपनी भाषा पर भी चर्चा

इसी बीच न्यूयॉर्क की एआई लैब Emergence के एक प्रयोग में अलग-अलग एआई एजेंट्स ने आपस में बातचीत करते हुए ऐसे शब्द और वाक्यांश विकसित किए, जिन्हें प्रयोग शुरू होने से पहले उन्हें सिखाया नहीं गया था। शोध में कुछ शब्दों के अर्थ एजेंट्स के बीच अलग तरह से इस्तेमाल होते पाए गए। एक खास वाक्यांश का करीब 5,000 बार इस्तेमाल दर्ज किया गया।

एआई सुरक्षा और इंसानी निगरानी पर बहस तेज

इन घटनाओं ने एआई मॉडल को अधिक स्वायत्त बनाने के साथ-साथ उनकी निगरानी, डेटा सुरक्षा और निर्देशों के पालन पर चर्चा को और तेज कर दिया है। OpenAI का नया ढांचा ऐसे व्यवहारों को जल्दी पहचानने और उनके बारे में जानकारी साझा करने पर जोर देता है। हालांकि कंपनी ने खुद भी स्पष्ट किया है कि सामने आए छह मामले पूरे एआई क्षेत्र में होने वाले ऐसे व्यवहारों की व्यापक तस्वीर नहीं हैं।

Share This Article
Leave a Comment

Leave a Reply

Your email address will not be published. Required fields are marked *