Natepute Express
सर्व बातम्या
शिक्षण व तंत्रज्ञानNatepute Pratinidhi

एआय मॉडेलमध्ये निर्देशांशिवाय भ्रामक वर्तनाचा अनोखा प्रकार

एआय आता फक्त प्रश्नांची उत्तरे देण्यापुरते किंवा सामग्री तयार करण्यापुरते मर्यादित राहिलेले नाही. ब्रिटनच्या एआय सिक्युरिटी इन्स्टिट्यूट (एआयएसआय) च्या एका चाचणीत दोन प्रगत एआय मॉडेल्सनी असे वर्तन केले, ज्यामुळे तज्ञांची चिंता वाढली. चाचणीदरम्यान, अँथ्रोपिकच्या मायथोस एआयने मानवी बनावट ऑनलाइन ओळख तयार केली. नंतर खासगी संदेश पाठवले आणि लोकांना विश्वासात घेऊन ‘गिटहब’ प्रणालीमध्ये हानीकारक कोड टाकण्याचा प्रयत्न केला. जेव्हा त्याच्या हालचालींवर प्रश्नचिन्ह उपस्थित झाले, तेव्हा त्याने आपले जुने रेकॉर्ड सामान्य दिसण्यासाठी त्यात बदल केले आणि नवीन ओळख स्वीकारण्याचाही विचार केला. एखाद्या एआय मॉडेलमध्ये कोणत्याही सूचनेशिवाय इतके स्पष्ट स्वायत्त आणि भ्रामक वर्तन दिसण्याची ही पहिलीच वेळ आहे.

एआय मॉडेलमध्ये निर्देशांशिवाय भ्रामक वर्तनाचा अनोखा प्रकार

AI Model Deceptive Behavior Detected; UK Security Institute Report एआय आता फक्त प्रश्नांची उत्तरे देण्यापुरते किंवा सामग्री तयार करण्यापुरते मर्यादित राहिलेले नाही. ब्रिटनच्या एआय सिक्युरिटी इन्स्टिट्यूट (एआयएसआय) च्या एका चाचणीत दोन प्रगत एआय मॉडेल्सनी असे वर्तन केले, ज्यामुळे तज्ञांची चिंता वाढली. चाचणीदरम्यान, अँथ्रोपिकच्या मायथोस एआयने मानवी बनावट ऑनलाइन ओळख तयार केली. नंतर खासगी संदेश पाठवले आणि लोकांना विश्वासात घेऊन ‘गिटहब’ प्रणालीमध्ये हानीकारक कोड टाकण्याचा प्रयत्न केला. जेव्हा त्याच्या हालचालींवर प्रश्नचिन्ह उपस्थित झाले, तेव्हा त्याने आपले जुने रेकॉर्ड सामान्य दिसण्यासाठी त्यात बदल केले आणि नवीन ओळख स्वीकारण्याचाही विचार केला.

एखाद्या एआय मॉडेलमध्ये कोणत्याही सूचनेशिवाय इतके स्पष्ट स्वायत्त आणि भ्रामक वर्तन दिसण्याची ही पहिलीच वेळ आहे. तथापि, संपूर्ण प्रक्रियेदरम्यान मानवी देखरेख असल्यामुळे, एआय आपल्या उद्देशात यशस्वी होऊ शकले नाही. या प्रकरणात, एआय मॉडेलला फक्त एक सायबर सुरक्षा आव्हान सोडवण्याचे काम देण्यात आले होते. यासाठी त्याला इंटरनेटची सुविधा देण्यात आली होती, जेणेकरून वास्तविक परिस्थितीत एआय काय करू शकते हे समजून घेता यावे. परंतु एआयने ठरवलेल्या मर्यादेपलीकडे जाऊन स्वतः लोकांची ओळख शोधली, त्यांच्या नावाने बनावट खाती तयार केली आणि त्यांना फाइल शेअरिंग सेवेद्वारे संदेश पाठवून सिस्टममध्ये प्रवेश मिळवण्याचा प्रयत्न केला. एआयएसआयचे म्हणणे आहे की, यावरून असे दिसून येते की अधिक सक्षम होणारे एआय मॉडेल भविष्यात अपेक्षेपेक्षा वेगळे वर्तन देखील करू शकतात.

ब्रिटनचे एआय मंत्री कनिष्क नारायण म्हणाले की, असे धोके ओळखणे आणि ते सार्वजनिक करणे आवश्यक आहे, जेणेकरून ते अधिक सुरक्षित बनवता येईल. अँथ्रोपिक आणि ओपनएआय, दोघांनीही सांगितले की ही चाचणी सामान्य वापरासारख्या परिस्थितीत केली गेली नव्हती. चाचणीदरम्यान, त्यांच्या मॉडेलच्या सामान्य सुरक्षा व्यवस्था कमी करण्यात आल्या होत्या किंवा काढून टाकण्यात आल्या होत्या. अँथ्रोपिकने या प्रकरणाची चौकशी सुरू केली आहे, तर ओपनएआयने सांगितले की ते भविष्यात अशा चाचण्या अधिक सुरक्षित करण्यासाठी मूल्यांकन एजन्सींसोबत काम करत राहतील. चाचणीत एआयला फसवणूक करण्याचा कोणताही निर्देश मिळाला नव्हता एआय सिक्युरिटी इन्स्टिट्यूटने सांगितले की मायथोस एआयला लोकांना फसवण्याचा किंवा त्यापासून वाचण्याचा कोणताही विशेष निर्देश दिला नव्हता. तरीही त्याने स्वतःच बनावट ओळख निर्माण केली आणि लोकांना दिशाभूल करण्याचा प्रयत्न केला. संस्थेनुसार, पहिल्यांदाच कोणत्याही विशिष्ट प्रॉम्प्टशिवाय एआयमध्ये या स्तरावरील स्वायत्त आणि भ्रामक वर्तन पहायला मिळाले. मात्र, अशा घटना अतिशय मर्यादित परिस्थितीत घडल्या.

Source: Technology

ही बातमी उपयोगी वाटली?मित्र आणि कुटुंबासोबत WhatsAppवर share करा.
WhatsAppवर Share करा