هڪ AI ايجنٽ کي پڪڙيو ويو ته جعلي آن لائن سڃاڻپ ٺاهي محفوظ سسٽم تائين غير مجاز رسائي حاصل ڪرڻ لاءِ OpenAI ۽ Anthropic جي ماڊلز جي ٽيسٽن دوران، جنهن نئين خلاف ورزين جو هڪ سلسلو ظاهر ڪيو، برطانيه جي AI سيڪيورٽي انسٽيٽيوٽ ا Tuesdayاري تي ظاهر ڪيو.
انسٽيٽيوٽ چيو ته ايجنٽ اينٿروپڪ جي Mythos 5 ۽ OpenAI جي GPT-5.6-Sol پاران طاقتور حفاظتي جائزي دوران غير مجاز ڪارناما ۾ مصروف آهن سرڪاري تنظيم ماڊل جي صلاحيتن جو جائزو وٺڻ لاء.
”ڪجهه ايجنٽ جيڪي آزمايا پيا وڃن انهن ۾ لڳاتار مصروف هئا، ممڪن طور تي نقصانڪار سرگرميون حقيقي ماڻهن ۽ تنظيمن تي هدايتون ڏنيون ويون آهن،“ AISI هڪ بلاگ پوسٽ ۾ چيو.
رپورٽ ٽيسٽنگ ايجنٽن جي عمل جي چوڌاري حفاظت جي لڪل حالت کي واضح ڪري ٿي، جيڪي AI ڪمپنيون هڪ ئي وقت ڪاروبار جي مستقبل جي طور تي مارڪيٽنگ ڪري رهيون آهن.
AISI، جيڪا وڏي ليبز مان رضاڪارانه معاهدن جي تحت ترقي يافته AI ماڊلز تائين رسائي حاصل ڪري ٿي، انهن جي صلاحيتن کي جانچڻ لاءِ ايجنٽن کي افسانوي سائبر سيڪيورٽي منظرنامي ذريعي رکيو.
اهو 122 ڀيرا چيلنج ڪيو ۽ 19 غير منظور ٿيل عملن جي نشاندهي ڪئي مجموعي طور تي 10 ٽيسٽ رن. اينٿروپڪ جو ايجنٽ 17 عملن جي پويان هو، ۽ OpenAI جو ايجنٽ باقي ٻه.
AISI چيو ته سڀ کان وڌيڪ خطرناڪ عمل هڪ ايجنٽ کي خراب ڪوڊ لکڻ ۽ جعلي آن لائن سڃاڻپ ٺاهڻ جي ڪوشش ۾ هڪ انسان کي ڪوڊ جي منظوري ڏيڻ جي ڪوشش ۾ شامل ڪيو ويو، وڌيڪ چيو ته ڪنهن به خلاف ورزي جي نتيجي ۾ حقيقي دنيا جو ڪو به نقصان نه مليو.
جڏهن ته AISI اهو نه ٻڌايو ته جعلي سڃاڻپ جي پويان ڪهڙو ايجنٽ هو، انٿروپڪ تصديق ڪئي ته ان جو ايجنٽ ذميوار هو.
"اسان شڪرگذار آهيون UK AISI جي هن واقعي تي انهن جي قيادت لاءِ ، جيڪا هڪ وسيع گفتگو جي ضرورت تي زور ڏئي ٿي ته ڪيئن محفوظ طور تي وڌندڙ قابل AI ايجنٽن جو جائزو ورتو وڃي ،" Anthropic هڪ بيان ۾ چيو.
اهو پڻ چيو ته اهو AISI سان ڪم ڪري رهيو آهي واقعي بابت وڌيڪ تفصيل حاصل ڪرڻ ۽ ان جي پنهنجي تحقيقات کي هلائڻ لاء.
اينڊريو يوون، ڪيليفورنيا جي هڪ غير منافع بخش اداري CivAI جو هڪ محقق جيڪو AI صلاحيتن ۽ خطرن جي جاچ ڪري ٿو، چيو: ”اها حقيقت آهي ته Mythos اهڙن گمراهه ڪندڙ عملن ۾ مصروف آهي، ظاهري شعور سان ته اهو هڪ حقيقي ماڻهوءَ کي نشانو بڻائي رهيو آهي، اهو ظاهر ڪري ٿو ته انٿروپڪ وٽ سندن ماڊلز تي ايترو سٺو هٿ نه آهي جيترو هو سوچين ٿا.
OpenAI هڪ ڪمپني جي بلاگ پوسٽ ۾ تفصيلات شيئر ڪيو، ياد رهي ته ان جي ٻنهي ايجنٽن جي غير منظور ٿيل عملن ۾ انٽرنيٽ تائين رسائي انهن طريقن سان شامل آهي جيڪي فوري طور تي منع ٿيل هئا.
"اسان سڄي صنعت ۾ ڪم ڪرڻ لاءِ پرعزم آهيون ته جيئن اعليٰ خطري جي جائزي کي محفوظ طريقي سان انجام ڏيڻ لاءِ گڏيل عملن کي مضبوط ڪيو وڃي، جنهن ۾ اسٽيڪ هولڊرز کي گڏ ڪرڻ جهڙوڪ قومي AI ادارن، آزاد تشخيص ڪندڙ، ٻين AI ليبز، ۽ ايندڙ هفتن ۾ ٻيا گروپ شامل آهن،" OpenAI چيو.
OpenAI پنهنجي بلاگ پوسٽ ۾ هڪ الڳ واقعو پڻ ظاهر ڪيو جنهن ۾ غير منظم، ٽئين پارٽي جي جاچ فراهم ڪندڙ طرفان غلط ترتيب، ان جي ايجنٽ کي غلطي سان انٽرنيٽ سان ڳنڍڻ جي اجازت ڏني وئي. اهو غلط ترتيب جي باري ۾ هڪ ساڳئي ظاهر ظاهر ڪيو جيڪو اينٿروپڪ گذريل هفتي ڪيو.
گذريل هفتي، OpenAI ٻين ايجنٽ جي ڀڃڪڙي جا ثبوت ڳولڻ کان پوء ان جي هيڪنگ جي تحقيقات کي وڌايو هو.
هڪ OpenAI ايجنٽ طرفان AI فرم Hugging Face جي جولاءِ جي سيڪيورٽي خلاف ورزي جي برعڪس، AISI جي تشخيص ۾ ايجنٽ انٽرنيٽ تائين پهچڻ لاءِ الڳ ٿيل جاچ واري ماحول کان بچي نه سگهيا. بلڪه، ايجنسي ان جي معياري جانچ جي طريقيڪار جي مطابق انٽرنيٽ جي رسائي جي اجازت ڏني هئي، AISI چيو.