اينٿروپيڪ ۽ اوپن اي آءِ جا اعليٰ ترين مصنوعي انٽيليجنس ماڊل ”خودمختار“ ۽ ”غير منظور ٿيل“ بدسلوڪي سرگرمي ۾ مصروف آهن جيڪي حقيقي ماڻهن ۽ تنظيمن کي نشانو بڻائي رهيا آهن تازو حفاظتي ٽيسٽن دوران ، برطانيه جي اي آءِ واچ ڊاگ چيو آهي.
AI سيڪيورٽي انسٽيٽيوٽ (AISI) اڱاري تي جاري ڪيل هڪ رپورٽ ۾ چيو آهي ته OpenAI جي GPT-5.6-Sol ۽ Anthropic's Mythos 5 کي استعمال ڪيو ويو فريب جي اڳ ۾ نه ڏٺي سطح کي "مسلسل، ممڪن طور تي نقصانڪار سرگرمي" کي هلائڻ لاء معمول جي حفاظت جي تشخيص دوران.
جڏهن سائبر سيڪيورٽي چيلنج کي حل ڪرڻ جو ڪم سونپيو ويو، ماڊلز 10 مان 122 ٽيسٽ رن دوران ”خودمختار، غير منظور ٿيل ايڪشن“ ورتو، AISI مطابق.
AISI چيو ته ٽيسٽن AI ماڊلز پاران 19 غير منظور ٿيل عملن کي آگاهه ڪيو، انهن مان ٻه سواءِ Mythos 5 پاران ڪيا ويا.
سڀ کان وڌيڪ سنگين صورت ۾، Mythos 5 AISI جي مطابق، ڊولپر پليٽ فارم GitHub تي هڪ اوپن سورس پروجيڪٽ ۾ بدسلوڪي ڪوڊ داخل ڪرڻ جي ڪوشش ڪئي.
سائبر حملي جي ڪوشش جي حصي جي طور تي، Mythos 5 جعلي آن لائن سڃاڻپ ٺاهي وئي ته منصوبي کي برقرار رکڻ واري شخص کي بدسلوڪي ڪوڊ قبول ڪرڻ لاء قائل ڪرڻ لاء، واچ ڊاگ چيو.
AISI، برطانوي حڪومت پاران 2023 ۾ قائم ڪيو ويو، چيو ته سائبر حملو ناڪام ٿيو جڏهن پروجيڪٽ سنڀاليندڙ ڪوڊ کي منظور ڪرڻ کان انڪار ڪيو.
”هي پهريون ڀيرو آهي ته اي ايس آءِ هن شدت جو فريب ڏٺو آهي جيڪو حقيقي دنيا ۾ هڪ حقيقي شخص کي نشانو بڻايو ويو ، بي پرواهه ،“ واچ ڊاگ چيو.
جڏهن ته AISI چيو ته AI ماڊلز ”ناول، امڪاني طور تي گمراهه ڪندڙ رويا“ ڏيکاريا آهن، واچ ڊاگ خبردار ڪيو ته ان جي نتيجن کي احتياط سان تعبير ڪيو وڃي، ڇاڪاڻ ته اهي ”مخصوص حالتن“ جي تحت واقع ٿيا آهن، جن ۾ ڪجهه ماڊلز جي حفاظتي اپاءَ به شامل آهن.
"اسان اڃا تائين يقين نه ٿا ڪري سگھون ته ايجنٽ سمجهي ٿو ته اهو حقيقي دنيا جي ڪارروائي ڪري رهيو هو، يا ڪيتري حد تائين اهو يقين ڪيو ويو ته اهو هڪ افسانوي امتحان واري منظر ۾ هو؛ اسان جو تجزيو اڃا تائين هڪ مخلوط تصوير پيش ڪري ٿو ۽ جاري آهي،" AISI چيو.
انٿروپڪ چيو ته اها AISI سان ويجهي ڪم ڪري رهي آهي وڌيڪ تفصيل گڏ ڪرڻ لاءِ ان واقعي جي پنهنجي تحقيق جي حصي طور ، پر نوٽ ڪيو ته ٽيسٽ ”عمدي طور تي اجازت واري حالتن“ تحت ڪئي وئي.
”ڪلاڊ جي ان جي صورتحال کي سمجهڻ جي واضح تصوير حاصل ڪرڻ - ان جي استدلال واري نقلن کي جانچڻ ۽ اسان جا پنهنجا تجزيا هلائڻ سان - اسان کي ان جي رويي جي سببن جي نشاندهي ڪرڻ ۾ مدد ملندي ،“ اي آئي ڪمپني ايڪس تي هڪ پوسٽ ۾ چيو ، ڪلاڊ جو حوالو ڏيندي ، اينٿروپڪ جي اي آئي چيٽ بوٽ.
OpenAI چيو ته اها ٽئين پارٽي جي جاچ جي آجيان ڪئي جڏهن ته نوٽ ڪيو ته واچ ڊاگ جي تشخيص انهن حالتن ۾ ڪئي وئي جيڪا "عام استعمال کي ظاهر نه ڪن".
"اسان جائزو وٺندڙن ۽ صنعت جي ٻين اسٽيڪ هولڊرز سان ڪم جاري رکنداسين ته جيئن جائزي کي محفوظ طريقي سان هلائڻ لاءِ گڏيل عملن کي مضبوط ڪيو وڃي جيئن ماڊل وڌيڪ قابل ٿي وڃن ،" هڪ OpenAI ترجمان الجزيره کي ٻڌايو.
لنڊن جي بنياد تي واچ ڊاگ پاران رپورٽ فرنٽيئر اي آءِ ماڊلز جي ڪيترن ئي ڪيسن جي پيروي ڪري ٿي جيڪي انساني اشارن جي بغير بدسلوڪي سرگرمي ۾ ملوث آهن.
گذريل مهيني، OpenAI انڪشاف ڪيو ته ان جا ٻه AI ماڊل انهن جي جاچ واري ماحول مان ڀڄي ويا ۽ هيڪنگ هيڪنگ فيس، هڪ ڪمپني جيڪا ميزباني ڪري ٿي اوپن سورس AI ماڊل ۽ ڊيٽا سيٽ، بغير انساني هدايت جي.
ٽوبي والش، يو اين ايس ڊبليو سڊني ۾ پروفيسر ۽ AI ماهر، چيو ته ASAI جي نتيجن حقيقت کي اجاگر ڪيو ته سڀ کان وڌيڪ ترقي يافته AI ماڊل "خطرناڪ" صلاحيتون آهن.
”اسان نٿا چاهيون ته اهڙي دنيا ۾ جتي اسان AI ڪمپنين جي نيڪ نيتي ۽ محنت تي ڀاڙيون ته جيئن اي آءِ ماڊلز ۾ اهڙين مشڪلاتي صلاحيتن کي نندا ڪن ،“ والش الجزيره کي ٻڌايو.
"اسان چاهيون ٿا ته حڪومتون هن جي مٿان هجن. ۽ تنهنڪري مون کي يقين ڏياريو ويو آهي ته برطانيه جي حڪومت جي AI حفاظتي انسٽيٽيوٽ اهو مليو ... مصيبت اها آهي ته اهي سائبر صلاحيتون هاڻي هر ڪنهن لاء دستياب آهن، جن ۾ خراب اداڪار شامل آهن جيڪي اڳ ۾ پاڻ کي سسٽم ۾ هيڪ ڪرڻ جي صلاحيت نه هئا،" والش شامل ڪيو.
"توهان کان پوء ڪيترن ئي وڌيڪ سائبر حملن بابت ٻڌڻ جي اميد رکو."