گذريل ڪجھ مھينن ۾، AI ايجنٽ جيڪي سائبر سيڪيورٽي جي تشخيص کان گذري رھيا آھن، انھن جي حدن کان ڀڄي ويا آھن، انٽرنيٽ تائين رسائي، ۽، ڪجھ ڪيسن ۾، حقيقي دنيا جي سسٽم ۾ ھيڪ. واقعن ۾ OpenAI، Anthropic، Meta، ۽ سڀ کان تازو، چيني AI ليب Moonshot AI جا ماڊل شامل آهن، جن ۾ ڪيترن ئي مختلف تنظيمن پاران ڪيل ٽيسٽنگ سميت سائبر ايويوليشن اسٽارٽ اپ جنهن کي Irregular سڏيو ويندو آهي.
قسطون AI صنعت لاءِ وڌندڙ مسئلو کي بي نقاب ڪن ٿيون: جيئن خودمختيار ايجنٽ وڌيڪ قابل ٿي وڃن ٿا ، ماحول کي محفوظ طور تي جانچڻ لاءِ تيار ڪيو ويو آهي انهن جي حدن کي انهن تي مشتمل ڪرڻ ۾ ناڪام ٿي رهيا آهن.
”انهن واقعن جو تعداد جيڪو ٿي چڪو آهي اهو واضح ڪري ٿو ته سينڊ باڪسنگ ۽ ٽيسٽنگ ماحوليات جا ڪنٽرول حقيقت ۾ ماڊلز جي قابليت سان مطابقت نٿا رکن ،“ سين او هيگريٽائيگ، ڊائريڪٽر AI: سينٽر فار دي فيوچرز اينڊ ريسپونسيبليٽي پروگرام ۾ سينٽر فار دي فيوچر آف انٽيليجنس يونيورسٽي آف ڪيمبرج، ٽيڪ ڪرنچ کي ٻڌايو.
آزمائشي نموني جي فطرت خطري ۾ اضافو ڪري ٿي. AI ڪمپنيون اڻ ڇپيل، ايندڙ-جين ماڊلز تي سائبر تشخيص جي جانچ ڪن ٿيون، اڪثر عام حفاظت سان جيڪي بدسلوڪي رويي کي بند ڪن ٿيون، ان ڪري محقق ڏسي سگهن ٿا ته ماڊل واقعي جي قابل آهن. ان جو مطلب اهو آهي ته جاچ واري ماحول جي حفاظت پاڻ دفاع جي هڪ اهم لائن آهي.
”اها جانچ جي لحاظ کان تمام سٺي شيءِ آهي ، پر ان جو مطلب اهو پڻ آهي ته جيڪڏهن اهي جهنگ ۾ نڪرڻ جو انتظام ڪن ، اهي ڪافي نقصان پهچائي سگهن ٿا ،“ Ó هيگيارٽيگ چيو.
سڀ کان وڌيڪ سنگين ڪيسن ۾، هڪ اڻ ڇپيل OpenAI ماڊل پنهنجي سينڊ باڪس مان ڀڃي ڇڏيو ۽ هنگنگ منهن جي پيداوار سسٽم ۾ هيڪ ڪيو ويو. غير منظم، اينٿروپڪ ۽ ميٽا ماڊل پاران ڪيل الڳ الڳ تشخيص ۾، غلط ترتيب ڏيڻ کان پوء انهن جي امتحان واري ماحول کان ٻاهر سسٽم تائين پهچي ويا، انهن کي انٽرنيٽ ڏانهن رستا ڏني. Moonshot AI جي Kimi K3 انٽرنيٽ تائين رسائي حاصل ڪرڻ ۽ GitHub تي معلومات تائين رسائي حاصل ڪرڻ لاءِ فرنٽيئر سيڪيورٽي پاران هلندڙ پنهنجي سينڊ باڪس ۾ هڪ ليک جو فائدو پڻ ورتو.
برطانيه جي AI سيڪيورٽي انسٽيٽيوٽ (AISI) جي جاچ ۾، محقق اصل ۾ ايجنٽن کي انٽرنيٽ جي رسائي ڏني، اهو نه سمجهڻ ته اهي غير منظور ٿيل حقيقي دنيا جي عملن کي کڻندا، بشمول هڪ سوشل انجنيئرنگ ڪوشش هڪ اوپن سورس پروجيڪٽ ۾ خطري کي ڇڪڻ جي ڪوشش.
هر صورت ۾، ايجنٽن کي بي ترتيب حقيقي دنيا جي هدفن تي حملو ڪرڻ جي هدايت نه ڪئي وئي. اهي صرف اهو ڪري رهيا هئا ته اهو انهن کي پيش ڪيل مسئلي کي حل ڪرڻ لاء ورتو ويو.
گڏ ڪيو ويو، اينڊريو يوون، AI غير منافع بخش CivAI ۾ تحقيق جو سربراهه، دليل ڏئي ٿو ته واقعن کي هڪ شفٽ ڏانهن اشارو ڪيو ويو آهي.
"ماضي ۾، اسان کي صرف پريشان ٿيڻو پوندو هو AI ماڊل ماڻهن طرفان مختلف مقصدن لاءِ غلط استعمال ڪيو پيو وڃي، جهڙوڪ AI اسڪيمن يا CSAM لاءِ،" يوون ٻڌايو TechCrunch. "هاڻي اسان ان صورتحال ۾ آهيون جتي AI ماڊل خطرو اداڪار آهن سڀ پنهنجو پاڻ تي."
ڪيترن ئي محققن ۽ سائبر سيڪيورٽي جي ماهرن TechCrunch کي ٻڌايو ته AI تشخيصي ماحول کي مضبوط، حفاظتي-گهرا تحفظ جي ضرورت آهي، ڪنٽرول جي سطح ۽ ڪنٽرول جي سطح سان گڏ جيڪي تعیناتي ۾ استعمال ڪيا ويا آهن. ان جو مطلب سيڪيورٽي جي ڪيترن ئي تہن تي آهي ته جيئن هڪ واحد غلط ترتيب - جهڙوڪ اڻڄاڻ طور تي انٽرنيٽ جي رسائي کي کليل ڇڏڻ - فرار ٿيڻ جي اڳواڻي نه ٿي سگهي.
”جيڪڏهن توهان اهي ماڊل ٺاهڻ وارا آهيو…توهان اهو ڪرڻ چاهيو ٿا هڪ ايئر گپڊ نيٽ ورڪ تي،“ اسٽيلا بيڊرمين، اي سي حفاظتي تحقيق جي غير منافع بخش تنظيم EleutherAI جي ايگزيڪيوٽو ڊائريڪٽر. "توهان کي تمام سنجيده اڪيلائي ڪرڻ چاهيو ٿا."
هيدر سيلان، باڪس جي چيف انفارميشن سيڪيورٽي آفيسر، چيو ته ان جو مطلب آهي نيٽ ورڪ رستن کي ختم ڪرڻ سينڊ باڪس کان انٽرنيٽ تائين، انهي سان گڏ ٻين حساس سسٽم ڏانهن.
”توهان کي اهو سمجهڻو پوندو ته سڀ نڪرندڙ نقطا ڇا آهن،“ سيلان TechCrunch کي ٻڌايو. "جيڪڏهن اسان اسان جي اسٽيجنگ ماحول يا اسان جي ترقي واري ماحول ۾ هڪ نموني جو جائزو وٺندا آهيون، توهان چاهيو ٿا ته اسان جي پيداوار واري ماحول ڏانهن ڪو به رستو نه آهي."
سيلان چيو ته مناسب حفاظتي جائزو ماحول جي ڪنٽرول ۽ ڪنٽرول کان ٻاهر آهن. هڪ دفعو اهي ٽيسٽ جاري آهن انهن جي بهتر نگراني جي ضرورت آهي.
”منهنجو خيال آهي ته انهن ڪيترن ئي ڪيسن ۾ دلچسپ ڳالهه اها آهي ته ڪنهن به ان کي پڪڙيو جڏهن اهو ٿيو ،“ سيلينڊ چيو. "OpenAI کي Hugging Face جي ڪري معلوم ٿيو. انٿروپڪ ان کي پڪڙي نه سگهيو جيستائين اهي واپس ويا ۽ نه ڏسندا. ميٽا هڪجهڙائي هئي .... مون کي پڪ آهي ته اتي سگنل هئا جيڪي اهي ڳولي سگهيا هوندا."
انٿروپڪ جي ٽن واقعن جي پوسٽ مارٽم ۾، ڪمپني تسليم ڪيو ته اهو ۽ غير منظم ٻنهي مانيٽرنگ ۾ بهتر ڪم ڪري سگهيا آهن، ۽ ڪجهه ڪيسن ۾ واضح نشانيون هيون ته ڪجهه غلط هو.
ماهرن کي پڻ سڏيو ويو آهي آزاد، ٽئين پارٽي جي آڊٽ جي تشخيص ماحول جي ان کان اڳ جو ماڊل انهن ۾ ڦهليل آهن. "جيڪڏهن، چئو، غير منظم ڪيو ويو هو يا هڪ خارجي آڊيٽر کي ڀرتي ڪرڻ تي مجبور ڪيو ويو هو ته انهن جي سسٽم جي ترتيبن کي جانچڻ لاء انهن تي تشخيص هلائڻ کان پهريان، انهن کي يقيني طور تي هتي ئي مسئلو پڪڙي ها،" يوون چيو. ”جيتوڻيڪ جيڪڏهن ماڻهن وٽ وقت کان اڳ گڏجاڻي هجي ها ته صرف چيڪ لسٽ مان وڃڻ لاءِ ، اهي پڪڙي وٺن ها… حقيقت اها آهي ته انهن اهو نه ڏيکاريو ته اتي ڪجهه تمام سخت ڪنڊ ڪٽڻ ٿي رهيو آهي.
تفصيلن کان واقف هڪ ذريعو TechCrunch کي ٻڌايو ته غيرقانوني ماحول جو مسلسل جائزو ورتو ويو ۽ جانچيو وڃي ٿو، بشمول ڪيترن ئي خارجي پارٽين سان صلاح مشوري ۾. ذريعن اهو پڻ چيو ته مانيٽرنگ پنهنجي جاءِ تي هئي، پر اها نگراني پاڻ تي ڪافي ناهي.
يون ۽ ٻين محققن صنعت تي زور ڏنو ته فرنٽيئر ماڊل حفاظت جي جائزي لاءِ معياري طريقي سان اچي.
"خاص طور تي جڏهن گارڊ بند ٿي ويا آهن، توهان کي اهو علاج ڪرڻو پوندو ته توهان ان ماحول جي اندر دنيا ۾ سڀ کان وڌيڪ قابل هيڪر وجهي رهيا آهيو،" سيلان چيو.
مسئلو اهو ناهي ته ڪمپنيون نه ٿيون ڄاڻن ته وڌيڪ محفوظ ٽيسٽنگ ماحول ڪيئن ٺاهيو وڃي، يون ۽ بيڊرمين ٻنهي جو دليل آهي. اهو اهو آهي ته ائين ڪرڻ مهانگو ۽ بوجھل ٿي سگهي ٿو، ۽ ڪمپنين کي اهي سيڙپڪاري ڪرڻ لاءِ ٿورو ترغيب آهي جيستائين ڪجهه غلط نه ٿئي.
”منهنجو خيال آهي ته ڪمپنيون وسيلن کي وڌائڻ لاءِ تيار نه آهن جيڪي [ڪافي محافظن] کي پورو ڪرڻ لاءِ گهربل آهن ۽ شايد نه جيستائين اهي مجبور نه ٿين ،“ بيڊرمين چيو.
پر هٿ ۾ هڪ ٻيو مسئلو آهي. جيڪڏهن اهي ٽيسٽ دوران هڪ ماڊل کي تمام تنگ ڪري ڇڏيندا آهن، محقق شايد ماڊل کي ڇڏڻ کان اڳ صلاحيتون ڳولڻ ۾ ناڪام ٿي وڃن. اهو صرف ايترو ئي خطرناڪ آهي، ممڪن آهي ته ان کان وڌيڪ، ان کي تمام گهڻي آزادي ڏيڻ کان، ۽ پوءِ تشخيص پاڻ ئي مسئلو بڻجڻ جو خطرو آهي.
ٽرمپ انتظاميه هن وقت هڪ رضاڪارانه اڳڀرائي واري سائبر سيڪيورٽي تشخيصي نظام جو وزن ڪري رهي آهي، جنهن تحت حڪومت کي نئين، طاقتور ماڊلز جي سيڪيورٽي خطرن جو جائزو وٺڻ لاءِ 30 ڏينهن اڳ اهي عوامي طور تي جاري ڪيا ويندا. پاليسي - ٽرمپ جي ايگزيڪيوٽو آرڊر جي پيداوار جنهن کي بند دروازن جي پويان حتمي ڪيو ويو آهي - حفاظتي تشخيص جي واقعن کي خطاب نه ڪندي ڇاڪاڻ ته اهي تعیناتي جي اڳتي وڌڻ وارا آهن.
”جيڪو سبق اسان گذريل ڪجهه مهينن ۾ سکي رهيا آهيون اهو آهي ته خود ريگيوليٽري اپريٽس هاڻي ڪافي نه آهي ،“ يوون چيو. "اتي مقابلي وارا دٻاء آهن جيڪي حفاظتي معيارن تي هڪ نسل کي ترغيب ڏئي رهيا آهن، ۽ اهو ريگيوليٽري مداخلت لاءِ هڪ بهترين جڳهه آهي."
”جيڪو اسان کي ان کي ڍڪڻ جي ضرورت پوندي ته ليبز اندر ڇا ٿي رهيو آهي ان تي ڪجهه قسم جا ڪنٽرول آهن جڏهن ته ماڊل تيار ڪيا پيا وڃن ، ٻئي ٽريننگ اسٽيج تي ۽ ٽيسٽنگ اسٽيج تي ،“ هن جاري رکيو.
چئلينج صرف وڌڻ جو امڪان آهي جيئن ماڊل ڪندا آهن. Irregular جي تشخيص سان واقف هڪ ذريعو TechCrunch کي ٻڌايو ته وڌيڪ قابل ماڊل وڌيڪ پيچيده تشخيص جي ضرورت هونديون آهن، اڪثر ڪري جلدي ۽ وڏي پيماني تي، جيڪو وڌيڪ غلطين لاء دروازو کوليندو آهي.
AISI، جيڪو ارادي طور تي ڪجهه ماڊلن کي انٽرنيٽ جي رسائي ڏئي ٿو، TechCrunch کي ٻڌايو ته اهو حقيقي جانچ جي وچ ۾ توازن جو جائزو وٺي رهيو آهي ۽ انهن خطرن کي منظم ڪرڻ جو انتظام ڪري ٿو جيڪي اهي ٽيسٽ ٺاهي رهيا آهن.
OpenAI چيو ته اهو جائزو وٺي رهيو آهي ته اها ٽئين پارٽي جي جاچ ڪيئن ڪري ٿي، انهي سان گڏ اڪيلائي، نگراني، ۽ جڏهن تشخيص کي روڪيو وڃي. ميٽا چيو ته اهو اڃا تائين واقعي جي تحقيقات ڪري رهيو آهي ۽ هڪ ڀيرو ٻيهر شايع ڪرڻ جو منصوبو آهي جڏهن اهو سڀ حقيقتون آهن.
آخر ۾، خطري کي مڪمل طور تي ختم ڪرڻ جو ڪو طريقو ناهي. جيئن ماڊل وڌيڪ قابل ٿي ويندا آهن، انهن کي جانچڻ واري ماحول کي وڌيڪ مضبوط ٿيڻ جي ضرورت آهي. ان غلطيءَ جا نتيجا رڳو وڌندا رهندا.