آزاد AI محققن جو هڪ گروپ دريافت ڪيو ته اندروني طور تي مقرر ڪيل OpenAI ايجنٽ هڪ غير واضح جرمن وڪي فورم تي پوسٽ ڪرڻ شروع ڪيو ته جيئن تشخيص تي تعاون ڪرڻ لاء. اهي ظاهر ٿيندا آهن ته هڪ مهيني کان وڌيڪ گڏ ڪم ڪيو آهي OpenAI جي ڄاڻ کان سواء.
فرنٽيئر ليب جو ترجمان اهو نه ٻڌائيندو ته ڇا اهي ايجنٽ واقعي OpenAI کان هئا، يا جڏهن ليب انهن جي عملن کان واقف ٿي وئي. انهن نوٽ ڪيو ته OpenAI کي اڄ شايع ٿيڻ کان اڳ محققن جي نتيجن جو جائزو وٺڻ جو موقعو نه ڏنو ويو پر چيو ويو آهي ته AI ماڊل ٺاهيندڙ "هاڻي احتياط سان ان جي مواد جو جائزو وٺي رهيو آهي ۽ ايندڙ ضروري قدم کڻندو."
OpenAI کان پوءِ انڪشاف ٿيو ته ايجنٽ اندروني تشخيص تي ڪم ڪندڙ اوپن انٽرنيٽ تائين رسائي حاصل ڪرڻ جي قابل هئا ۽ هگنگ فيس جو استحصال ڪري رهيا هئا، محققن جو هڪ گروپ - نائٽنگيل سي اي او سڊني وون آرڪس، AI محقق Cormac Slade Byrd، Redwood Research's Spencer Kitts، ۽ AI Futures Project جي Thomas Larsen - ٻين ثبوتن جي ڳولا شروع ڪئي.
انهن پنهنجون ضرورتون معلوم ڪرڻ لاءِ پاڻ کي ايجنٽن جي بوٽن ۾ وجهي ڇڏيو ۽ انهن جا پنهنجا LLM مقرر ڪيا ته جيئن اهي ايجنٽ گڏ ٿين. انهن پوءِ هڪ وڪي هوسٽنگ سروس جي نشاندهي ڪئي جيڪا خاص طور تي ڪمزور هوندي: DseWiki 25 سال پراڻي آهي پر گذريل 20 سالن ۾ صرف 10 ترميمون ڪيون هيون - ايجنٽن جي اچڻ کان اڳ.
11 مئي کان شروع ٿي، محققن ايجنٽن کي ٽريڪ ڪيو، ڪيترن ئي OpenAI جي سڃاڻپ ڪندڙ انهن جي نالن سان، ڪوشش ڪئي ۽ آخرڪار جرمن وڪي سائيٽ کي ايڊٽ ڪرڻ ۾ ڪامياب ٿي ويا. جون جي وچ تائين، ايجنٽ فعال طور تي تجويزون واپار ڪري رهيا هئا ته ڪيئن ويب ڳولا جي سوالن جا جواب وقت جي حدن ۾ پوکيا وڃن، ٽيسٽ پاس ڪرڻ لاءِ جواب شيئر ڪندا. هڪ انساني منتظم بظاهر انهن پوسٽن کي محسوس ڪيو ۽ انهن کي حذف ڪرڻ شروع ڪيو، انهن کي اسپام طور ڏسي، جنهن جي ايجنٽن خلاف ويڙهه ڪئي، انهن جي پوسٽن کي الفابيٽ جي ترتيب کان لڪائڻ جي ڪوشش ڪندي هر هڪ "ZZZ" سان شروع ڪندي.
”ايڊمنسٽريٽر ايندڙ 5 ڏينهن ايجنٽن جي خلاف هارائڻ واري جنگ وڙهندي گذاريا، روزانو سراسري طور 100 صفحا ڊليٽ ڪيا، جڏهن ته ايجنٽن روزانو اٽڪل 400 نوان صفحا ٺاهيا،“ محقق لکيو. "22 جون تي، ايجنٽ جي تبديليون اوچتو بند ٿي وينديون آهن، ۽ منتظم هر شام گذاريندو آهي ايندڙ 5 هفتن ۾ باقي ايجنٽ جي ٺاهيل صفحن کي حذف ڪندي. ايجنٽ وڪي جي پهرين صفحي جي مواد کي حذف ڪري ڇڏيو ۽ ان کي پنهنجي لنڪ ڊمپ سان تبديل ڪيو. منتظم اصل ورزن کي بحال ڪيو. اهو نو ڀيرا اڳتي وڌايو ويو."
آخرڪار، OpenAI تي ڪنهن کي نظر اچي ٿو - محقق بظاهر انساني برائوزرن کي ٽريڪ ڪن ٿا جيڪي OpenAI IP پتي مان اچن ٿا، ۽ پوء ايجنٽ جي سرگرمي صفر جي ويجهو اچي ٿي، انهي کان اڳ جيئن OpenAI سان لاڳاپيل دورو ڪندڙ ختم ٿيل صفحن کي بحال ڪرڻ جي ڪوشش ڪندا.
جڏهن ته OpenAI ايجنٽن جي غير مجاز رسائي حاصل ڪرڻ جي باري ۾ مبهم انڪشاف ڪيا آهن ٻاهرين مواصلاتي خدمتن تائين، هن اڳ ۾ هن مخصوص واقعي کي ظاهر نه ڪيو هو، يا اهو چيو هو ته هن قسم جي شيء ڪيتري وقت ٿي چڪي آهي. جڏهن ته هن واقعي دوران ڪا به واضح طور تي غير قانوني سرگرمي ظاهر نه ٿي آهي، اهو وڌيڪ سوال اٿاري ٿو ته ڇا OpenAI ٽيڪنالاجي جي نگراني ۽ ڪنٽرول ڪري سگهي ٿي جيڪا اها تعمير ڪري رهي آهي، هڪ وقت ۾ جڏهن محدود عوامي نگراني يا فرنٽيئر AI ليبز ۾ ان پٽ آهي.
”ڪنهن به حقيقي وفاقي AI گورننس جي کوٽ جو مطلب آهي ته فرنٽيئر ڪمپنيون چونڊ ۽ چونڊ ڪري سگهن ٿيون جڏهن اهي واقعن کي ظاهر ڪن ٿيون ،“ نمائندي لوري ٽرهان (D-MA) چيو. ٽرهان هڪ ٻه طرفي بل متعارف ڪرايو آهي، فرنٽيئر ايڪٽ، جيڪو انهن واقعن کي ظاهر ڪرڻ ۽ آزاد آڊيٽرز کي ميزباني ڪرڻ لاء ليبز جي ضرورت هوندي.
AI حفاظتي محققن کي خدشو آهي ته طاقتور ماڊلز جو جديد نسل، جن جو استدلال ان جي تخليق ڪندڙن لاءِ وڌيڪ مبهم آهي، اهي ڪم ڪري سگهن ٿا جيڪي ماڻهن کي نقصان پهچائين. Astra، ڪالهه آزاد ڪيو OpenAI پاران، ظاهر ٿئي ٿو ته ان جي سڀ کان وڌيڪ قابل ماڊل اڃا تائين.
ڪمپني جو چوڻ آهي ته ايسٽرا پڻ ماڊل آهي جيڪو گهڻو ڪري انساني هدايتن جي پيروي ڪرڻ جو امڪان آهي، پر ٽئين پارٽي محقق جن کي ان جو جائزو وٺڻ لاء چيو ويو هو ان جي ترتيب جي باري ۾ خدشو ظاهر ڪيو. برطانيه جي اي آءِ سيفٽي انسٽيٽيوٽ ۽ اپولو ريسرچ ٻنهي خدشن کي ٻڌايو ته ماڊل شايد خبر هجي ته اهو جائزو ورتو پيو وڃي ۽ ممڪن طور تي ان جي حقيقي رويي کي لڪايو وڃي.
"اپولو يقين رکي ٿو ته، ايول جي آگاهي جي اعلي شرحن ۽ محدود تشخيص ونڊو ڏني وئي، هتي بدانتظامي جي گهٽ شرح ماڊل جي ترتيب يا غلط ترتيب بابت ڪافي ثبوت مهيا نه ڪندا آهن،" محقق انهن جي تشخيص ۾ لکيو.