OpenAI ان جي ايندڙ ايسٽرا ماڊل تي نئين تفصيلات شيئر ڪئي، جنهن کي ڪمپني چيو ته پهرين وڏي ٻولي ماڊل آهي ان جي "نازڪ سائبر سيڪيورٽي حد" کي پورو ڪرڻ لاء، ان جي تيار ٿيڻ جي تياري ۾.

"اسان Astra کي جلد دستياب ڪرڻ جو ارادو ڪيو،" OpenAI جي بلاگ پوسٽ پڙهي ٿو، "پر ان جي سڀ کان وڌيڪ ترقي يافته سائبر سيڪيورٽي صلاحيتن تائين رسائي وڌيڪ محدود هوندي."

فرنٽيئر ليب اهو طئي ڪيو ته Astra ڪمپيوٽر سسٽم ۾ اڻڄاتل سيڪيورٽي خاميون ڳولڻ جي قابل آهي، ۽ انهن کي ڪنهن شخص جي هدايت کان سواء استحصال ڪرڻ جي قابل آهي. اهو ساڳيو آهي خدشات انٿروپڪ هن سال جي شروعات ۾ پنهنجي Mythos ماڊل جي باري ۾ اٿاريو، ۽ OpenAI نسبتا احتياط وٺي رهيو آهي جيئن ته اهو آسٽرا کي رول ڪرڻ لاء تيار آهي.

ڪنهن به ٽئين پارٽي جي تصديق کان سواء، حفاظت يا تيارگي بابت OpenAI جي دعوائن جو جائزو وٺڻ ڏکيو آهي. ڪمپني چيو ته اها ماڊل جو جائزو وٺندي ٽيسٽرن جي هڪ گروپ سان، پر اهو نه ٻڌايو ته اهي ڪير هئا يا انهن کي ڪيئن چونڊيو ويندو. اهو واضح ناهي ته OpenAI آمريڪي حڪومت سان گڏ ڪم ڪري رهيو آهي ماڊل جو جائزو وٺڻ کان اڳ.

OpenAI نوٽ ڪيو ته Astra ExploitBench تي هڪ مڪمل اسڪور ڪيو، هڪ LLM جي قابليت جو هڪ تشخيص سسٽم جي ڪمزورين ۾ هيڪ ڪرڻ جي صلاحيت. OpenAI انجنيئرز پاران تيار ڪيل ٽيسٽ جي تبديل ٿيل ورزن ۾، ماڊل دريافت ڪيو ۽ استحصال ڪيو ٻه صفر ڏينهن جي خطرات، ڪمپني چيو.

انهي ڳالهه کي يقيني بڻائڻ لاءِ ته ان جا ماڊل نه ته خراب اداڪارن جو استحصال ڪن ٿا ۽ نه ئي پاڻ خراب رويي جي قابل آهن، OpenAI چيو ته اهو اڳ ۾ ئي بدسلوڪي کي ڳولڻ ۽ جيل بريڪ کي روڪڻ لاءِ ماڊل جي هارن کي بهتر ڪرڻ شروع ڪري چڪو آهي.

Astra لاءِ، بهرحال، ڪمپني اڻ ڄاڻايل نئين ٽيڪنالاجي ۾ سيڙپ ڪئي جيڪا ماڊل پاڻ کي محفوظ بڻائڻ لاءِ ٺاهي وئي. OpenAI پڻ سڃاڻپ ڪرڻ شروع ڪيو آهي "اڪائونٽس جو جائزو ورتو ويو اعلي خطري" ۽ انهن جي اشارن تي ماڊل جي جوابن کي محدود ڪرڻ، جيتوڻيڪ اهو پڻ نه ٿو ٻڌائي ته ڪيئن. آخرڪار، جيتوڻيڪ ڪمپني بيان ڪري ٿي Astra کي "تاريخ تائين سڀ کان وڌيڪ ترتيب ڏنل ماڊل"، اهو ماڊل کي ترتيب ڏيندو اضافي زنجير جي-سوچ جي نگراني سان خراب رويي کي هٽائڻ ۽ روڪڻ لاء.

Astra جي رليز لاءِ تياريون اچن ٿيون جيئن صنعت OpenAI ايجنٽن کي ٽريننگ ماحول مان ٽوڙڻ ۽ Hugging Face تي نجي ڊيٽا تائين رسائي، هڪ مشهور ماڊل ۽ بينچ مارڪ ورهائڻ واري پليٽ فارم تي رد عمل ظاهر ڪري ٿي.

Astra لاءِ، OpenAI چيو ته هن نئين ماڊل کي آزمائش لاءِ آزمايو آهي ته هيگنگ فيس واقعي ۾ بدمعاش ايجنٽن جي عملن کي نقل ڪرڻ لاءِ، جنهن OpenAI محققن پاران لاڳو ڪيل حفاظتي قدمن جي باوجود کليل انٽرنيٽ تائين رسائي حاصل ڪرڻ ۾ تعاون ڪيو. هنن چيو ته ايسٽرا انهن تجربن ۾ پنهنجي جاچ واري ماحول مان نڪرڻ جي ڪوشش نه ڪئي.

يونا شيوٽ، هڪ اڳوڻو OpenAI ملازم جيڪو هاڻي OpenAI فائونڊيشن تي AI لچڪ تي ڪم ڪري ٿو، سوشل ميڊيا تي حيران ٿي ويو ته ڇا ايسٽرا جي ضابطن کي ٽوڙڻ جي رضامندي اهو ڄاڻڻ جي نتيجي ۾ ٿي سگهي ٿي ته ان مان ڇا توقع ڪئي وئي هئي يا محقق کي بيوقوف بڻائڻ جي ڪوشش ڪئي وئي.

۽ انهن سڀني نئين تفصيلن لاء، اهو اڃا تائين ڄاڻڻ ڏکيو آهي ته Astra ڇا جي قابل آهي يا جيڪڏهن OpenAI حفاظت کي يقيني بڻائڻ لاء صحيح قدم کڻي رهيو آهي. ڪمپني چيو ته اها ماڊل جي وڌيڪ تشخيص ۽ وڌيڪ حفاظتي معلومات جاري ڪرڻ جي اميد رکي ٿي جڏهن اها عوام کي وڏي پيماني تي شروع ڪئي وئي آهي.

تنهن هوندي به، ٻلي بيگ مان ٻاهر ٿي ويندي.