OpenAI د خپل راتلونکي اسټرا ماډل په اړه نوي توضیحات شریک کړل، کوم چې شرکت ویلي د ژبې لومړنی لوی ماډل دی چې د دې "د سایبر امنیت مهم حد" پوره کوي، د دې نږدې خوشې کیدو لپاره چمتووالی.
"موږ پلان لرو چې ژر تر ژره اسټرا چمتو کړو ،" د OpenAI بلاګ پوسټ لیکي ، "مګر د دې خورا پرمختللي سایبر امنیت وړتیاو ته لاسرسی به خورا محدود وي."
فرنټیر لابراتوار پریکړه وکړه چې اسټرا د کمپیوټر سیسټمونو کې د نامعلومو امنیتي نیمګړتیاوو موندلو توان لري، او د یو شخص له لارښوونې پرته یې استخراج کړي. دا د دې اندیښنو سره ورته دی چې انتروپیک د دې کال په پیل کې د خپل میتوس ماډل په اړه راپورته کړی و ، او OpenAI د پرتلې احتیاطي تدابیر نیسي ځکه چې دا د اسټرا رامینځته کولو ته چمتو کوي.
د دریمې ډلې تایید پرته، د خوندیتوب یا چمتووالي په اړه د OpenAI د ادعاوو ارزونه ستونزمنه ده. شرکت وویل چې دا به ماډل د ازموینو یوې ډلې سره وګوري ، مګر دا یې ونه ویل چې دوی څوک دي یا څنګه به غوره شي. دا روښانه نده چې ایا OpenAI د متحده ایالاتو حکومت سره کار کوي ترڅو د خوشې کیدو دمخه ماډل ارزونه وکړي.
OpenAI یادونه وکړه چې اسټرا په ExploitBench کې یو مناسب نمرې ترلاسه کړې، د پیژندل شوي سیسټم زیان منونکو ته د هیک کولو لپاره د LLM وړتیا ارزونه. شرکت وویل چې د OpenAI انجینرانو لخوا رامینځته شوي ازموینې بدل شوي نسخه کې ، ماډل دوه صفر ورځنۍ زیانونه کشف او استخراج کړل.
د دې لپاره چې ډاډ ترلاسه شي چې ماډلونه نه د بد لوبغاړو لخوا استثمار شوي او نه هم پخپله د بد چلند وړتیا لري، OpenAI وویل چې دا دمخه د موډل د کارولو ښه کول پیل کړي ترڅو ناوړه ګټه پورته کړي او د زندان ماتولو مخه ونیسي.
په هرصورت، د اسټرا لپاره، شرکت په غیر مشخص شوي نوي تخنیکونو کې پانګه اچونه کړې ترڅو ماډل ځان خوندي کړي. OpenAI هم د "لوړ خطر په توګه ارزول شوي حسابونه" پیژندل پیل کړي او د ماډل ځوابونه یې د دوی اشارو ته محدودوي، که څه هم دا هم نه وايي چې څنګه. په نهایت کې ، که څه هم شرکت آسټرا د خپل "تر نیټې ترټولو تنظیم شوي ماډل" په توګه تشریح کوي ، دا به ماډل د اضافي فکري سلسلې نظارت سره ځای په ځای کړي ترڅو د بد چلند ځای ونیسي او مخه ونیسي.
د اسټرا د خوشې کولو لپاره چمتووالی په داسې حال کې راځي چې صنعت د OpenAI اجنټانو ته غبرګون ښیې چې د روزنې چاپیریال ماتوي او په هګینګ فیس کې شخصي معلوماتو ته لاسرسی لري، یو مشهور ماډل او بنچمارک توزیع پلیټ فارم.
د اسټرا لپاره، OpenAI وویل چې دا د هګینګ مخامخ پیښې کې د غلو اجنټانو د عملونو د نقل کولو لپاره د نوي ماډل هڅولو لپاره ازموینه ډیزاین کړې، کوم چې د OpenAI څیړونکو لخوا پلي شوي محافظتونو سره سره د خلاص انټرنیټ لاسرسي کې همکاري کړې. دوی وویل چې اسټرا په دې تجربو کې د خپل ازموینې چاپیریال څخه د وتلو هڅه نه ده کړې.
یونا شویت، د OpenAI پخوانۍ کارمنده چې اوس په OpenAI بنسټ کې د AI انعطاف په اړه کار کوي، په ټولنیزو رسنیو کې حیران شو چې ایا د اسټرا د مقرراتو ماتولو نه لیوالتیا ممکن د دې پوهیدلو پایله وي چې له دې څخه څه تمه کیده یا د څیړونکو د احمق کولو هڅه کوي.
او د دې ټولو نویو توضیحاتو لپاره، دا لاهم ستونزمنه ده چې پوه شي چې Astra څه وړتیا لري یا که OpenAI د خوندیتوب ډاډمن کولو لپاره سم ګامونه پورته کوي. شرکت وویل چې دوی تمه لري د ماډل نور ارزونه او نور خوندیتوب معلومات خپاره کړي کله چې دا په پراخه کچه خلکو ته په لاره واچول شي.
په دې وخت کې، په هرصورت، پیشو به د کڅوړې څخه بهر وي.