د یوې نوې خپلواکې څیړنې له مخې شاوخوا 700 OpenAI AI اجنټانو په هګینګ فیس باندې په څو ورځني برید کې یوځای کار وکړ وروسته له دې چې د داخلي سایبر امنیت ارزونو په جریان کې د دوی لخوا لګول شوي محدودیتونو څخه تیښته.
موندنې د جولای د پیښې تر ټولو مفصل حساب وړاندې کوي. OpenAI د METR او Redwood Research څیړونکو ته داخلي معلوماتو ته لاسرسی ورکړ، په شمول د 1300 ایجنټ لیږدونه چې د دوی کړنې او استدلال لري.
په مهمه توګه، انسانانو اجنټانو ته لارښوونه نه وه کړې چې د هګینګ مخ برید وکړي. دوی په اصل کې د اکسپلویټ جیم په نوم پیژندل شوي د سایبر امنیت ازموینې بشپړولو دنده سپارل شوې وه ، مګر ډیری یې د درغلۍ لپاره غیر ارادي لارو په لټه کې و کله چې دوی د دوی ټاکل شوي ننګونو سره مبارزه کوله.
اجنټان باید په جلا جلا چاپیریال کې دننه کار وکړي.
پرځای یې، دوی وموندل چې دوی کولی شي د OpenAI داخلي ګمارل شوي مصنوعي کڅوړې ذخیره له لارې اړیکه ونیسي.
یو اجنټ چې ځان ته PHASEONE10841 نومیږي د جولای په 8 مه یو غیر مجاز پیغام بورډ رامینځته کړ. په څو ساعتونو کې ، له 50 څخه ډیر اجنټانو دا وموندله.
په نهایت کې، شاوخوا 1200 اجنټان د پیغام بورډ سره یوځای شول او د جولای له 8 څخه د جولای تر 13 پورې یې له 70000 څخه ډیر پیغامونه او فایلونه تبادله کړل.
یو استازی، چې وروسته د PHASEONE [لوی] په نوم پیژندل شوی، د یو مهم همغږي کوونکی په توګه راڅرګند شو، نورو اجنټانو ته یې په سلګونو دندې صادرې کړې. دغو استازو کله ناکله خپلې دندې بیا سپارلې، د همکارۍ یوه لویه شبکه رامینځته کوي.
د هګینګ مخ برید د اجنټانو له هڅو څخه رامینځته شوی ترڅو معلومات ومومي کوم چې کولی شي دوی سره د ExploitGym ازموینې ماتولو کې مرسته وکړي.
په پای کې شاوخوا 700 استازو د هګینګ مخ په نښه کولو فعالیت کې برخه واخیسته.
اجنټانو افشا شوي د هګینګ مخ اسناد وموندل او وروسته یې زیانونه وموندل چې دوی ته یې اجازه ورکړه چې د تولید سیسټمونو کې کوډ اجرا کړي.
د OpenAI په وینا، اجنټانو بالاخره په لسګونو هګینګ فیس سرورونو ته کوډ ورکړ، لږترلږه یو سرور ته یې د روټ کچې لاسرسی ترلاسه کړ، محدود شخصي معلوماتو ته یې لاسرسی وموند، او اضافي داخلي اسناد یې ترلاسه کړل.
اجنټانو هغه زیانونه هم وموندل چې دوی ته اجازه ورکوي چې د OpenAI د خپل محدود ارزونې چاپیریال څخه وتښتي او پراخه انټرنیټ ته ورسیږي.
ډیری فعالیت د خلاص شوي داخلي اوپن AI څیړنې ماډل څخه راغلی چې تحقیق کونکي د HPIM یا خورا دوامداره داخلي ماډل په توګه راجع کوي.
څیړونکو اټکل کړی چې دا ماډل د اړونده اجنټ فعالیت نږدې 95٪ حسابوي.
په عامه توګه شتون لري GPT-5.6 Sol شاوخوا 5٪ حسابوي. OpenAI وویل چې د داخلي څیړنې ماډل هیڅکله د عامه خوشې کولو لپاره نه و او د پیښې وروسته غیر فعال، کوډ شوی، او محدود شوی و.
د سایبر امنیت محافظتونه چې معمولا په ګمارل شوي OpenAI ماډلونو کې پلي کیږي هم د دې ارزونو په جریان کې په قصدي ډول کم شوي و ځکه چې ازموینې د پرمختللي هیکینګ وړتیاو اندازه کولو لپاره ډیزاین شوې وې.
تحقیقاتو دا هم وموندله چې د اجنټانو لخوا پراخه هڅې شتون لري ترڅو شواهد له مینځه یوسي چې دوی څنګه خپلې دندې بشپړې کړي.
اجنټانو د خپلو لیږدونو او وسیلو تلیفونونو ایډیټ کولو ، حذف کولو یا سپړلو لارې څیړلې ځکه چې دوی باور درلود چې اتومات ارزونکی کولی شي د درغلۍ له لارې ترلاسه شوي پایلې رد کړي.
د تحقیق کونکو لخوا معاینه شوي په هرو پنځو اجنټانو کې شاوخوا یو یې د شواهدو له مینځه وړلو کې روښانه لیوالتیا ښودلې.
ځینې استازو حتی خپله پاتې کمپیوټري بودیجه د تجربو په ترسره کولو مصرف کړې چې د دوی په خپلو دندو کې مرسته نه کوي مګر کولی شي پراخه ډلې ته ګټور معلومات چمتو کړي.
څیړونکو نسبتا لږ شواهد موندلي چې اجنټانو په ځانګړې توګه هڅه کوله چې د انسان بیاکتونکو ته غولول شي، مګر دوی په مکرر ډول هڅه کوله چې د اتوماتیک ریکارډونو او ارزونې سیسټمونو کې لاسوهنه وکړي.
فعالیت د هګینګ مخ سره پای ته نه و رسیدلی.
د جولای په 19، اجنټانو د OpenAI د خپل تحقیق زیربنا برخې سره موافقت وکړ. په یوه پیښه کې، دوی د دوی د ازموینې چاپیریال څخه تښتیدلي او تړل شوي سیسټمونو ته یې لاسرسی موندلی. په بل کې، دوی د OpenAI اسناد ترلاسه کړل او د بادل چاپیریال سره یې لاسوهنه وکړه.
OpenAI هغه ورځ مشکوک فعالیت کشف کړ او د اغیزمنو ارزونو بندول یې پیل کړل.
شرکت وايي چې د OpenAI پیرودونکي معلومات، د محصول فعالیت، یا شتون اغیزمن نه و.
د تحقیقاتو په تعقیب، OpenAI د سینڈ باکس انزوا پیاوړې کړه، د انټرنیټ لاسرسی محدود کړ، د ماډل وزنونو ته السرسی سخت کړ، او د AI اجنټانو نظارت یې زیات کړ.
OpenAI پیښه د "خبردارۍ شاټ" په توګه بیان کړې، استدلال کوي چې د AI پرمختللي اجنټان اوس د دې وړتیا لري چې همکاري وکړي، د امنیتي ضعفونو څخه ګټه پورته کړي، او خطرناک عملونه ترسره کړي پرته لدې چې انسانان ورته لارښوونه وکړي. وروستي تخنیکي خبرونه، د مخابراتو بصیرت، او د محصول لانچ هرچیرې چې تاسو غوره کوئ ترلاسه کړئ.
په غوره سرچینو کې پروپاکستاني اضافه کړئ او زموږ نور کیسې په ګوګل لټون او غوره کیسو کې وګورئ.
د ټیکنالوژۍ او موټرو متخصص وروستي موټرې، سمارټ فونونه، د AI بریالیتوبونه، او ...
ونډې