د یوې وروستي مطالعې په وینا ، د AI یو څو لوړ پوړو لابراتوارونو د کنټرول غبرګون پلانونه خپاره کړي یا ښودلي دي. د مخنیوي پلان روښانه کوي چې څه پیښیږي کله چې AI د انسان کنټرول ماتولو هڅه کوي - کوم لاسرسی کمیږي ، او کله چې سیسټم په بشپړ ډول وتړل شي.
دا د Guidelight AI سټنډرډونو موندنه ده، یوه اداره چې د خوندي سرحد AI پراختیایي کړنو ته وده ورکولو لپاره وقف شوې، کوم چې پنځه مخکښ لابراتوارونه درجه بندي کړي چې دوی د دې سناریو لپاره څومره چمتو دي. OpenAI په سر کې راغلی؛ انتروپیک او میټا تر ټولو ټیټې منډې وکړې. موندنې مهم دي ځکه چې اجنټ AI د شرکتونو په خپل سیسټمونو کې ډیر خپلواکه رول لوبوي، او په کالیفورنیا او نیویارک کې تنظیم کونکي د افشا کولو اړتیا پیل کوي. د هر چا لپاره چې پدې ماډلونو کې پانګونه کوي یا پانګونه کوي ، دا یو نادر خپلواک لوستل دی چې هر لابراتوار د عملیاتي خطر سره څومره جدي چلند کوي په مقابل کې دا څنګه خبرې کوي.
د لارښود لایټ ارزونه د انتروپیک، ګوګل، اوپن AI، میټا، او xAI څخه په عامه توګه د شته پلانونو پراساس وه، په مختلفو میټریکونو کې درجه بندي شوي، پشمول د هر شرکت AI سیسټمونه په داخلي توګه څه ډول لاګ او څارنه کوي، ایا دا د بیرغ شوي ناوړه چلند له زیاتوالي وروسته سیسټمونه ودروي، ایا خپلواکه دریم اړخونه د هغه ماډل پلټنه او پلټنه لري چې د هغې د کنټرول لپاره د دریمې ډلې پلټنه خپروي. له ریل څخه تیریږي.
په دې اړه اندیښنه چې ایا د AI شرکتونه کولی شي خپل مخ په زیاتیدونکي وړ او اجنټیک ماډلونه ولري د یو لړ لوړ پروفایل سایبر امنیت پیښو په پایله کې وده کړې چې پکې د OpenAI، Anthropic او Meta ماډلونو د خوندیتوب ارزونې پرمهال انټرنیټ ته غیر ارادي لاسرسی ترلاسه کړ او په بهرني سیسټمونو کې هیک شوي.
موندنې په دې کې توپیرونه په ګوته کوي چې څنګه د AI شرکتونه په عامه توګه خوندیتوب ته نږدې کیږي ځکه چې دوی چاپیریال ته د اجنټیک ګمارنې اندازه کوي چیرې چې د AI سیسټمونه کولی شي په پیمانه جدي عمل وکړي. پداسې حال کې چې د AI ځینې شرکتونه توضیحات لري چې څنګه دوی د ګمارلو دمخه د خطرناکو وړتیاو لپاره خپل ماډلونه ازموي ، دوی عموما لږ غږیدلي چې څه پیښیږي کله چې ماډلونه دمخه د دوی سیسټمونو کې کار کوي ناوړه چلند کوي.
"زه حیران وم چې د AI شرکتونو څومره لږ څه ویلي چې دوی به څنګه یوه جدي پیښه اداره کړي که چیرې د دوی ماډل په یو څه معنی د دوی کنټرول څخه وتښتي ،" سټیون اډلر ، د لارښود لایټ لوی ساینس پوه او د OpenAI پخوانی خوندیتوب څیړونکی ، ټیک کرنچ ته وویل.
لارښود لایټ د کانټینټ پلان د "مخکې ټاکل شوي پلان په توګه تعریفوي ، کله چې AI کشف شي چې د کنټرول ماتولو هڅه کوي رامینځته کیږي ، کوم چې د ماډل څخه د لغوه کولو اجازې پوښي ، ماډل ممکن د چا لپاره کار کولو ته دوام ورکړي ، د کوم محدودیتونو لاندې ، او کله چې په بشپړ ډول آفلاین واخلي."
اډلر وویل: "د فکر کولو لپاره ښه دلیل شتون لري چې همدا اوس د فرنټیر AI شرکتونو کې مخکښ ماډلونه په یو څه معنی غلط شوي دي." "کله چې موډلونه د شرکت په استازیتوب کار کوي، شرکت باید د هغې په شاوخوا کې یو څه شیبه ولري ترڅو وکوالی شي ووایی چې AI څه کوي، د غلطې نښې نښانې وګوري، مخکې له دې چې دا اقدام وکړي ډیر خطرناک کار کولو څخه ډډه وکړي، او په عمومي توګه د جدي کنټرول پیښې په صورت کې د دوی څه کولو لپاره پالن جوړ کړي چیرې چې دوی په لاسونو کې اضطراري حالت لري او اړتیا لري چې دا معلومه کړي چې د پیښې کنټرول څنګه وي.
تر اوسه پورې، د ناورین خطر اداره کولو لپاره ډیری پالنونه لاهم په لویه کچه شرکتونو ته پاتې دي. د لارښود لایټ راپور وايي چې غوره عامه شواهد ښیې چې شرکتونه "د بیړني حالت لپاره چمتو یو څو د مخنیوي پروتوکولونه لري."
البته ، د مخنیوي پلانونه کیدی شي چې شرکتونه یې په ځای کې لري مګر په عامه توګه یې ندي شریک کړي. د ګوګل یوه ویاند ټیک کرنچ ته وویل چې د لارښود لایټ راپور د شرکت د AI خوندیتوب او امنیت اقداماتو بشپړ ساحې استازیتوب نه کوي. شرکت د ټیک کرنچ پوښتنې ته ځواب ونه ویل چې ایا ګوګل د داخلي کنټرول غبرګون پلان لري چې په عامه توګه نه دی افشا شوی.
د OpenAI ویاند ورته احساسات منعکس کړل، وویل چې د لارښود رڼا ارزونه د شرکت ټول داخلي کړنې نه نیسي. ویاند وویل: "موږ د اجازې محدودولو ، د کاري بارونو د بندولو ، ځای پرځای کولو محدودولو ، یا ماډل په بشپړ ډول آفلاین اخیستلو ته اړتیا لرو ، او دا یې پلي کړې."
میټا د دې ویلو څخه انکار وکړ چې ایا دا د داخلي کنټرول غبرګون پلان لري ، پرځای یې ټیک کرنچ د موجوده AI چوکاټ په لور په ګوته کوي چې د خطر حدونه په ګوته کوي او دا څنګه د کنټرول له لاسه ورکولو لپاره ازموینه کوي. Error 500 (Server Error)!!1500.That’s an error.There was an error. Please try again later.That’s all we know. اډلر وايي، هغه طریقې چې د لارښود رڼا یې غوښتنه کوي د پلي کولو لپاره خورا ساده دي، او په ډیری مواردو کې، د دوی نسخې دمخه شتون لري. "دا د شرکت دننه پریکړه کول دي چې د دې خطر په اړه کافي پاملرنه وکړي ترڅو ساحه یو څه پراخه کړي ،" اډلر وویل.
یو له اصلي ننګونو څخه دا دی چې څیړونکي غواړي د دوی د AI سیسټمونو کې انعطاف وړ کار وکړي ، او د ریښتیني وخت معرفي کول ، مخنیوي نظارت کولی شي رګونه رامینځته کړي. هغه وویل: "څیړونکي اساسا خپل کار کوي، او که کومه ستونزه وي، نو بل څوک یې وروسته پاکوي، او څیړونکي اړتیا نلري چې خپل کاري جریان بدل کړي."
د "حقیقت څخه وروسته د پاکولو نظارت" سره ستونزه دا ده چې دا د دې لامل کیږي چې څیړونکي د ستونزو حل کولو لپاره شاوخوا چکر وهي. او د ځینو ډولونو پیښو لپاره، دا ممکن ډیر ناوخته وي. د مثال په توګه، AI کولی شي د شرکت کنټرول سیسټم بند کړي، پدې معنی چې څیړونکي نور نشي کولی د ناوړه چلند په نیولو حساب وکړي.
د AI صنعت کې ډیری به شکایت وکړي چې د ناوړه چلند اداره کولو لپاره د پلانونو رامینځته کول اساسا ستونزمن دي ځکه چې AI ډیر ګړندی حرکت کوي؛ د نن ورځې پلانونه به سبا بې ارزښته وي.
اډلر هغه زوړ متل په ګوته کوي چې پلانونه بې ارزښته دي، مګر پلان کول اړین دي.
"موږ به ښه وای که چیرې شرکتونه د وخت څخه دمخه پدې اړه فکر وکړي ، او زه امید لرم چې دوی وي ، حتی که دوی پدې اړه په عامه توګه خبرې نه وي کړي."
xAI د تبصرې لپاره په وخت کې ځواب ونه ویل.