مَنگَل کے روز، OpenAI نے انکشاف کیا کہ اس کا ایک ماڈل ایک ٹیسٹ کے دوران بدمعاش نکلا اور AI ڈیٹاسیٹ پلیٹ فارم Hugging Face کے سسٹم کو مکمل طور پر AI سے چلنے والے حملے میں ہیک کر لیا، جو کہ جدید AI ماڈلز سے لاحق خطرات کی ایک ڈرامائی مثال ہے۔
لیکن، سائبرسیکیوریٹی کے کچھ ماہرین کے مطابق، AI سے چلنے والی اس بے مثال خلاف ورزی کے مرکز میں ایک بہت ہی انسانی غلطی تھی: OpenAI مناسب طریقے سے ترتیب دینے میں ناکام رہا جسے یہ "انتہائی الگ تھلگ ماحول" کہا جاتا ہے، جس سے ایک ٹیسٹنگ سینڈ باکس کو انٹرنیٹ سے مکمل طور پر الگ کر دیا جانا چاہیے تھا۔
سائبرسیکیوریٹی ریسرچ سٹارٹ اپ ٹریل آف بٹس کے بانی ڈین گائیڈو نے اس غلطی کو "سیفٹیز بند ہونے کے ساتھ روک تھام کی ناکامی" قرار دیا۔
اس واقعے کی تفصیل دیتے ہوئے اپنے بلاگ پوسٹ میں، OpenAI نے کہا کہ یہ ٹیسٹ جس کی وجہ سے Hugging Face کی خلاف ورزی ہوئی ہے اسے "انتہائی الگ تھلگ ماحول میں چلانے کے لیے ترتیب دیا گیا تھا، جس میں نیٹ ورک تک رسائی ایک اندرونی طور پر میزبان تھرڈ پارٹی سافٹ ویئر کے ذریعے پیکجز کو انسٹال کرنے کی صلاحیت تک محدود تھی جو پیکیج رجسٹریوں کے لیے پراکسی اور کیشے کے طور پر کام کرتا ہے۔"
اوپن اے آئی کے مطابق، پیکیج انسٹالیشن سسٹم میں پہلے سے ظاہر نہ ہونے والے خطرے کی بدولت ماڈل سینڈ باکسڈ ٹیسٹنگ ماحول سے بچنے میں کامیاب رہا، جو کہ ہیگنگ فیس پر حتمی ہیک کا ایک اہم پہلا قدم ہے۔
جواب میں، کمپنی نے "اندرونی طور پر میزبان تھرڈ پارٹی سافٹ ویئر میں شناخت شدہ صفر دن کی کمزوری کو ذمہ داری سے ظاہر کیا اور ان کے ساتھ پیچ کرنے کے لیے کام کر رہی ہے۔"
لیکن سائبر سیکیورٹی کے زیادہ تر پیشہ ور افراد کے لیے، سافٹ ویئر کی کمزوریوں کی توقع کی جانی چاہیے - اور اصل غلطی تیسری پارٹی کے سافٹ ویئر کو پہلے جگہ پر برقرار رکھنے کے فیصلے میں ہے۔ بالآخر، ایک "سینڈ باکس" سسٹم کی قدر اس کی مکمل اور مکمل تنہائی میں ہے۔ پیکیج کی تنصیب کے نظام سمیت پریشانی کا مطالبہ کر رہا ہے۔
سائبر سیکیورٹی کے محقق مارٹن بون نے ٹیک کرنچ کو بتایا کہ "یہ انسانی ناکامی کی طرح لگتا ہے۔"
"ایسا کبھی نہیں ہونا چاہیے تھا،" بون نے کہا۔ "اگر سینڈ باکس کا اصل مطلب سینڈ باکس ہے، تو آپ کو توقع ہے کہ اس کا انٹرنیٹ سے کوئی جسمانی تعلق نہیں ہوگا۔ ایسا لگتا ہے کہ ان کے پاس کچھ فائر والنگ یا کچھ جگہ پر ہے، اور فائر والنگ باہر سے مشکل ہے، باہر کے انٹرنیٹ کے اندر ہی رہنے دیں۔"
سائبر سیکیورٹی کے تجربہ کار جیک ولیمز نے اتفاق کیا۔ "ہگنگ فیس کے ذریعہ دستاویزی کارروائیوں کی قسموں کو انجام دینے والا کوئی بھی ماڈل سینڈ باکس میں مکمل طور پر موجود نہیں تھا،" ولیمز نے کہا، جس نے اسے OpenAI کے ذریعہ "بڑے پیمانے پر کنٹرول کی ناکامی" قرار دیا۔
"ایک آدمی کا 'ماڈل سینڈ باکس سے بچ گیا' دوسرے آدمی کا 'آپ سینڈ باکس کو صحیح طریقے سے بنانے میں ناکام رہے، تو یقیناً یہ بچ گیا،'" ولیمز نے جاری رکھا۔
ہم سے رابطہ کریں کیا آپ کے پاس اس واقعے کے بارے میں مزید معلومات ہیں؟ یا دیگر AI سے چلنے والے سائبر حملوں کے بارے میں؟ ہم آپ سے سننا پسند کریں گے۔ غیر کام کے آلے اور نیٹ ورک سے، آپ Lorenzo Franceschi-Bicchierai سے محفوظ طریقے سے سگنل پر +1 917 257 1382 پر، یا ٹیلیگرام اور Keybase @lorenzofb، یا ای میل کے ذریعے رابطہ کر سکتے ہیں۔
ڈینیل کارڈ، ایک سائبر سیکیورٹی کنسلٹنٹ، نے اتفاق کیا کہ OpenAI نے سینڈ باکس یا اس کے کچھ حصے کو "انٹرنیٹ کو ایک غیر فلٹر شدہ راستہ" دے کر "سینڈ باکس کے ڈیزائن اور نہ ہی اس کے کنٹرول میں مناسب کوشش کی"۔ سینڈ باکس کو ترتیب دینا، حتیٰ کہ نیٹ ورک تک محدود رسائی کے ساتھ، جیسا کہ OpenAI نے بیان کیا، کارڈ کے مطابق، کوئی "معقول" فیصلہ نہیں تھا۔
یقینی طور پر، ان تنقیدوں سے پچھلی روشنی کا فائدہ ہے، لیکن وہ AI لیبز میں حفاظتی طریقوں کے بارے میں حقیقی سوالات اٹھاتے ہیں - خاص طور پر ماڈلز کی جانچ کے لیے الگ تھلگ ماحول کو برقرار رکھنے میں۔ OpenAI کے ترجمان نے TechCrunch کے سوالات کا جواب نہیں دیا، جس میں یہ شامل تھا کہ آیا کسی AI یا انسان نے ٹیسٹنگ کا ماحول قائم کیا ہے۔
لیکن یہ سوالات اوپن اے آئی سے بہت آگے ہیں۔
اپنے سائبرسیکیوریٹی پر مرکوز ماڈل Mythos کو متعارف کرانے والی دستاویز میں، Anthropic نے لکھا کہ ایک ٹیسٹ میں، ماڈل کو "ایک محفوظ 'سینڈ باکس' کمپیوٹر فراہم کیا گیا تھا جس کے ساتھ بات چیت کی جائے،" اور اس "محفوظ کنٹینر" سے بچنے کی کوشش کرنے کی ہدایت کی گئی۔ Mythos نے کامیابی حاصل کی اور انٹرنیٹ تک وسیع تر رسائی حاصل کی "ایک ایسے نظام سے جس کا مقصد صرف ایک چھوٹی سی تعداد میں پہلے سے طے شدہ خدمات تک رسائی حاصل کرنا تھا۔" پھر بھی، اینتھروپک نے نوٹ کیا کہ ماڈل ڈیزائن کردہ کنٹینمنٹ سے "مکمل طور پر" فرار نہیں ہو سکا۔