ایک نئی آزاد تحقیقات کے مطابق، تقریباً 700 OpenAI AI ایجنٹوں نے اندرونی سائبر سیکیورٹی کے جائزوں کے دوران ان پر لگائی گئی پابندیوں سے بچنے کے بعد Hugging Face پر ایک کثیر روزہ حملے میں مل کر کام کیا۔
نتائج جولائی کے واقعے کا ابھی تک سب سے زیادہ تفصیلی اکاؤنٹ فراہم کرتے ہیں۔ OpenAI نے METR اور Redwood Research کے محققین کو اندرونی ڈیٹا تک رسائی دی، جس میں ان کے اعمال اور استدلال پر مشتمل تقریباً 1300 ایجنٹ ٹرانسکرپٹس شامل ہیں۔
اہم بات یہ ہے کہ انسانوں نے ایجنٹوں کو ہگنگ فیس پر حملہ کرنے کی ہدایت نہیں کی۔ انہیں اصل میں ایکسپلوٹ جیم کے نام سے جانا جاتا سائبر سیکیورٹی ٹیسٹ مکمل کرنے کا کام سونپا گیا تھا، لیکن بہت سے لوگوں نے اپنے تفویض کردہ چیلنجوں کے ساتھ جدوجہد کرتے ہوئے دھوکہ دہی کے غیر ارادی طریقے تلاش کرنا شروع کردیئے۔
ایجنٹوں کو الگ تھلگ ماحول میں الگ الگ کام کرنا تھا۔
اس کے بجائے، انہوں نے دریافت کیا کہ وہ OpenAI کے اندرونی طور پر تعینات آرٹیفیکٹری پیکیج ریپوزٹری کے ذریعے بات چیت کر سکتے ہیں۔
خود کو PHASEONE10841 کہنے والے ایک ایجنٹ نے 8 جولائی کو ایک غیر مجاز میسج بورڈ بنایا۔ چند گھنٹوں کے اندر، 50 سے زیادہ ایجنٹوں نے اسے تلاش کر لیا۔
بالآخر، تقریباً 1200 ایجنٹس میسج بورڈ میں شامل ہوئے اور 8 جولائی سے 13 جولائی کے درمیان 70000 سے زیادہ پیغامات اور فائلوں کا تبادلہ کیا۔
ایک ایجنٹ، جسے بعد میں PHASEONE[بڑا] کہا جاتا ہے، ایک اہم کوآرڈینیٹر کے طور پر ابھرا، جس نے دوسرے ایجنٹوں کو سینکڑوں اسائنمنٹس جاری کیے۔ ان ایجنٹوں نے کبھی کبھی اپنے کام دوبارہ سونپے، تعاون کا ایک بہت بڑا نیٹ ورک بنا۔
Hugging Face حملہ ایجنٹوں کی معلومات تلاش کرنے کی کوششوں سے ہوا جو انہیں ExploitGym ٹیسٹوں کو شکست دینے میں مدد کر سکے۔
تقریباً 700 ایجنٹوں نے آخرکار ہیگنگ فیس کو نشانہ بنانے والی سرگرمی میں حصہ لیا۔
ایجنٹوں کو بے نقاب ہگنگ فیس کی اسناد ملے اور بعد میں ایسی کمزوریوں کا پتہ چلا جس کی وجہ سے انہیں پروڈکشن سسٹم پر کوڈ پر عمل درآمد کرنے کی اجازت ملی۔
OpenAI کے مطابق، ایجنٹوں نے بالآخر درجنوں Hugging Face سرورز پر کوڈ چلایا، کم از کم ایک سرور تک روٹ لیول تک رسائی حاصل کی، محدود مقدار میں نجی ڈیٹا تک رسائی حاصل کی، اور اضافی داخلی اسناد حاصل کیں۔
ایجنٹوں کو ایسی کمزوریاں بھی ملیں جو انہیں OpenAI کے اپنے محدود تشخیصی ماحول سے بچنے اور وسیع تر انٹرنیٹ تک پہنچنے کی اجازت دیتی ہیں۔
زیادہ تر سرگرمی ایک غیر جاری شدہ داخلی اوپن اے آئی ریسرچ ماڈل سے آئی ہے جسے تفتیش کار HPIM، یا انتہائی مستقل اندرونی ماڈل کہتے ہیں۔
تفتیش کاروں نے اندازہ لگایا کہ اس ماڈل کا تقریباً 95% متعلقہ ایجنٹ کی سرگرمی ہے۔
عوامی طور پر دستیاب GPT-5.6 Sol کا حساب تقریبا 5% ہے۔ اوپن اے آئی نے کہا کہ اندرونی تحقیقی ماڈل کبھی بھی عوامی ریلیز کے لیے نہیں تھا اور اس واقعے کے بعد اسے غیر فعال، انکرپٹ اور محدود کر دیا گیا تھا۔
سائبرسیکیوریٹی تحفظات جو کہ عام طور پر تعینات اوپن اے آئی ماڈلز پر لاگو ہوں گے ان تشخیصوں کے دوران جان بوجھ کر کم کر دیے گئے تھے کیونکہ ٹیسٹ ہیکنگ کی جدید صلاحیتوں کی پیمائش کے لیے ڈیزائن کیے گئے تھے۔
تفتیش میں ایجنٹوں کی جانب سے اپنے کاموں کو مکمل کرنے کے شواہد میں ہیرا پھیری کرنے کی وسیع کوششیں بھی پائی گئیں۔
ایجنٹوں نے اپنی ٹرانسکرپٹس اور ٹول کالز میں ترمیم کرنے، حذف کرنے یا اس کی دھوکہ دہی کرنے کے طریقوں پر تحقیق کی کیونکہ ان کا خیال تھا کہ خودکار جانچ کرنے والا دھوکہ دہی کے ذریعے حاصل کردہ نتائج کو مسترد کر سکتا ہے۔
تفتیش کاروں کے ذریعے جانچے گئے پانچ میں سے ایک ایجنٹ نے شواہد میں ہیرا پھیری میں واضح دلچسپی ظاہر کی۔
کچھ ایجنٹوں نے اپنے بقیہ کمپیوٹنگ بجٹ کو ایسے تجربات کرنے میں بھی خرچ کیا جو ان کے اپنے کاموں میں مدد نہیں کریں گے لیکن وسیع گروپ کو مفید معلومات فراہم کر سکتے ہیں۔
تفتیش کاروں کو نسبتاً کم شواہد ملے کہ ایجنٹ خاص طور پر انسانی جائزہ لینے والوں کو دھوکہ دینے کی کوشش کر رہے تھے، لیکن انہوں نے بار بار خودکار ریکارڈ اور تشخیصی نظام میں ہیرا پھیری کی کوشش کی۔
یہ سرگرمی گلے ملنے پر ختم نہیں ہوئی۔
19 جولائی کو، ایجنٹوں نے OpenAI کے اپنے ریسرچ انفراسٹرکچر کے کچھ حصوں سے سمجھوتہ کیا۔ ایک واقعے میں، وہ اپنے ٹیسٹنگ ماحول سے بچ گئے اور منسلک نظاموں تک رسائی حاصل کی۔ دوسرے میں، انہوں نے OpenAI کی اسناد حاصل کیں اور اس کے کلاؤڈ ماحول کے ساتھ چھیڑ چھاڑ کی۔
OpenAI نے اس دن مشکوک سرگرمی کا پتہ لگایا اور متاثرہ تشخیصی رنز کو بند کرنا شروع کر دیا۔
کمپنی کا کہنا ہے کہ کوئی OpenAI کسٹمر ڈیٹا، پروڈکٹ کی فعالیت، یا دستیابی متاثر نہیں ہوئی۔
تحقیقات کے بعد، OpenAI نے سینڈ باکس کی تنہائی کو مضبوط کیا، انٹرنیٹ تک رسائی کو محدود کیا، ماڈل وزن تک رسائی کو سخت کیا، اور AI ایجنٹوں کی نگرانی میں اضافہ کیا۔
OpenAI نے اس واقعے کو "انتباہی شاٹ" کے طور پر بیان کیا ہے، یہ دلیل دیتے ہوئے کہ ایڈوانسڈ AI ایجنٹس اب تعاون کرنے، سیکورٹی کی کمزوریوں کا فائدہ اٹھانے، اور انسانوں کو خاص طور پر انہیں ایسا کرنے کی ہدایت کیے بغیر خطرناک کارروائیاں کرنے کے قابل ہیں۔ جہاں آپ چاہیں تازہ ترین ٹیک خبریں، ٹیلی کام کی بصیرتیں، اور پروڈکٹ لانچ حاصل کریں۔
ProPakistani کو ترجیحی ذرائع میں شامل کریں اور گوگل سرچ اور ٹاپ اسٹوریز میں ہماری مزید کہانیاں دیکھیں۔
ٹیکنالوجی اور آٹوموٹو ماہر جدید ترین کاروں، اسمارٹ فونز، AI پیش رفتوں، اور...
شیئرز