OpenAI نے مَنگَل کو اعتراف کیا کہ اس کے AI ماڈلز میں سے ایک نے اندرونی سائبرسیکیوریٹی ٹیسٹ کے دوران Hugging Face کے سسٹمز کی خلاف ورزی کی جو خراب ہو گئی۔ گلے ملنے والے چہرے نے ابتدائی طور پر اس خلاف ورزی کو "بیرونی AI ایجنٹ" سے منسوب کیا۔

مَنگَل کی سہ پہر شائع ہونے والی ایک بلاگ پوسٹ میں، OpenAI نے ان اقدامات کی تفصیل دی جس کی وجہ سے ماڈلز نے سروس سے سمجھوتہ کیا۔

"تحقیقات کے بعد، اب ہم جان گئے ہیں کہ یہ خاص واقعہ OpenAI ماڈلز کے مجموعے کے ذریعے کارفرما تھا - بشمول GPT-5.6 Sol اور اس سے بھی زیادہ قابل پری ریلیز ماڈل، سبھی تشخیصی مقاصد کے لیے کم سائبر انکار کے ساتھ - جبکہ اندرونی طور پر سائبر صلاحیتوں کے ایک معیار پر جانچا جا رہا تھا،" پوسٹ پڑھتی ہے۔

خاص طور پر، ایسا لگتا ہے کہ خلاف ورزی نے ExploitGym پر توجہ مرکوز کی ہے، جو کہ عوامی طور پر میزبانی کرنے والے بینچ مارک کی پیمائش کرنے والے ماڈلز کی موجودہ کمزوریوں کی بنیاد پر حملوں کو انجام دینے کی صلاحیت ہے۔ ExploitGym جیسے بینچ مارکس کو عام طور پر ماڈل ٹریننگ میں مخصوص مہارتوں کو نکھارنے کے لیے استعمال کیا جاتا ہے، لیکن یہ پہلا معلوم واقعہ ہے جس میں اس ٹیسٹنگ کے نتیجے میں ایک حقیقی سائبر حملہ ہوا۔

اس معاملے میں، زیر بحث ماڈل کے پاس انٹرنیٹ تک رسائی بھی نہیں ہونی چاہیے، کسی مخصوص ٹول کے باہر جس نے ماڈلز کو سافٹ ویئر پیکجز کو انسٹال کرنے کے قابل بنایا ہو تاکہ انہیں اپنا کام مکمل کرنے کی ضرورت ہو۔ اس کے بجائے، ماڈل پیکیج-انسٹالر پروگرام میں ایک نامعلوم خطرے کو تلاش کرنے کے قابل تھا، جسے وہ اپنی مرضی سے وسیع تر انٹرنیٹ تک رسائی کے لیے استعمال کرتا تھا۔

اوپن اے آئی کی پوسٹ پڑھتی ہے، "ماڈلز کو ایکسپلوٹ جیم کے لیے حل تلاش کرنے پر زیادہ توجہ مرکوز کی گئی تھی، جو کہ ٹیسٹنگ کے ایک تنگ ہدف کو حاصل کرنے کے لیے انتہائی حد تک جا رہے تھے۔" "انٹرنیٹ تک رسائی حاصل کرنے کے بعد، ماڈلز نے اندازہ لگایا کہ Hugging Face نے ممکنہ طور پر ExploitGym کے لیے ماڈلز، ڈیٹا سیٹس اور حل کی میزبانی کی ہے۔ یہ جاننے کے بعد، ماڈل نے خفیہ معلومات تک رسائی حاصل کرنے کے طریقے تلاش کیے اور کامیابی کے ساتھ تلاش کیے جنہیں وہ تشخیص کو دھوکہ دینے کے لیے استعمال کر سکتا ہے۔"

بالآخر، ماڈلز کو Hugging Face کے بنیادی ڈھانچے میں کمزوریاں ملیں جس کی وجہ سے وہ "Hugging Face کے پروڈکشن ڈیٹا بیس سے براہ راست ٹیسٹ کے حل حاصل کر سکتے ہیں،" مؤثر طریقے سے بینچ مارک کے جوابات فراہم کرتے ہیں۔

Hugging Face کے لیے، بظاہر نتیجہ ایک نفیس اور جارحانہ سائبر اٹیک تھا، جس میں "قلیل المدت سینڈ باکسز کے ایک بھیڑ میں ہزاروں انفرادی کارروائیاں، عوامی خدمات پر خود ساختہ کمانڈ اینڈ کنٹرول کے ساتھ،" جیسا کہ کمپنی نے اپنے ابتدائی انکشاف میں کہا۔

OpenAI نے پیکیج انسٹالر میں موجود کمزوریوں کی نشاندہی کی ہے اور اس کی اطلاع دی ہے اور اس واقعے کی مزید تحقیقات کے لیے Hugging Face کے ساتھ کام کر رہا ہے۔ کمپنی نے یہ بھی کہا کہ وہ ماڈل ٹیسٹنگ اور متعلقہ انفراسٹرکچر دونوں پر نئے کنٹرول نافذ کرے گی، جس کا مقصد مستقبل میں ایسے ہی واقعات کو روکنا ہے۔

یہ واضح نہیں ہے کہ آیا خلاف ورزی کے نتیجے میں OpenAI کو کسی قانونی نتائج کا سامنا کرنا پڑے گا، حالانکہ اس بات کا امکان ہے کہ ماڈلز کے اقدامات نے کمپیوٹر فراڈ اینڈ ابیوز ایکٹ کی خلاف ورزی کی ہو۔

بہر حال، نتیجہ طویل وقت کے افق پر کام کرنے والے فرنٹیئر AI ماڈلز کی طاقت اور خطرات کی غیر معمولی طور پر واضح مثال ہے۔ جیسا کہ اوپن اے آئی کے محقق میکاہ کیرول نے اس خبر کے جواب میں پوسٹ کیا، "اگر یہ آپ کو اس بات پر قائل نہیں کرتا ہے کہ آگے بڑھتے ہوئے غلط خطوط کے خطرات ایک اہم تشویش کا باعث بنیں گے، تو مجھے نہیں معلوم کہ کیا ہوگا۔"