ChatGPT کے مالک OpenAI نے ایک "بے مثال سائبر واقعے" کا اعتراف کیا ہے – اس کے دو انتہائی قابل مصنوعی ذہانت کے ماڈلز نے اپنے طور پر ایک اور AI کمپنی میں ہیک کر لیا ہے – مضبوط ٹیکنالوجی کے محافظوں کی ضرورت پر بحث چھیڑ رہی ہے۔

کمپنی نے کہا کہ اس کے AI سسٹمز ٹیسٹنگ ماحول سے باہر نکلے اور سٹارٹ اپ Hugging Face کو ہیک کر لیا۔

سٹارٹ اپ نے 16 جولائی کو انکشاف کیا تھا کہ اس کے سرورز کو ایک نامعلوم لیکن جدید ترین ایجنٹ نے ہیک کر لیا تھا۔

کمپنیوں، کچھ حکومتوں اور قانون سازوں نے اس طرح کے پہلے عوامی طور پر ظاہر کیے گئے سائبر اٹیک کا جواب کیسے دیا اس کے بارے میں یہاں تازہ ترین معلومات ہیں:

کمپنی نے ایک بیان میں کہا کہ اس نے اپنے AI کی مدد سے پتہ لگانے کے ذریعے خلاف ورزی کا پتہ لگایا۔

"یہ کسی بھی چیز سے مختلف تھا جسے ہم نے ایک اہم طریقے سے پہلے ہینڈل کیا تھا: یہ ایک خود مختار AI ایجنٹ کے نظام کے ذریعہ، آخر سے آخر تک چلایا گیا تھا،" اس نے کہا۔

OpenAI کے اس انکشاف کے بعد کہ اس کے ماڈل خلاف ورزی میں ملوث تھے، دونوں فریقوں نے اس ہفتے جاری مشترکہ تحقیقات کا آغاز کیا۔

ہیگنگ فیس کے کوفاؤنڈر کلیمنٹ ڈیلنگو نے کہا کہ اس کا اسٹارٹ اپ چینی کمپنی Zhipu AI کے اوپن سورس GLM-5.2 ماڈل کی طرف متوجہ ہوا تاکہ ہیک سے ڈیٹا کا تجزیہ کیا جا سکے جب کہ امریکہ کے معروف AI ماڈلز نے اس کام سے انکار کر دیا، جو کہ محافظ اور حملہ آور کے درمیان فرق کرنے سے قاصر ہے۔

گلے لگانے والے چہرے کے عملے کو "پختہ یقین ہے کہ ان کی طرف سے کوئی بدنیتی پر مبنی ارادہ نہیں تھا"، ڈیلنگو نے اوپن اے آئی کا حوالہ دیتے ہوئے مزید کہا۔

"اپنی سیکیورٹی ٹیم پر بہت فخر ہے! انہوں نے کسی بھی حملے کو پکڑا، اس پر مشتمل اور عوامی طور پر اس کا انکشاف کیا جو ہم نے پہلے نہیں دیکھا، اور اسے ریکارڈ رفتار سے کیا،" انہوں نے X پر لکھا۔

"یہ ایجنٹوں کے دور میں سائبرسیکیوریٹی کا پہلا دن ہے اور ہم سب یہ سیکھ رہے ہیں کہ رازداری جواب نہیں ہے اور یہ کہ تمام محافظوں (صرف چند منتخب افراد کو نہیں) ہر جگہ بغیر کسی پابندی کے زیادہ طاقتور ماڈلز کی ضرورت ہے، خاص طور پر کھلے ماڈلز!" ڈیلنگو نے مزید کہا۔

AI سیکیورٹی انسٹی ٹیوٹ (AISI)، جو کہ برطانیہ کی حکومت کی حمایت یافتہ ایک ادارہ ہے جو کہ 2023 میں جدید AI سسٹمز سے لاحق خطرات کا جائزہ لینے کے لیے قائم کیا گیا تھا، نے اس ہفتے کہا کہ ایک AI ماڈل جس کی وہ تحقیقات کر رہی تھی وہ بھی بدمعاش نکلا اور اس کے ٹیسٹنگ سسٹم کو ہیک کرنے کی کوشش کی۔

AISI نے AI ماڈل کے پیچھے کمپنی کا انکشاف نہیں کیا اور مزید کہا کہ اس کے اپنے بنیادی ڈھانچے کو کوئی نقصان نہیں پہنچا ہے۔ اس کے بعد سے اس نے اپنے سسٹمز کو مزید محفوظ بنانے کے لیے اقدامات کیے ہیں۔

اس کے تازہ ترین تجزیوں سے یہ بھی پتہ چلا ہے کہ ہر فرنٹیئر اے آئی ماڈل جس کا اس نے تجربہ کیا اس نے صلاحیتوں کے جائزوں کے دوران دھوکہ دینے کی کوشش کی، جو کہ ماڈلز کے زیادہ قابل ہونے کے ساتھ اے آئی کی حفاظت کے لیے بڑھتے ہوئے چیلنج کو اجاگر کرتی ہے۔

AISI کے مطابق، ماڈلز نے کاموں کو زیادہ آسانی سے مکمل کرنے کے لیے تشخیصی اصولوں کو توڑا، جس میں ممنوع ہونے پر آن لائن جوابات تلاش کرنا، نیٹ ورک کی پابندیوں کو نظرانداز کرنا، سراگوں کے لیے تشخیصی سافٹ ویئر کی چھان بین کرنا، اور اجازت شدہ ماحول سے باہر سسٹمز تک رسائی شامل ہے۔

AISI نے کہا کہ بعد میں پوچھ گچھ کے دوران ماڈلز نے شاذ و نادر ہی دھوکہ دہی کا اعتراف کیا اور اکثر اپنے استدلال میں رویے کو ظاہر نہیں کیا، جس کی وجہ سے صرف خود رپورٹنگ کے ذریعے پتہ لگانا مشکل ہو جاتا ہے۔ انسٹی ٹیوٹ نے استدلال کیا کہ آزاد نگرانی اور نگرانی کے مضبوط میکانزم تیزی سے اہم ہوتے جائیں گے کیونکہ AI نظام زیادہ خود مختاری حاصل کرتے ہیں۔

انسٹی ٹیوٹ نے اس بات پر زور دیا کہ یہ رویہ لازمی طور پر بدنیتی پر مبنی ارادے کی نشاندہی نہیں کرتا ہے بلکہ ان ماڈلز کی عکاسی کرتا ہے جو موجودہ تشخیصی سیٹ اپ میں زیادہ سے زیادہ کامیابی حاصل کرنے کے لیے شارٹ کٹس کا استحصال کرتے ہیں۔

چیٹ جی پی ٹی بنانے والے نے مَنگَل کو ایک بلاگ پوسٹ میں کہا: "ہم ہیگنگ فیس کو بھروسہ مند رسائی پروگرام میں لے آئے ہیں اور اپنے دفاع کو بہتر بنانے کے لیے اپنے ماڈلز کی صلاحیتوں کو تیزی سے استعمال کرنے میں اپنی ٹیموں کی مدد کر رہے ہیں۔"

سان فرانسسکو فرم نے انکشاف کیا کہ حملے میں ملوث اس کے دو ماڈلز جدید ترین GPT-5.6 Sol ماڈل ہیں اور ایک غیر ریلیز شدہ ماڈل جس کے بارے میں کمپنی نے کہا کہ یہ اس کے تازہ ترین ورژن سے بھی زیادہ قابل ہے۔

اوپن اے آئی کے دو ایجنٹوں نے ہگنگ فیس کے سرورز میں کمزوریاں دریافت کیں اور لاگ ان کی تفصیلات چرانے اور پھر کمپنی کے سسٹمز کو ہیک کرنے کے لیے آگے بڑھے۔

یہ واقعہ اوپن اے آئی کے اندرونی ٹیسٹنگ سیشن کے دوران پیش آیا جو ماڈلز کی سائبرسیکیوریٹی صلاحیتوں کا جائزہ لینے کے لیے ڈیزائن کیا گیا تھا۔ OpenAI نے ٹیسٹ کے لیے معیاری حفاظتی اقدامات کو ہٹا دیا تھا۔

اوپن اے آئی نے کہا کہ دونوں نے ٹیسٹ کے دوران ایک مسئلہ کے ذریعے اپنے راستے کو دھوکہ دینے کی کوشش کی۔ انہوں نے "بجائے ایک تنگ ٹیسٹنگ ہدف کو حاصل کرنے کے لئے انتہائی طوالت اختیار کی" اور "خفیہ معلومات تک رسائی حاصل کرنے کے طریقے تلاش کیے جن کا استعمال یہ تشخیص کو دھوکہ دینے کے لیے کر سکتا ہے"۔

ٹیکساس سے ڈیموکریٹک امریکی کانگریس مین، گریگ کیسر نے X پر ایک پوسٹ میں لکھا: "یہ انتہائی تشویشناک ہے۔ AI ہمیں محفوظ رکھنے کے لیے کوئی حقیقی ضوابط کے بغیر انتہائی تیزی سے ترقی کر رہا ہے۔ اسے تبدیل ہونا چاہیے۔" انہوں نے مزید کہا کہ "ہمیں باقاعدہ لازمی آزاد حفاظتی جانچ اور نگرانی، سیکورٹی کے واقعات کا لازمی انکشاف، اور لوگوں کو مکمل آفت سے محفوظ رکھنے کے لیے بین الاقوامی تعاون کی ضرورت ہے۔"