اینتھروپک نے جُمِرات کو کہا کہ اس کے کچھ کلاڈ اے آئی ماڈلز نے سائبرسیکیوریٹی ٹیسٹ کے دوران تین کمپنیوں کے سسٹمز میں ہیک کر لیا تھا، یہ انکشاف حریف اوپن اے آئی کے اس انکشاف کے چند دن بعد ہوا ہے کہ اس کے اے آئی ایجنٹوں میں سے ایک بدمعاش حملہ کر گیا تھا۔

نئے واقعات ایک غلطی کی وجہ سے ہوئے جس نے نادانستہ طور پر Anthropic کے ماڈلز کو کھلے انٹرنیٹ تک رسائی فراہم کی۔ یہ OpenAI سے متصادم ہے، جس کے AI ایجنٹ نے سائبر ٹیسٹنگ کے دوران انٹرنیٹ تک پہنچنے کے لیے آزادانہ طور پر ایک نئے خطرے کا فائدہ اٹھایا۔

اس کے باوجود، تازہ ترین انکشاف اس بات کی نشاندہی کرتا ہے کہ کس طرح AI نے سائبر سیکیورٹی کے لیے خطرات میں اضافہ کیا ہے اور اس کے ڈویلپرز اپنے ماڈلز کی صلاحیتوں کو برقرار رکھنے کے لیے کس طرح جدوجہد کر سکتے ہیں۔

ایک ایسے وقت میں جب اینتھروپک اور اوپن اے آئی اپنی منصوبہ بند عوامی فہرستوں سے پہلے زیادہ قابل نظام جاری کرنے کی دوڑ میں لگے ہوئے ہیں، AI سیکورٹی کے خطرات کو بہتر طریقے سے منظم کرنے کے لیے امریکی حکومت کی جانب سے زور پکڑنے کے لیے اس سے ایندھن کا اضافہ ہونے کا امکان ہے۔ ان لیبز کے ممتاز رہنماؤں نے پہلے خطرات سے نمٹنے کے لیے سست روی کا مطالبہ کیا ہے۔

سان فرانسسکو میں مقیم انتھروپک نے ایک بلاگ پوسٹ میں کہا کہ اس نے 141006 ٹیسٹ سیشنز کا جائزہ لینے کے بعد واقعات کی نشاندہی کی، یہ ایک ایسا عمل ہے جس کا آغاز اوپن اے آئی کے گزشتہ ہفتے یہ کہنے کے بعد کیا گیا تھا کہ اس کے AI ماڈلز سے چلنے والے ایک خود مختار ایجنٹ نے ایک ہیک کو متحرک کیا جس نے اسٹارٹ اپ Hugging Face کے بنیادی ڈھانچے سے سمجھوتہ کیا۔

سائبر ٹیسٹنگ کے دوران، Anthropic کے Claude ماڈلز کو بتایا گیا کہ ان کے پاس انٹرنیٹ تک رسائی نہیں ہے، لیکن ایک غلط فہمی جس میں Anthropic کے تشخیصی شراکت داروں میں سے ایک شامل تھا، نے عوامی ویب سے منسلک نظام کو چھوڑ دیا۔ اینتھروپک نے تنظیموں کا نام لیے بغیر کہا کہ اس نے تین تنظیموں کے نظام تک غیر مجاز رسائی کو قابل بنایا۔

اینتھروپک نے کہا، "کلاڈ نے بنیادی تکنیکوں کا استعمال کرتے ہوئے متاثرہ تنظیموں کے بنیادی ڈھانچے سے سمجھوتہ کیا، جیسے کمزور پاس ورڈز اور غیر تصدیق شدہ اینڈ پوائنٹس کا استحصال کرنا،" اینتھروپک نے کہا۔

جیفری لاڈیش، پالیسڈ ریسرچ کے ایگزیکٹو ڈائریکٹر، جو AI سسٹمز کی جارحانہ صلاحیتوں کا مطالعہ کرتے ہیں، نے کہا کہ انہیں شبہ ہے کہ AI کمپنیوں کی ایک رینج نے دوسرے واقعات کا تجربہ کیا ہے جن کا پتہ نہیں چل سکا ہے یا عوامی طور پر ظاہر نہیں کیا گیا ہے۔

"یہ صرف اور بھی خراب ہوتا جا رہا ہے کیونکہ ماڈلز زیادہ ہوشیار ہوتے جائیں گے۔ وہ دھوکہ دہی میں بہتر ہوں گے۔ وہ جھوٹ بولنے میں بہتر ہوں گے،" انہوں نے کہا۔

اینتھروپک نے کہا کہ واقعات - جن کو اس نے "آپریشنل ناکامی" کا لیبل لگایا ہے - تین الگ الگ ماڈلز شامل ہیں: کلاڈ اوپس 4.7، کلاڈ میتھوس 5 اور ایک اندرونی تحقیقی ٹیسٹ ماڈل۔ ابتدائی معاملات اپریل کے ہیں اور تشخیصی ماحول میں پیش آئے جن میں جان بوجھ کر حفاظتی اقدامات کی کمی تھی تاکہ انتھروپک اس بات کا اندازہ لگا سکے کہ اس کا AI کس قابل ہے۔

اس کے ماڈلز کو نام نہاد "کیپچر دی فلیگ" چیلنجز، خیالی منظرناموں کے ساتھ کام سونپا گیا تھا جس میں انہیں نقلی نیٹ ورکس میں چھپی ہوئی معلومات تلاش کرنی پڑتی تھیں۔

ایک واقعے میں، Claude Opus 4.7 کو ایک فرضی ٹارگٹ کمپنی دی گئی، جو حقیقی دنیا میں کاروبار کا نام بتانے کے لیے نکلی۔ اس کے بعد AI ماڈل نے ایسے کیڑے ڈھونڈے اور ان کا استحصال کیا جو اسے اسناد اور اس کاروبار کے ڈیٹا بیس تک رسائی دینے دیتے ہیں۔ AI سٹارٹ اپ نے کہا کہ Opus 4.7 نے اس بات کو منطقی طور پر پیش کیا کہ جو چیز حقیقی دنیا سے متعلق معلوم ہوتی ہے وہ انتھروپک کے بنائے گئے تخروپن کا حصہ تھی۔

ایک الگ واقعہ میں Anthropic کا نیا، غیر عوامی ٹیسٹ ماڈل شامل تھا، جس نے اپنے ہدف کو حقیقی ہونے کا احساس کرنے کے بعد آزادانہ طور پر اپنے حملے کو روک دیا۔ اس رویے نے اینتھروپک کو AI کو مناسب طریقے سے برتاؤ کرنے کے لیے اپنی پیش رفت کے بارے میں محتاط طور پر پر امید بنا دیا ہے، "لیکن ہمیں اس نتیجے پر اعتماد کرنے کے لیے مزید جانچ کرنے کی ضرورت ہوگی،" اس نے کہا۔

اینتھروپک نے کہا کہ اس نے 23 جولائی کو تمام سائبر تشخیص کو معطل کر دیا۔ اس نے 27 جولائی کو متاثرہ تنظیموں کو مطلع کیا، جن میں سے دو رابطہ کیے جانے سے پہلے اس سرگرمی سے لاعلم تھے۔ اینتھروپک نے کہا کہ وہ تیسری کمپنی تک پہنچنا جاری رکھے ہوئے ہے۔

اس کے تیسرے فریق کے تشخیصی شراکت داروں میں سے ایک، سائبرسیکیوریٹی لیب جسے Irregular کہتے ہیں، نے رائٹرز کو بتایا کہ اس کے پاس ان واقعات کی تحقیقات جاری ہیں۔

اینتھروپک نے کہا کہ یہ واقعات اندرونی اور فریق ثالث دونوں ٹیسٹنگ ماحول میں مضبوط کنٹرول کی ضرورت پر زور دیتے ہیں کیونکہ AI ماڈلز حقیقی دنیا کی سائبر سرگرمیاں انجام دینے کے قابل ہو جاتے ہیں۔

اسپیس ایکس کے سی ای او ایلون مسک نے، جو کہ ایک مسابقتی AI لیب چلاتا ہے، نے X پر خبروں کا جواب دیتے ہوئے کہا کہ "ایسا کثرت سے ہوتا رہے گا کیونکہ AI زیادہ ہوشیار اور زیادہ ایجنٹ ہوتا ہے،" کمپیوٹر پروگراموں یا "ایجنٹوں" کا حوالہ دیتے ہوئے جو محدود انسانی مداخلت کے ساتھ کام کرتے ہیں۔ OpenAI ایجنٹ جو Hugging Face میں داخل ہوا، ایک پلیٹ فارم جسے ڈویلپرز AI ماڈلز کی میزبانی اور تعاون کرنے کے لیے استعمال کرتے ہیں، ایک دن تک ہیکنگ کا سلسلہ جاری رکھا جسے OpenAI نے اس وقت تک پکڑا نہیں جب تک خطرہ موجود نہیں تھا اور FBI کو مطلع کیا گیا تھا۔

اوپن اے آئی کے سی ای او سیم آلٹمین نے اس ہفتے کہا کہ اس نے کیپیٹل ہل پر سینیٹرز کے ساتھ ہیک کے بارے میں بات کی ہے، اور اوپن اے آئی کے ترجمان نے کہا کہ وہ وائٹ ہاؤس کے ساتھ آنے والے اے آئی ماڈلز اور ٹیسٹنگ پر بات کرنے کا ارادہ رکھتے ہیں۔

واشنگٹن نے نئے ماڈل کے رول آؤٹس کی نگرانی کو سخت کرنا شروع کر دیا ہے۔ 2 جون کو، امریکی صدر ڈونلڈ ٹرمپ نے مشیروں کو ہدایت کی کہ وہ جدید ترین AI کے لیے رضاکارانہ سائبر سیکیورٹی ٹیسٹنگ فریم ورک تیار کریں، بشمول ٹیکنالوجی کے ڈویلپرز کے ان پٹ۔

اینتھروپک نے اس سے قبل اپنے Fable 5 اور Mythos 5 ماڈلز تک رسائی کو محدود کر دیا تھا جب امریکہ نے قومی سلامتی کے خدشات کا حوالہ دیتے ہوئے عارضی طور پر برآمدی کنٹرول کی ہدایت جاری کی تھی۔