چینی کمپنی مون شاٹ کا بنایا ہوا جدید ترین AI ماڈل Kimi K3 اپنی سائبر صلاحیتوں کو جانچنے کے لیے بنائے گئے ماحول سے بچ گیا، محققین نے جُمُعَہ کو شائع ہونے والے ایک بلاگ پوسٹ میں کہا۔

خبر ایک بار پھر ظاہر کرتی ہے کہ کمپنیاں اور آزاد تنظیمیں ہیکنگ کے لیے بنائے گئے اپنے AI ماڈلز کو رکھنے کے لیے جدوجہد کر رہی ہیں۔

حالیہ ہفتوں میں، امریکی مصنوعی ذہانت کی لیبز OpenAI اور Anthropic، Meta کے ساتھ ساتھ U.K. کے AI سیکیورٹی انسٹی ٹیوٹ میں فرنٹیئر LLMs، سبھی مختلف طریقوں سے ٹیسٹنگ ماحول سے بچ گئے اور حقیقی اہداف کو ہیک کرنا ختم کیا جو تجربے کا حصہ نہیں تھے۔ ایسا اکثر ہونا شروع ہو رہا ہے اب ایک ویب سائٹ ہے جو ان تمام واقعات کا سراغ لگاتی ہے جسے Felony Bench کہتے ہیں، اس حقیقت کی طرف اشارہ ہے کہ یہ LLM جرم کر رہے ہیں - کم از کم نظریاتی طور پر۔

اس Kimi ٹیسٹ کے معاملے میں، تجربہ پر مشتمل سینڈ باکس کو مناسب طریقے سے ترتیب نہیں دیا گیا تھا۔ جب کہ سینڈ باکس نے AI ماڈل کو مخصوص ویب ٹریفک تک رسائی کی اجازت نہیں دی، اس کے بجائے ماڈل نے کمانڈ لائن ٹولز پر انحصار کرتے ہوئے سینڈ باکس کو نظرانداز کیا، محققین AI پر مرکوز سائبر سیکیورٹی فرم فرنٹیئر سیکیورٹی کے مطابق۔

محققین نے لکھا، "اس سے پتہ چلتا ہے کہ سائبرسیکیوریٹی کے بارے میں کچھ تشخیصات جو کمیونٹی استعمال کرتی ہیں وہ سیکیورٹی کے خطرات کا شکار ہیں اور ماڈلز کو دھوکہ دینے کی اجازت دیتے ہیں، اور یہ کہ ایسے ماڈلز ہیں جو جان بوجھ کر خامیاں اور کمزوریاں تلاش کرتے ہیں جو انہیں تشخیص میں دھوکہ دینے کی اجازت دیتے ہیں،" محققین نے لکھا۔

اگر آپ گھر پر اسکور رکھ رہے ہیں، فیلونی بنچ کی تعداد کے مطابق، مون شاٹ اب OpenAI اور Anthropic کے ساتھ شامل ہوتا ہے، جس میں ہر ایک میں سات ریکارڈ شدہ واقعات ہیں، اور Meta، جس میں ایک ہے۔