چینی AI سٹارٹ اپ Z.ai نے جُمُعَہ کے روز کہا کہ اس کا اوپن سورس GLM-5.3 ماڈل سافٹ ویئر کی کمزوریوں کی نشاندہی کرنے میں Anthropic کے محدود Mythos 5 کے قریب پہنچ گیا ہے، جس سے مغربی ڈویلپرز کے درمیان کرشن حاصل کرنے والے چینی AI چیلنجر کی اسناد کو تقویت ملی ہے۔
Z.ai نے کہا کہ GLM-5.3 نے CyberGym پر 84.5 فیصد اسکور کیا، یہ ٹیسٹ کہ آیا کوئی ماڈل کوڈ کا جائزہ لے سکتا ہے، حفاظتی خامیوں کی نشاندہی کرسکتا ہے اور تصدیق کرسکتا ہے کہ وہ حقیقی ہیں۔ یہ Mythos 5 کے لیے رپورٹ کردہ 83.8pc سے تھوڑا زیادہ تھا۔ نتائج کی آزادانہ طور پر تصدیق نہیں کی گئی ہے۔
GLM-5.3 دریافت شدہ خامیوں کو ورکنگ حملوں میں تبدیل کرنے میں Mythos 5 سے پیچھے رہ گیا، جو دفاعی حفاظتی تحقیق کا ایک معیاری حصہ ہے۔ Z.ai نے کہا کہ اس کے ماڈل نے اس صلاحیت کے ExploitBench ٹیسٹ میں 54.4pc اسکور کیے، بمقابلہ Mythos 5 کے لیے 78.0pc۔ ایک الگ وقتی ٹیسٹ میں، Z.ai نے کہا کہ GLM-5.3 نے دو گھنٹے میں 105 حملہ ترقی کے کام مکمل کیے اور چھ گھنٹے میں 130۔ Mythos 5 نے بالترتیب 181 اور 247 کام مکمل کیے۔
Anthropic نے Mythos بنا دیا ہے، جو اس کے Claude Fable 5 ماڈل کا ایک ورژن ہے جس میں سائبر سیکیورٹی کے تحفظات کو ہٹا دیا گیا ہے، جو صرف جانچ شدہ تنظیموں کے لیے دستیاب ہے۔ اس طرح کے کنٹرول اس تشویش کی عکاسی کرتے ہیں کہ سافٹ ویئر کی خامیوں کو تلاش کرنے اور ان کا استحصال کرنے کے قابل AI سسٹم محافظوں کی مدد کر سکتے ہیں لیکن حملہ آوروں کے لیے رکاوٹیں بھی کم کر سکتے ہیں۔
Z.ai نے کہا کہ یہ GLM-5.3 کو سیکیورٹی کے جائزے مکمل کرنے اور اس کے تحفظات کو مضبوط کرنے کے بعد تقریباً دو ہفتوں میں عوامی طور پر جاری کرے گا۔ اس نے کہا کہ اس کے انتہائی حساس سائبرسیکیوریٹی افعال صرف تصدیق شدہ صارفین کے لیے "قابل اعتماد رسائی" پروگرام کے ذریعے دستیاب ہوں گے۔
اس نے فرائیڈے X پوسٹ میں لکھا ہے کہ ابتدائی ماڈل تک رسائی کا اشتراک لانچ پارٹنرز کے ایک منتخب گروپ کے ساتھ کیا جائے گا، جسے بعد میں "ایک مستقل اور ذمہ دارانہ عمل کے ذریعے" بڑھایا جائے گا، جو کہ Mythos کے لیے Anthropic کی "Project Glasswing" کی محدود رسائی اسکیم کی زبان سے گونجتا ہے۔
"میری بہترین معلومات کے مطابق، یہ پہلا موقع ہے جب کوئی چینی لیب عوامی طور پر حفاظتی تحفظات کے ساتھ ماڈل وزن کی تاخیر سے جاری ہونے کا جواز پیش کر رہی ہے،" بیجنگ میں AI حفاظت پر توجہ مرکوز کرنے والی کنکورڈیا AI کے AI گورننس کے محقق گیبریل ویگنر نے کہا۔
"یہ ظاہر کرتا ہے کہ چین میں کھلے وزن کے خطرے کے انتظام کے طریقے زیادہ نفیس ہوتے جا رہے ہیں۔" کمپنی نے کہا کہ اس نے GLM-5.3 میں تحفظ کی کئی پرتیں شامل کی ہیں، بشمول پرخطر درخواستوں کو اسکرین کرنے کے لیے سسٹمز، ماڈل کے کام کی نگرانی کرنا اور اسے بدنیتی پر مبنی کاموں کو مسترد کرنے کی تربیت دینا۔
اس میں کہا گیا ہے کہ یہ نقصان دہ سرگرمی کو جائز استعمال سے ممتاز کرنے کے لیے ڈیزائن کیے گئے تھے جیسے کیڑے ٹھیک کرنا، سائبر سیکیورٹی کی تعلیم دینا یا مجاز سیکیورٹی ٹیسٹنگ۔
لیکن ناقدین کا کہنا ہے کہ ان حفاظتی اقدامات کو نافذ کرنا مشکل ہو جاتا ہے جب ایک ماڈل دوسروں کے لیے ڈاؤن لوڈ، تبدیل کرنے یا بیرونی ٹولز کے ساتھ جوڑنے کے لیے جاری کیا جاتا ہے۔
Z.ai نے لانچ کو محدود رسائی والے ماڈل کے لیے چیلنج کے طور پر تیار کیا جس کی نمائندگی Mythos کے ذریعے کی گئی ہے۔ اس نے استدلال کیا کہ سائبر ڈیفنس کے جدید ٹولز اوپن سورس سافٹ ویئر کے ڈویلپرز اور چھوٹی سیکیورٹی ٹیموں کے لیے دستیاب ہونے چاہئیں، بجائے اس کے کہ محدود تعداد میں بند ماڈل فراہم کنندگان کے زیر کنٹرول ہوں۔
اس نے کہا کہ یہ منتخب اوپن سورس پروجیکٹس کے آڈٹ کے لیے ایک "اوپن سورس شیلڈ" پہل شروع کرے گا، دفاعی کام کے لیے ماڈل تک رسائی فراہم کرے گا اور اس کے ZCode پروگرامنگ پروڈکٹ میں کوڈ آڈیٹنگ کے افعال کو شامل کرے گا۔
ویگنر نے Mythos تک رسائی کے ساتھ مغربی کمپنیوں کے کنسورشیم کا حوالہ دیتے ہوئے کہا، "اس جذبے میں، Z.ai چینی خصوصیات کے ساتھ ایک قسم کا 'Project Glasswing' تجویز کر رہا ہے جو کھلے پن کو خرابی کے بجائے ایک اثاثہ کے طور پر دیکھتا ہے۔" نیویارک میں قائم AI سٹارٹ اپ Hugging Face نے گزشتہ ماہ کہا تھا کہ اس نے Z.ai کے پچھلے ماڈل GLM-5.2 کو ایک بدمعاش OpenAI ایجنٹ کے سائبر حملے کے خلاف دفاع کے لیے استعمال کیا جو اس کے سسٹمز میں داخل ہوا۔
Z.ai پہلی چینی کمپنی نہیں ہے جس نے Mythos کے جواب کے طور پر کسی پروڈکٹ کو پوزیشن میں رکھا ہے۔ سائبرسیکیوریٹی فرم 360 نے جون میں کہا تھا کہ اس کے Tulongfeng vulnerability-Discovery سسٹم نے AI ماڈلز کو سیکیورٹی ڈیٹا اور خودکار ٹولز کے ساتھ ملا کر Mythos کے مساوی صلاحیتیں حاصل کی ہیں، حالانکہ ان دعوؤں کی آزادانہ طور پر تصدیق نہیں کی گئی تھی۔
GLM-5.3 اس میں مختلف ہے کہ یہ ایک عام مقصد کا کوڈنگ ماڈل ہے جس کے بارے میں Z.ai کا کہنا ہے کہ ایک مقصد سے بنائے گئے حفاظتی نظام کے بجائے توسیعی پوسٹ ٹریننگ اور کمک سیکھنے کے ذریعے سائبر سیکیورٹی کی صلاحیتیں حاصل کیں۔ کمپنی نے کہا کہ اس نے GLM-5.2 جیسا ہی بیس ماڈل استعمال کیا لیکن اسے طویل اور مختلف کام کے ماحول میں تربیت دی۔
لانچ GLM-5.2 میں عالمی دلچسپی پر مبنی ہے، جس نے حالیہ مہینوں میں کوڈنگ اور ایجنٹ کی صلاحیتوں کے لیے بیرون ملک مقیم ڈویلپرز کی توجہ حاصل کی جس کے بارے میں صارفین اور تجزیہ کاروں نے کہا کہ وہ معروف امریکی ماڈلز سے رابطہ کرتے ہیں لیکن بہت کم قیمت پر۔