SaferAI نے پایا ہے کہ ایک سرکردہ چینی AI ماڈل نے خطرناک سائبر سیکیورٹی اور حیاتیاتی کاموں کو ان میں سے کسی سے انکار کیے بغیر مکمل کیا، جس سے جدید چینی AI نظاموں میں حفاظتی تحفظات کی تاثیر کے بارے میں تازہ خدشات پیدا ہوئے۔

آزادانہ تشخیص سے پتہ چلا کہ Zhipu AI کا کھلا وزن GLM-5.2 جارحانہ حفاظتی اور حیاتیاتی درخواستوں کو انجام دینے کے لیے تیار تھا جبکہ مغربی ماڈلز کو نقصان دہ ہیرا پھیری کی طرف لے جانے سے زیادہ حساس ثابت ہوتا ہے۔ محققین نے متنبہ کیا کہ نتائج بڑھتے ہوئے حفاظتی خدشات کو اجاگر کرتے ہیں کیونکہ چینی AI ماڈلز ریاستہائے متحدہ کے حریفوں کے ساتھ صلاحیت کے فرق کو تیزی سے ختم کرتے ہیں۔

یورپی غیر منافع بخش نے Zhipu AI کے ساتھ ہم آہنگی کے بغیر GLM-5.2 کا تجربہ کیا۔ اس نے ماڈل کا موازنہ OpenAI کے GPT-5.5 اور Anthropic کے Claude Opus 4.7 کے ساتھ کیا جس میں کنٹرول کے نقصان، سائبر جرم، حیاتیاتی خطرہ، اور نقصان دہ ہیرا پھیری، چار نظامی خطرے والے علاقے جو یورپی یونین کے عمومی مقصد کے AI کوڈ آف پریکٹس میں شامل ہیں۔

SaferAI نے اندازہ لگایا کہ GLM-5.2 سائبر جرم اور حیاتیاتی صلاحیتوں میں معروف مغربی ماڈلز سے صرف دو سے چار ماہ پیچھے ہے۔

CyBench پر، جو کیپچر دی فلیگ سائبرسیکیوریٹی چیلنجز کا استعمال کرتا ہے، GLM-5.2 نے 34 میں سے 29 ٹیسٹ شدہ کاموں کو مکمل کیا۔ اس کی کارکردگی Claude Opus 4.7 جیسی تھی اور GPT-5.5 کے قریب تھی، جس نے 31 کام مکمل کیے تھے۔

ماڈل نے خفیہ نگاری، ویب سیکیورٹی، ریورس انجینئرنگ، فرانزک، اور بائنری استحصال میں بھرپور کارکردگی کا مظاہرہ کیا۔ Claude اور GPT ماڈلز کے کچھ ٹیسٹوں کے برعکس، GLM-5.2 نے مواد کے فلٹرز کو متحرک کیے بغیر ان کاموں کو مکمل کیا۔

CyberGym، حقیقی سافٹ ویئر کی کمزوریوں کو دوبارہ تیار کرنے پر مبنی ایک بینچ مارک، نے ظاہر کیا کہ ماڈل کی صلاحیت کا بہت زیادہ انحصار انفرنس کمپیوٹ کی دستیاب مقدار پر ہے۔

دو ملین ٹوکن والے بجٹ کے ساتھ، GLM-5.2 نے 36.6% آزمائشی کمزوریوں کو دوبارہ پیش کیا۔ اس کی کامیابی کی شرح 76.2% تک بڑھ گئی جب بجٹ 50 ملین ٹوکن تک بڑھ گیا، GPT-5.5 کے 88% نتائج کے قریب پہنچ گیا۔

نتائج UK AI سیکیورٹی انسٹی ٹیوٹ کے اس موقف کی تائید کرتے ہیں کہ سائبر کی صلاحیت ایک مقررہ سکور نہیں ہے اور زیادہ تخمینہ وقت اور حساب کے ساتھ نمایاں طور پر بڑھ سکتی ہے۔

اپنی تکنیکی صلاحیتوں سے ہٹ کر، SaferAI نے پایا کہ GLM-5.2 نے کسی بھی جارحانہ حفاظت یا حیاتیاتی کام سے انکار نہیں کیا۔ یہ موازنہ ماڈلز کے مقابلے میں صارفین کو سازش سے متعلق اور کنٹرول کو کمزور کرنے والے موضوعات پر قائل کرنے کے لیے بھی زیادہ تیار تھا اور دباؤ کے تحت نقصان دہ اقدامات کی طرف دھکیل سکتا تھا۔

محققین نے کہا کہ ماڈل کی کھلے وزن کی رہائی خطرے کی ایک اور تہہ میں اضافہ کرتی ہے۔ جبکہ Zhipu AI اپنے آفیشل API کے ذریعے فلٹرز اور مانیٹرنگ کا اطلاق کر سکتا ہے، لیکن ماڈل کو آزادانہ طور پر چلانے والے صارفین ان حفاظتی اقدامات، سسٹم پرامپٹس اور اکاؤنٹ کی سطح کے کنٹرول کو ہٹا سکتے ہیں۔

تشخیص سے پتہ چلتا ہے کہ اگلی بڑی ریگولیٹری بحث اس بات پر کم توجہ مرکوز کر سکتی ہے کہ آیا چینی AI ماڈل مغربی سسٹمز سے مماثل ہیں اور زیادہ اس بات پر کہ آیا طاقتور اوپن ویٹ ماڈلز کو محفوظ طریقے سے جاری کیا جا سکتا ہے جب ان کے تحفظات کو مزید نافذ نہیں کیا جا سکتا۔

جہاں آپ چاہیں تازہ ترین ٹیک خبریں، ٹیلی کام کی بصیرتیں، اور پروڈکٹ لانچ حاصل کریں۔

ProPakistani کو ترجیحی ذرائع میں شامل کریں اور گوگل سرچ اور ٹاپ اسٹوریز میں ہماری مزید کہانیاں دیکھیں۔

ٹیکنالوجی اور آٹوموٹو ماہر جدید ترین کاروں، اسمارٹ فونز، AI پیش رفتوں، اور...

شیئرز