ویرا کوڈ کی 2026 GenAI کوڈ سیکیورٹی رپورٹ کے مطابق، AI ماڈلز تحریری کوڈ میں انتہائی قابل اعتماد ہو گئے ہیں، لیکن وہ اب بھی تقریباً نصف معاملات میں بنیادی حفاظتی ٹیسٹوں میں ناکام ہو رہے ہیں۔
ویرا کوڈ نے چار ٹیسٹنگ راؤنڈز میں 100 سے زیادہ AI ماڈلز کا تجربہ کیا۔ سیکیورٹی پاس کی اوسط شرح صرف 56% تک پہنچ گئی، جو پچھلے سال ریکارڈ کیے گئے 55% سے بمشکل زیادہ ہے۔ اس کے برعکس، ماڈل اب تقریباً ہر بار مصنوعی طور پر درست، مرتب کرنے والا کوڈ تیار کرتے ہیں۔
ویرا کوڈ کے حوالے سے اعداد و شمار کے مطابق، یہ مسئلہ زیادہ اہم ہوتا جا رہا ہے کیونکہ AI اب تمام کمٹڈ کوڈ کا تقریباً نصف تیار کرتا ہے۔ اس کا مطلب ہے کہ سیکیورٹی کی ناکامی کی شرح بڑی حد تک کوئی تبدیلی نہیں آئی ہے جبکہ AI تحریری سافٹ ویئر کی مقدار میں تیزی سے اضافہ ہوا ہے۔
رپورٹ میں پتا چلا کہ پروگرامنگ کے لیے خاص طور پر ڈیزائن کیے گئے ماڈلز عام مقصد کے اے آئی ماڈلز سے زیادہ محفوظ نہیں تھے۔
کوڈنگ پر توجہ مرکوز کرنے والے ماڈلز میں اوسطاً 51% سیکیورٹی پاس کی شرح ہے، اس کے مقابلے میں عام مقصد والے ماڈلز کے لیے 52%۔ بڑے ماڈلز نے بھی بہت کم فائدہ دکھایا، بڑے ماڈلز کی اوسط 53% تھی، جب کہ درمیانے اور چھوٹے ماڈل دونوں نے 51% اسکور کیا۔
استدلال کے ماڈلز نے بہتر کارکردگی کا مظاہرہ کیا، غیر معقول ماڈلز کے لیے 51% کے مقابلے میں اوسطاً 56%۔ ویرا کوڈ نے تجویز کیا کہ حتمی جواب تیار ہونے سے پہلے اضافی استدلال کے اقدامات اندرونی کوڈ کے جائزے کی طرح کام کر سکتے ہیں۔
OpenAI کا GPT-5.5 68% سیکورٹی پاس ریٹ کے ساتھ تازہ ترین ٹیسٹ میں پہلے نمبر پر ہے۔
ٹیسٹ کیے گئے 11 میں سے چھ ماڈلز نے 50% اور 53% کے درمیان اسکور کیا، جبکہ Alibaba کا Qwen3.7-max آخری نمبر پر 50% رہا۔ اس کا مطلب یہ ہے کہ بہترین کارکردگی کا مظاہرہ کرنے والا ماڈل بھی سیکیورٹی سے متعلق تقریباً ایک تہائی کاموں میں ناکام رہا۔
پچھلے راؤنڈ کے مقابلے ٹاپ اسکور بھی گرا، جہاں GPT-5-mini 72% تک پہنچ گیا تھا۔ دریں اثنا، Kimi-K2.6 اور Xiaomi کے MiMo-V2.5 سمیت چینی ماڈلز نے کئی مغربی ماڈلز کو پیچھے چھوڑ دیا، جس سے اس شعبے کو عالمی سطح پر مزید مسابقتی بنایا گیا۔
پروگرامنگ زبان کے لحاظ سے سیکورٹی کی کارکردگی بھی نمایاں طور پر مختلف ہوتی ہے۔
Python نے 63% پاس ریٹ کے ساتھ بہترین کارکردگی کا مظاہرہ کیا، جبکہ Java صرف 30% ہی کامیاب رہا، جس سے یہ ٹیسٹ میں سب سے کمزور زبان بنی۔ تاہم، ویرا کوڈ نے کہا کہ جاوا بھی واحد زبان تھی جو پچھلے سال کے دوران واضح طور پر اوپر کی طرف رجحان کو ظاہر کرتی ہے۔
خطرے کی قسم نے بھی ایک بڑا فرق کیا ہے۔ ماڈلز نے SQL انجیکشن اور غیر محفوظ کرپٹوگرافی کے خلاف نسبتاً اچھی کارکردگی کا مظاہرہ کیا، لیکن کراس سائٹ اسکرپٹنگ اور لاگ انجیکشن کے ساتھ بری طرح جدوجہد کی۔ پہلے ویرا کوڈ ٹیسٹنگ نے ان زمروں کے درمیان اسی طرح کے بڑے فرق کو دکھایا۔
ویرا کوڈ نے خام ماڈلز کو سیکیورٹی کے مخصوص اشارے، ایجنٹوں، چوکیوں یا انسانی جائزے کے بغیر جانچا۔
اس کا مطلب ہے کہ 44% ناکامی کی شرح یہ تجویز نہیں کرتی ہے کہ تمام AI سے تیار کردہ کوڈ کا تقریباً نصف کمزوریوں کے ساتھ پیداوار تک پہنچتا ہے۔ سافٹ ویئر کے جاری ہونے سے پہلے حقیقی ترقیاتی ورک فلو میں کوڈ کے جائزے، سیکیورٹی اسکینرز اور دیگر حفاظتی اقدامات شامل ہو سکتے ہیں۔
ویراکوڈ، جو سافٹ ویئر سیکیورٹی پروڈکٹس فروخت کرتا ہے، تجویز کرتا ہے کہ AI سے تیار کردہ کوڈ کو کسی بھی دوسرے غیر جائزہ شدہ کوڈ کی طرح اسکین کرکے اور تعیناتی سے پہلے اسے ٹھیک کریں۔
Veracode کے شریک بانی اور چیف سیکیورٹی مبشر، Chris Wysopal نے کہا کہ اس کا جواب جدید AI ماڈلز تک رسائی کو محدود نہیں کر رہا ہے، بلکہ ان کے ارد گرد سیکیورٹی کنٹرول کو بہتر بنا رہا ہے۔
جب تک کہ AI ماڈل سیکیورٹی کے لحاظ سے اتنے ہی قابل اعتماد نہیں ہو جاتے جتنے کہ وہ نحو میں ہوتے ہیں، رپورٹ بتاتی ہے کہ خودکار جانچ اور انسانی جائزہ AI کی مدد سے سافٹ ویئر کی ترقی کے ضروری حصے رہیں گے۔
جہاں آپ چاہیں تازہ ترین ٹیک خبریں، ٹیلی کام کی بصیرتیں، اور پروڈکٹ لانچ حاصل کریں۔
ProPakistani کو ترجیحی ذرائع میں شامل کریں اور گوگل سرچ اور ٹاپ اسٹوریز میں ہماری مزید کہانیاں دیکھیں۔
ٹیکنالوجی اور آٹوموٹو ماہر جدید ترین کاروں، اسمارٹ فونز، AI پیش رفتوں، اور...
شیئرز