ويراڪوڊ جي 2026 GenAI ڪوڊ سيڪيورٽي رپورٽ جي مطابق، AI ماڊل ڪوڊ لکڻ ۾ انتهائي قابل اعتماد ٿي چڪا آهن جيڪي مرتب ڪن ٿا، پر اهي اڃا تائين تقريبا اڌ ڪيسن ۾ بنيادي سيڪيورٽي ٽيسٽ ۾ ناڪام ٿي رهيا آهن.
ويراڪوڊ 100 کان وڌيڪ AI ماڊلز کي چار ٽيسٽنگ دورن ۾ آزمايو. سراسري سيڪيورٽي پاس جي شرح صرف 56٪ تائين پهچي وئي، گذريل سال رڪارڊ ڪيل 55٪ کان بمشکل وڌيڪ. ان جي ابتڙ، ماڊل هاڻي تقريبا هر وقت مصنوعي طور تي صحيح، مرتب ڪيل ڪوڊ ٺاهيندا آهن.
اهو مسئلو وڌيڪ اهم ٿي رهيو آهي جيئن AI هاڻي تقريبن سڀني ڪم ٿيل ڪوڊ جو اڌ ٺاهي ٿو، ويراڪوڊ پاران ڏنل ڊيٽا جي مطابق. ان جو مطلب اهو آهي ته سيڪيورٽي ناڪامي جي شرح گهڻو ڪري تبديل نه ٿي رهي آهي جڏهن ته AI-لکيل سافٽ ويئر جو مقدار تيزيء سان وڌي ويو آهي.
رپورٽ ۾ معلوم ٿيو ته خاص طور تي پروگرامنگ لاءِ ٺهيل ماڊلز عام مقصدي AI ماڊلز کان وڌيڪ محفوظ نه هئا.
ڪوڊنگ-مرڪوز ماڊلز سراسري طور تي 51٪ سيڪيورٽي پاس جي شرح، مقابلي ۾ 52٪ عام مقصدن واري ماڊل لاءِ. وڏن ماڊلن پڻ ٿورو فائدو ڏيکاريو، وڏن ماڊلن جي اوسط 53٪ سان، جڏهن ته وچولي ۽ ننڍن ماڊل ٻنهي 51٪ سکور ڪيو.
استدلال جا ماڊل بھترين پرفارم ڪيو، غير معقول ماڊلز لاءِ 51 سيڪڙو جي مقابلي ۾ اوسط 56٪. ويراڪوڊ تجويز ڪيو ته اضافي استدلال جا مرحلا شايد ڪم ڪري سگھن ٿا اندروني ڪوڊ جي نظرثاني وانگر حتمي جواب پيدا ٿيڻ کان اڳ.
OpenAI جي GPT-5.5 هڪ 68٪ سيڪيورٽي پاس جي شرح سان تازي ٽيسٽ ۾ پهريون نمبر.
11 ماڊلز مان ڇهه ٽيسٽ ڪيا ويا 50٪ ۽ 53٪ جي وچ ۾، جڏهن ته علي بابا جي Qwen3.7-max 50٪ تي آخري ختم ٿي وئي. ان جو مطلب اهو آهي ته بهترين پرفارمنس ماڊل اڃا تائين سيڪيورٽي سان لاڳاپيل ڪمن جو تقريبا ٽيون حصو ناڪام ٿيو.
مٿين نمبر پڻ پوئين دور جي مقابلي ۾ گر ٿي ويو، جتي GPT-5-mini 72٪ تائين پهچي چڪو هو. ان دوران، چيني ماڊلز جن ۾ Kimi-K2.6 ۽ Xiaomi جي MiMo-V2.5 شامل آهن ڪيترن ئي مغربي ماڊلز کي اڳتي وڌايو، فيلڊ کي وڌيڪ عالمي سطح تي مقابلي ۾ ٺاهيو.
سيڪيورٽي ڪارڪردگي پڻ پروگرامنگ ٻولي طرفان خاص طور تي مختلف آهي.
Python 63٪ پاس جي شرح سان بهترين پرفارم ڪيو، جڏهن ته جاوا صرف 30٪ منظم ڪيو، ان کي ٽيسٽ ۾ ڪمزور ٻولي بڻائي. بهرحال، ويراڪوڊ چيو ته جاوا پڻ واحد ٻولي هئي جيڪا گذريل سال ۾ واضح مٿي واري رجحان ڏيکاري ٿي.
خطري جي قسم پڻ هڪ وڏو فرق ڪيو. ماڊلز SQL انجيڪشن ۽ غير محفوظ ڪرپٽوگرافي جي خلاف نسبتا سٺي ڪارڪردگي ڪئي، پر ڪراس سائيٽ اسڪرپٽنگ ۽ لاگ انجڻ سان خراب طور تي جدوجهد ڪئي. اڳوڻي ويراڪوڊ ٽيسٽ ڏيکاريا ساڳيا وڏا فرق انهن زمرے جي وچ ۾.
ويراڪوڊ خام ماڊلز کي سيڪيورٽي مخصوص اشارن، ايجنٽن، گارڊ ريلز يا انساني جائزي کان سواءِ آزمايو.
هن جو مطلب آهي ته 44٪ ناڪامي جي شرح اهو مشورو نه ڏئي ٿي ته تقريبن اڌ AI ٺاهيل ڪوڊ نقصانن سان پيداوار تائين پهچي ٿو. حقيقي ترقي واري ڪم جي فلوز ۾ شامل ٿي سگھي ٿو ڪوڊ جائزو، سيڪيورٽي اسڪينر ۽ ٻيون حفاظتون سافٽ ويئر جاري ٿيڻ کان اڳ.
ويراڪوڊ، جيڪو وڪرو ڪري ٿو سافٽ ويئر سيڪيورٽي پراڊڪٽس، سفارش ڪري ٿو AI ٺاهيل ڪوڊ وانگر علاج ڪرڻ جي ڪنهن ٻئي غير نظرثاني ٿيل ڪوڊ وانگر ان کي اسڪين ڪرڻ ۽ مقرر ڪرڻ کان پهريان ان کي درست ڪندي.
ڪرس وائيسوپال، ويراڪوڊ جو گڏيل باني ۽ چيف سيڪيورٽي مبشر، چيو ته جواب ترقي يافته AI ماڊل تائين رسائي کي محدود نه آهي، پر انهن جي چوڌاري سيڪيورٽي ڪنٽرول کي بهتر بڻائي ٿو.
جيستائين AI ماڊل سيڪيورٽي جي لحاظ کان ايترو قابل اعتماد بڻجي ويندا آهن جيترو اهي نحو تي آهن، رپورٽ پيش ڪري ٿي ته خودڪار چيڪ ۽ انساني جائزو AI جي مدد سان سافٽ ويئر ڊولپمينٽ جا ضروري حصا رهندا.
تازه ترين ٽيڪني خبرن، ٽيليڪم بصيرت، ۽ پراڊڪٽ لانچ حاصل ڪريو جتي توهان چاهيو ٿا.
ProPakistani کي ترجيحي ذريعن ۾ شامل ڪريو ۽ ڏسو اسان جون وڌيڪ ڪهاڻيون گوگل سرچ ۽ ٽاپ اسٽوريز ۾.
ٽيڪنالاجي ۽ گاڏين جو ماهر جديد ڪارن، اسمارٽ فونز، AI ڪاميابين، ۽ ...
شيئرز