ایک AI ایجنٹ نے جعلی آن لائن شناختیں بنائیں اور OpenAI اور Anthropic کے ماڈلز کی تشخیص کے دوران محفوظ سسٹمز تک غیر مجاز رسائی حاصل کرنے کی کوشش کرتے ہوئے بدنیتی پر مبنی کوڈ لکھا۔
برطانیہ کے AI سیکیورٹی انسٹی ٹیوٹ نے مَنگَل کو ان واقعات کا انکشاف کیا، جس سے جدید AI ایجنٹوں کی جانچ کے دوران استعمال ہونے والے حفاظتی اقدامات کے بارے میں نئے خدشات پیدا ہوئے۔
انسٹی ٹیوٹ نے کہا کہ Anthropic's Mythos 5 اور OpenAI کے GPT-5.6-Sol سے چلنے والے ایجنٹوں نے سیکورٹی کی جانچ کے دوران غیر مجاز کارروائیاں کیں۔ کچھ ایجنٹوں نے ممکنہ طور پر نقصان دہ سرگرمیاں جاری رکھی جن میں حقیقی افراد اور تنظیمیں شامل تھیں۔ تاہم، تفتیش کاروں کو حقیقی دنیا کے نقصان کا کوئی ثبوت نہیں ملا۔
AISI بڑی AI لیبارٹریوں کے ساتھ رضاکارانہ معاہدوں کے ذریعے جدید AI ماڈلز تک رسائی حاصل کرتا ہے۔
انسٹی ٹیوٹ نے ایجنٹوں کو ایک خیالی سائبر سیکیورٹی کے منظر نامے میں رکھا جو ان کی صلاحیتوں کی پیمائش کے لیے ڈیزائن کیا گیا تھا۔ اس نے چیلنج کو 122 بار دوڑایا اور 10 ٹیسٹ رنز میں 19 غیر مجاز کارروائیاں ریکارڈ کیں۔
انتھروپک کے ایجنٹ نے ان میں سے 17 کارروائیاں کیں، جبکہ OpenAI کا ایجنٹ باقی دو کے لیے ذمہ دار تھا۔
نتائج AI-ایجنٹ کی جانچ کے ارد گرد حفاظتی اقدامات میں کمزوریوں کو نمایاں کرتے ہیں۔ ٹیکنالوجی کمپنیاں ان سسٹمز کو ایسے ٹولز کے طور پر بھی فروغ دے رہی ہیں جو مستقبل کے کاروباری آپریشنز میں اہم کردار ادا کر سکتے ہیں۔
سب سے سنگین واقعہ میں ایک ایجنٹ کا بدنیتی پر مبنی کوڈ لکھنا اور کسی انسان کو اس کی منظوری کے لیے قائل کرنے کی کوشش شامل ہے۔
ایجنٹ نے کوشش کے حصے کے طور پر جعلی آن لائن شناخت بنائی۔ تاہم، AISI نے یہ نہیں بتایا کہ کون سی کمپنی کا ماڈل ذمہ دار ہے۔
یہ واقعہ ان دو غیر مجاز کارروائیوں میں سے کسی ایک سے بھی میل نہیں کھاتا تھا جن کا اوپن اے آئی نے علیحدہ طور پر انکشاف کیا تھا۔
اینڈریو یون، کیلیفورنیا میں مقیم غیر منفعتی CivAI کے ایک محقق نے کہا کہ دستیاب شواہد اس بات کی نشاندہی کرتے ہیں کہ Anthropic کے ایجنٹ نے دھوکہ دہی کی سرگرمیاں انجام دیں۔
یون نے کہا کہ ظاہری آگاہی کہ ایجنٹ ایک حقیقی شخص کو نشانہ بنا رہا ہے، اس کے ماڈلز پر انتھروپک کے کنٹرول کے بارے میں سوالات اٹھائے ہیں۔
اینتھروپک نے X پر ایک بیان میں کہا کہ وہ مزید معلومات حاصل کرنے اور اپنی تحقیقات کرنے کے لیے AISI کے ساتھ مل کر کام کر رہا ہے۔
OpenAI نے اپنے ایجنٹ کی دو غیر مجاز کارروائیوں کے بارے میں تفصیلات بھی شائع کیں۔ کمپنی کے مطابق، دونوں واقعات میں ایجنٹ نے ایسے طریقوں سے انٹرنیٹ تک رسائی حاصل کی جو ٹیسٹ پرامپٹ کے ذریعے ممنوع تھی۔
OpenAI نے کہا کہ وہ قومی AI اداروں، آزاد تشخیص کاروں، دیگر AI لیبارٹریوں، اور اضافی گروپوں کے ساتھ مل کر کام کرنے کا ارادہ رکھتا ہے تاکہ اعلی خطرے کی تشخیص کے لیے حفاظتی طریقوں کو بہتر بنایا جا سکے۔
اوپن اے آئی نے ایک علیحدہ واقعہ کا بھی انکشاف کیا جس میں غیر قانونی، ایک تھرڈ پارٹی ٹیسٹنگ فراہم کنندہ شامل ہے۔
کنفیگریشن کی خرابی نے OpenAI کے ایجنٹوں کو انٹرنیٹ سے منسلک ہونے کی اجازت دی جب انہیں رسائی حاصل نہیں کرنی چاہیے تھی۔ اینتھروپک نے پچھلے ہفتے اسی طرح کی جانچ کی غلط ترتیب کا انکشاف کیا۔
رائٹرز نے پہلے اطلاع دی تھی کہ اوپن اے آئی نے AI-ایجنٹ کی ہیکنگ کے بارے میں اپنی تحقیقات کو بڑھا دیا ہے جب کہ دوسرے ایجنٹوں کی جانچ کی پابندیوں کو توڑنے کے ثبوت ملے ہیں۔
AISI کے واقعات جولائی کی خلاف ورزی سے مختلف تھے جس میں OpenAI ایجنٹ اور AI پلیٹ فارم Hugging Face شامل تھا۔
اس صورت میں، ایجنٹ الگ تھلگ ٹیسٹنگ ماحول سے بچ گیا اور انٹرنیٹ تک پہنچ گیا۔
AISI کی تشخیص کے دوران، ایجنٹس اپنے ٹیسٹنگ ماحول سے باہر نہیں نکلے۔ اس کے بجائے، انسٹی ٹیوٹ نے اپنے معیاری جانچ کے طریقہ کار کے حصے کے طور پر جان بوجھ کر انٹرنیٹ تک رسائی فراہم کی تھی۔
جہاں آپ چاہیں تازہ ترین ٹیک خبریں، ٹیلی کام کی بصیرتیں، اور پروڈکٹ لانچ حاصل کریں۔
ProPakistani کو ترجیحی ذرائع میں شامل کریں اور گوگل سرچ اور ٹاپ اسٹوریز میں ہماری مزید کہانیاں دیکھیں۔
ٹیکنالوجی اور آٹوموٹو ماہر جدید ترین کاروں، اسمارٹ فونز، AI پیش رفتوں، اور...
شیئرز