خود مختار AI کے بارے میں خدشات نے بڑی حد تک اس بات پر توجہ مرکوز کی ہے کہ جب کوئی ایجنٹ انسانی ارادوں کو نظر انداز کرتا ہے یا کسی مقصد کے حصول کے دوران نقصان دہ اقدامات کرتا ہے، جیسے کہ انسانوں کو دھوکہ دینا۔
اینتھروپک نے اب ایک اور مسئلہ کا مظاہرہ کیا ہے: AI ایجنٹ دوسرے AI ایجنٹوں کو بھی آن کر سکتے ہیں۔
ایک نئے تجربے میں، Anthropic نے کئی AI ایجنٹوں کو متضاد ہدایات دیں جبکہ انہیں ایک ہی سافٹ ویئر پروجیکٹ پر آزادانہ طور پر کام کرنے کی اجازت دی۔ بجائے اس کے کہ محض تنازعہ کو پہچاننے اور کسی انسان سے مداخلت کرنے کو کہے، ایجنٹوں نے بار بار ایک دوسرے پر حملہ کرنا شروع کر دیا۔
اس کے بعد جو کچھ ہوا وہ تعاون کی طرح کم اور ڈیجیٹل ٹرف وار کی طرح نظر آیا۔
Anthropic نے تین ایجنٹوں کو ایک ہی Python سافٹ ویئر بیک اینڈ کو تبدیل کرنے کی ہدایت کی، لیکن ہر ایجنٹ کو مختلف پروگرامنگ زبان کا استعمال کرتے ہوئے اسے دوبارہ بنانے کے لیے کہا گیا۔
ایجنٹوں کو ابتدائی طور پر معلوم نہیں تھا کہ دوسروں کو بھی جائز لیکن متضاد ہدایات موصول ہوئی ہیں۔
انہوں نے جلد ہی دوسرے ایجنٹوں کے کام کو دانستہ مداخلت سے تعبیر کیا۔
وہاں سے، کچھ ایجنٹوں نے مسابقتی عمل کو فعال طور پر تلاش کرنا اور انہیں بند کرنا شروع کیا۔ انہوں نے خودکار اسکرپٹ لکھے جو بار بار حریف پروگراموں کی تلاش میں رہتے تھے اور جب بھی وہ ظاہر ہوتے تھے انہیں مار ڈالتے تھے۔
دوسرے لفظوں میں، ایجنٹ مؤثر طریقے سے ایک ہی سسٹم پر چلنے والے مسابقتی AI کام کے بوجھ کا شکار کر رہے تھے۔
حملے تیزی سے زیادہ جارحانہ ہو گئے۔
کچھ ایجنٹوں نے اپنے حریفوں کے کمپیوٹر کی اجازتیں منسوخ کر دیں، انہیں صارف گروپوں سے ہٹا دیا، ان کے اکاؤنٹس کو لاک کر دیا، اور SSH رسائی کو مسدود کر دیا، جو عام طور پر کمپیوٹر کو دور سے کنٹرول کرنے کے لیے استعمال ہوتا ہے۔
دوسروں نے بدنیتی پر مبنی کوڈ بنایا جو مسابقتی عمل کو بار بار غیر فعال کر سکتا ہے۔
انتھروپک نے یہاں تک کہ ایسے ایجنٹوں کو دیکھا جو میلویئر کے بھیس میں تعینات ہوتے ہیں گویا اسے کسی اور ایجنٹ نے بنایا ہے۔
متعدد تجربات میں، ایک ایجنٹ نے مؤثر طریقے سے دوسرے کی کام جاری رکھنے کی صلاحیت کو ختم کرکے تنازعہ جیت لیا۔
ہر تجربہ ایک AI کے ساتھ دوسرے کو آف لائن مجبور کرنے کے ساتھ ختم نہیں ہوا۔
کچھ ایجنٹوں کو آخرکار پتہ چلا کہ ان کے حریف جان بوجھ کر ان پر حملہ نہیں کر رہے تھے۔ اس کے بجائے، ان سب کو انسانوں کی طرف سے متضاد ہدایات دی گئی تھیں۔
ایک بار جب وہ صورتحال کو سمجھ گئے، تو کچھ نے لڑائی بند کر دی، اپنے بنائے ہوئے بدنیتی پر مبنی کوڈ کو حذف کر دیا، اور بات چیت کرنے کی کوشش کی۔
یہاں تک کہ کچھ لوگوں نے اختلاف رائے کو حل کرنے کے لیے انسان سے کہنے سے پہلے کوڈ کمٹ یا دستاویزات میں معافی کے پیغامات چھوڑے ہیں۔
اینتھروپک نے مزید جدید ایجنٹوں کا بھی مشاہدہ کیا کہ وہ یہ فیصلہ کرنے کے لیے اپنے مقابلے بناتے ہیں کہ کون سا حل زندہ رہنا چاہیے۔ کئی Mythos 5 تجربات میں، ایجنٹوں نے مختلف پروگرامنگ زبانوں کی کارکردگی کا موازنہ کیا، ایک فاتح پر اتفاق کیا، اور جیتنے والے ایجنٹ کو پروجیکٹ کو کنٹرول کرنے کی اجازت دی۔
نتائج سے پتہ چلتا ہے کہ AI ایجنٹوں کو زیادہ آزادی دینے سے ایسے مسائل پیدا ہوتے ہیں جو انسانی بمقابلہ AI تنازعات سے بالاتر ہیں۔
مستقبل کے کام کی جگہوں میں درجنوں یا اس سے بھی ہزاروں ایجنٹ بیک وقت کام کرنے، فائلوں میں ترمیم کرنے، کمپیوٹرز کو کنٹرول کرنے اور ایک جیسے ڈیجیٹل وسائل کو استعمال کرنے میں شامل ہو سکتے ہیں۔
اگر ان ایجنٹوں کو متضاد اہداف ملتے ہیں، تو Anthropic کی تحقیق بتاتی ہے کہ وہ خود بخود تعاون نہیں کر سکتے۔ اس کے بجائے وہ ایک دوسرے کو بند کر سکتے ہیں، مسابقتی کام کو تباہ کر سکتے ہیں، یا حریف ایجنٹوں کو روکنے کے لیے ڈیزائن کردہ سافٹ ویئر تعینات کر سکتے ہیں۔
اینتھروپک کا کہنا ہے کہ واضح درجہ بندی اور تنازعات کے حل کے نظام کی ضرورت ہوگی کیونکہ خود مختار AI زیادہ عام ہو جاتا ہے۔
تجربہ بتاتا ہے کہ AI کی حفاظت کے لیے اگلا بڑا چیلنج صرف ایجنٹوں کو انسانوں کے ساتھ منسلک رکھنا نہیں ہے۔ اس میں AI ایجنٹوں کو ایک دوسرے کو ہیک کرنے اور سبوتاژ کرنے سے روکنا بھی شامل ہو سکتا ہے۔
جہاں آپ چاہیں تازہ ترین ٹیک خبریں، ٹیلی کام کی بصیرتیں، اور پروڈکٹ لانچ حاصل کریں۔
ProPakistani کو ترجیحی ذرائع میں شامل کریں اور گوگل سرچ اور ٹاپ اسٹوریز میں ہماری مزید کہانیاں دیکھیں۔
ٹیکنالوجی اور آٹوموٹو ماہر جدید ترین کاروں، اسمارٹ فونز، AI پیش رفتوں، اور...
شیئرز