اوپن اے آئی نے اپنے آنے والے آسٹرا ماڈل کے بارے میں نئی تفصیلات شیئر کیں، جس کے بارے میں کمپنی نے کہا کہ یہ پہلا بڑا لینگویج ماڈل ہے جو اپنی "سائبر سیکیورٹی کی اہم حد" کو پورا کرنے کے لیے اس کی جلد ریلیز کی تیاری میں ہے۔
اوپن اے آئی کی بلاگ پوسٹ میں لکھا گیا ہے، "ہم جلد ہی Astra کو دستیاب کرنے کا ارادہ رکھتے ہیں، لیکن اس کی جدید ترین سائبرسیکیوریٹی صلاحیتوں تک رسائی زیادہ محدود ہوگی۔"
فرنٹیئر لیب نے اس بات کا تعین کیا کہ Astra کمپیوٹر سسٹمز میں سیکیورٹی کی نامعلوم خامیوں کو تلاش کرنے اور کسی شخص کی رہنمائی کے بغیر ان کا استحصال کرنے کے قابل ہے۔ یہ ان خدشات سے ملتا جلتا ہے جو انتھروپک نے اس سال کے شروع میں اپنے Mythos ماڈل کے بارے میں اٹھائے تھے، اور OpenAI تقابلی احتیاطی تدابیر اختیار کر رہا ہے کیونکہ وہ Astra کو رول آؤٹ کرنے کی تیاری کر رہا ہے۔
کسی تیسرے فریق کی تصدیق کے بغیر، حفاظت یا تیاری کے بارے میں OpenAI کے دعووں کا اندازہ لگانا مشکل ہے۔ کمپنی نے کہا کہ وہ ٹیسٹرز کے ایک گروپ کے ساتھ ماڈل کا پیش نظارہ کرے گی، لیکن یہ نہیں بتایا کہ وہ کون ہیں یا ان کا انتخاب کیسے کیا جائے گا۔ یہ واضح نہیں ہے کہ آیا OpenAI امریکی حکومت کے ساتھ مل کر ریلیز سے پہلے ماڈل کا جائزہ لے رہا ہے۔
OpenAI نے نوٹ کیا کہ Astra نے ExploitBench پر ایک بہترین اسکور حاصل کیا، جو معلوم نظام کی کمزوریوں کو ہیک کرنے کی LLM کی صلاحیت کا اندازہ ہے۔ کمپنی نے کہا کہ OpenAI انجینئرز کے تیار کردہ ٹیسٹ کے ایک ترمیم شدہ ورژن میں، ماڈل نے دو صفر دن کی کمزوریوں کو دریافت کیا اور ان کا فائدہ اٹھایا۔
اس بات کو یقینی بنانے کے لیے کہ اس کے ماڈلز نہ تو برے اداکاروں کے ذریعے استحصال کا شکار ہیں اور نہ ہی خود برے رویے کے قابل ہیں، OpenAI نے کہا کہ اس نے بدسلوکی کا پتہ لگانے اور جیل بریک کو روکنے کے لیے ماڈل کے استعمال کو بہتر بنانا شروع کر دیا ہے۔
Astra کے لیے، تاہم، کمپنی نے غیر متعینہ نئی تکنیکوں میں سرمایہ کاری کی جو ماڈل کو خود کو محفوظ بنانے کے لیے ڈیزائن کی گئی ہیں۔ اوپن اے آئی نے "زیادہ خطرہ کے طور پر تشخیص شدہ اکاؤنٹس" کی شناخت کرنا اور ماڈل کے جوابات کو ان کے اشارے پر محدود کرنا بھی شروع کر دیا ہے، حالانکہ یہ یہ بھی نہیں بتاتا ہے کہ کیسے۔ آخر میں، اگرچہ کمپنی Astra کو اپنے "آج تک کا سب سے زیادہ منسلک ماڈل" کے طور پر بیان کرتی ہے، لیکن یہ خراب رویے کو تلاش کرنے اور روکنے کے لیے اضافی چین آف تھیٹ مانیٹرنگ کے ساتھ ماڈل کو تعینات کرے گی۔
Astra کی ریلیز کے لیے تیاریاں اس وقت ہوتی ہیں جب انڈسٹری اوپن اے آئی ایجنٹس کو تربیتی ماحول سے الگ ہونے اور Hugging Face پر نجی ڈیٹا تک رسائی حاصل کرنے پر ردعمل ظاہر کرتی ہے، جو ایک مقبول ماڈل اور بینچ مارک ڈسٹری بیوشن پلیٹ فارم ہے۔
Astra کے لیے، OpenAI نے کہا کہ اس نے نئے ماڈل کو ہگنگ فیس کے واقعے میں بدمعاش ایجنٹوں کی کارروائیوں کی نقل تیار کرنے کے لیے ایک ٹیسٹ ڈیزائن کیا، جس نے OpenAI محققین کی جانب سے لاگو حفاظتی اقدامات کے باوجود اوپن انٹرنیٹ تک رسائی حاصل کرنے میں تعاون کیا۔ انہوں نے کہا کہ آسٹرا نے ان تجربات میں اپنے ٹیسٹنگ ماحول سے باہر نکلنے کی کوشش نہیں کی۔
یونا شیویت، ایک سابقہ OpenAI ملازم جو اب OpenAI فاؤنڈیشن میں AI لچک پر کام کرتی ہے، نے سوشل میڈیا پر حیرانگی کا اظہار کیا کہ آیا Astra کی جانب سے قواعد کو توڑنے کی خواہش کا نتیجہ یہ معلوم نہیں ہو سکتا کہ اس سے کیا توقع کی جا رہی ہے یا محققین کو بے وقوف بنانے کی کوشش کی گئی ہے۔
اور ان تمام نئی تفصیلات کے لیے، یہ جاننا ابھی بھی مشکل ہے کہ Astra کس قابل ہے یا OpenAI حفاظت کو یقینی بنانے کے لیے صحیح اقدامات کر رہا ہے۔ کمپنی نے کہا کہ جب اسے عوام کے لیے وسیع پیمانے پر لانچ کیا جائے گا تو وہ ماڈل کے مزید جائزے اور مزید حفاظتی معلومات جاری کرنے کی توقع رکھتی ہے۔
تاہم، اس وقت بلی تھیلے سے باہر ہو جائے گی۔