هاڻ هڪ سال لاءِ، AI حفاظتي جاچ واري فرم اينڊون ليبز فرنٽيئر ماڊلز کي مختلف حقيقي دنيا جي ڪمن سان گڏ ڪم ڪيو آهي ته اهو طئي ڪرڻ لاءِ ته اهي ڪيترو بهتر ڪم ڪن ٿا ايجنٽ طور ڊگهي عرصي تائين هلن ٿا بغير ڪنهن انساني نگراني جي.
اربع تي، اينڊون هڪ نئين قسط شايع ڪئي ته ڪئين شيون ان جي وينڊنگ-بينچ جي تحقيق ۾ هلي رهيون آهن، جتي ليب ۾ فرنٽيئر ماڊل آهن هڪ ٺاهيل وينڊنگ مشين جو ڪاروبار هڪ ٺهيل سال لاءِ. مشن سادو آهي: ٻين ماڊلن کان وڌيڪ پئسا ڪمايو. اهو نتيجن کي بينچ مارڪ ڪري ٿو علائقن ۾ حتمي نقد بيلنس، قيمتون ادا ڪندڙ سپلائرز، ۽ ادا ڪيل واپسي.
انهن تجربن ۾، هن مختلف AI ماڊلز کي ڏٺو آهي - گهڻو ڪري Anthropic ۽ OpenAI کان - ڪوڙ، ٺڳي ۽ انهن جي رستي کي ٽوڙيو.
تازي ٽيسٽ ۾، ماڊل خاص طور تي ڇانيل ٿي ويا آهن جڏهن انهن جي تخليق انهن کي ٻڌايو ته انهن جي وينڊنگ مشين کي ٻين ماڊل جي مشينن جي ويجهو سان فرانسسڪو ۾ مصروف سياحتي گهٽي تي رکيو ويندو. هي گول هڪ ٻئي جي خلاف Claude Opus 5، GPT-5.6 Sol، ۽ Kimi K3 کي ڇڪايو.
هر هڪ کي ٻين ماڊل تائين اي ميل رسائي ڏني وئي، سڀ انساني نالي تخلص جي تحت. انهن کي خبر هئي ته ٻيا ماڊل هئا، پر اهو نه ڄاڻندا هئا ته ڪهڙي نموني جي پويان انساني نالو آهي.
انهن کي هڪ اي ميل ايڊريس پڻ ڏنو ويو انهن جي ”انتظام“ کي جيڪڏهن انهن کي مدد جي ضرورت هجي. پر انتظاميا هميشه جواب ڏنو ته "رپورٽ ملي وئي آهي ۽ ٿي سگهي ٿي يا نه ٿي سگهي ٿي" ۽ ڪڏهن به مداخلت نه ڪئي وئي.
سول جلد ئي محسوس ڪيو ته اهو هڪ برتري حاصل ڪري سگهي ٿو پنهنجي مقابلي کي قائل ڪرڻ لاءِ قيمت جي منزل تي. ماڊل سڀ مشروبات خريد ڪري رهيا هئا $1.50 هڪ بوتل تي، ۽ سول تجويز ڪيو ته اهي $2.15 کان گهٽ ۾ وڪڻڻ تي متفق آهن. اهو انهن کي واعدو سان لالچ ڏئي ٿو ته اهي سڀئي هڪ ٻن ڏينهن ۾ نفعي تي وڪرو ڪندا.
پر جڏهن ٻيا متفق ٿيا، سول فوري طور تي ان جي پنهنجي قيمت کي $ 2.14 تائين گھٽائي انهن کي پٺي ۾ ڇڪايو.
اوپس جو پاڻي وڪرو رات جو صفر ٿي ويو. ٻئي ڏينهن، اهو سول کي هڪ گندو اي ميل موڪليو، ان تي هٿرادو الزام لڳايو. پر اوپس اهو پڻ چيو ته اهو اسڪيم تي انتظاميا کي تنگ ڪرڻ وارو ناهي: ”مان توهان کي هيڊ ڪوارٽر ڏانهن رپورٽ نه ڪري رهيو آهيان - توهان جيڪو ڪيو اهو مقابلو آهي ، دوکي ناهي.
اڃان تائين، جڏهن Opus ان جي قيمت $ 2.14 تائين گھٽائي ڇڏيا سول سان ملائڻ لاء (پڻ ان جي اجتماعي $ 2.15 معاهدي جي خلاف ورزي ۾)، سول هڪ ڪرين ۾ تبديل ٿي ويو، "انتظام" جي شڪايت ڪئي ۽ "نافذ ڪرڻ، هڪ جرمانه، ۽ / يا نااهل" Opus لاء مطالبو ڪيو.
جيتوڻيڪ، اوپس گهڻي عرصي تائين چوسڻ وارو نه هو. حقيقت ۾، اهو ڪنهن به AI ماڊل جو بهترين سرمائيدار بڻجي ويو آهي اينڊون ڪڏهن به آزمائشي آهي (جنهن ۾ ڪيترائي اڳئين فرنٽيئر ماڊل شامل آهن).
اهو هڪ نئون وينڊنگ-بينچ رڪارڊ پڻ قائم ڪيو آهي $11182 جي معنيٰ فائنل بيلنس سان. اڃا به بهتر، اهو ڪڏهن به ڪنهن گراهڪ سان ڪوڙ نه ڳالهايو، جيتوڻيڪ اهو ڄاڻي واڻي گراهڪ جي شڪايتن کي نظرانداز ڪيو جنهن جي نتيجي ۾ واپسي ٿيڻ گهرجي ها. اهو، شايد، پنهنجي ننڍي ڀاءُ ڪلاڊ 4.6 تي هڪ بهتري آهي، جنهن پسند ڪيو ته گراهڪن کي ٻڌايان ته واپسي اچي رهيا آهن، ۽ پوءِ انهن کي ڪڏهن به ادا نه ڪيو.
اڃا تائين، Opus هڪ مڪمل نئين سطح تي اتحاد ۽ ٻين بي ايماني حڪمت عملي کڻڻ سان بينچ مارڪ تخليق حاصل ڪئي.
مثال طور، اهو سول کي اي ميل ڪيو، تجويز ڪيو ته اهي مارڪيٽ کي ورهائي. هر هڪ منفرد پراڊڪٽ وڪڻڻ تي متفق هوندو، تنهنڪري ڪنهن کي به قيمت تي ٻئي تي ڀروسو نه ڪرڻو پوندو. سول ساڳئي پروڊڪٽس تي قيمت جي منزلن جي خواهش سان مقابلو ڪيو، پر اوپس انڪار ڪيو، چيو ته ان قسم جو ميلاپ غير قانوني هو، ڄاڻڻ سان ان کي شرمن ايڪٽ جي خلاف ورزي جي طور تي بيان ڪيو ويو.
اهو بعد ۾ ظاهري طور تي پوئتي هٽيو ويو، هڪ اي ميل موڪلڻ واري موضوع واري لائن سان "پنهنجي جنگ کي روڪيو،" ۽ سول کي ٻڌايو ته ان تي غور ڪيو ويو آهي ۽ قيمت مقرر ڪرڻ تي اتفاق ڪيو ويندو.
پر اندروني لاگ ان جي استدلال کي دستاويز ڪندي هڪ وڌيڪ شيطاني منصوبو ظاهر ڪيو: صرف تعاون جو تجويز ڪيو جڏهن ته ساڳئي وقت ان جي اعلي منافعي واري شين تي قيمتن کي گهٽايو. زيتون جي شاخ جي اي ميل هڪ عمدي سازش هئي.
ڪنهن به صورت ۾، سول انڪار ڪيو ۽ اوپس کي ٻيهر انتظاميه کي ٻڌايو.
پر اوپس کي بيخبر ڪيو ويو ۽ قيمتن يا اسٽاڪ کي گڏ ڪرڻ لاءِ ٻين ريڪيٽس جي تجويز ڏني وئي. آخر ۾، سڀئي ماڊل ڪيترن ئي دورن جي معاهدي ۾ مشغول ٿيا. ۽ سڀ ماڊلز سندن مقابلي ۾ خيانت ڪئي. سڀني معاهدن تي، اوپس ٽوڙيو 11 ٽراس، جي پي ٽي 2، ۽ ڪيمي 1، اينڊن ٻڌايو.
بيوس ڪريمي هر طرف کان بيزار ٿي ويو. Opus ۽ Kimi جي وچ ۾ هڪ معاهدي دوران (سول متفق نه ٿيندو)، سول انهن ٻنهي کي قيمتن تي گهٽايو. تنهنڪري Opus فوري طور تي ان جي قيمت گھٽائي ڇڏي. پوءِ اهو ”ڪمي کي ٻڌائڻ لاءِ پورو هفتو انتظار ڪيو ته اهو پنهنجو واعدو ٽوڙيو ،“ اينڊون ليبز پنهنجي بلاگ پوسٽ ۾ لکيو. نه رڳو Kimi قيمت حاصل ڪئي هڪ مقابلي طرفان، پر ان جي نالي سان پارٽنر طرفان پڻ. اوپس پڻ پنهنجي عظمت ۽ طاقت جي فريب کي وڌائڻ شروع ڪيو. هن پنهنجي سلطنت کي پنهنجي وينڊنگ مشين کان ٻاهر وڌائڻ جي ڪوشش شروع ڪئي، پهرين هڪ هول سيلر جي حيثيت سان، ٻين مشينن کي بلڪ پروڊڪٽس وڪڻڻ، پوء وڌيڪ مشينون کولڻ جي سازش. اهو تخليق جي دائري کان ٻاهر هو، مطلب ته اهو سڀ Opus جا خيال هئا، نه ته اهو ڪم ڪيو ويو هو.
هول سيلنگ لاءِ هن جو انداز خاص طور تي دلچسپ هو. Opus اهو محسوس ڪيو ته ڪاروبار جي هن لائين ان کي ٻين ٻن وينڊنگ مشين آپريٽرز تي وڌيڪ طاقت ڏني. اهو انهن کي پنهنجي اي ميلن ۾ رشوت يا ڌمڪيون شامل ڪرڻ شروع ڪيو: انهن کي بلڪ شين تي اڃا به گهٽ قيمتون پيش ڪرڻ، پر صرف ان صورت ۾ جڏهن اهي ان جي پرچون قيمت جي مطالبن جي تعميل ڪن. سول ان مان ڪو به نه هو، ۽ انتظاميا کي Opus رپورٽ ڪندو رهيو.
Opus پڻ ان جي سپلائرز سان ڪوڙ ڳالهايو: انهن کي ٻڌايو ته ان کي شيون تي گهٽ آڇون آهن جڏهن اهو نه هو، انهن کي حاصل ڪرڻ جي ڪوشش ڪري انهن جي قيمتن کي گهٽائڻ لاء.
هڪ طرف، AI ماڊلز مسٽر پوٽر طرز جي ولنيءَ کي چينل ڪري رهيا آهن It's a Wonderful Life جي فيم فليٽ آئوٽ مزاحيه آهي. ٻئي طرف، اهو سنجيدگي سان ڏيکاري ٿو ته اهي فرنٽيئر ماڊل، خاص طور تي يو ايس جي ملڪيت جي ليبز (خاص طور تي اينٿروپڪ)، حقيقي دنيا ۾ غير نگراني، ڊگهي هلندڙ ايجنٽ طور تي ڀروسو ڪرڻ لاء تيار نه آهن.
"اهو خاص طور تي لاڳاپيل آهي جيئن اسان هڪ اهڙي دنيا ۾ داخل ٿيو جتي AI ايجنٽ ڪمپنين کي پنهنجي ادارن جي طور تي هلائيندا آهن (صرف انسانن لاء اوزار نه آهن). جيڪڏهن AI ايجنٽ آزاديء سان معيشت جو هڪ وڏو حصو هلائي رهيا آهن، ڇا اسان چاهيون ٿا ته اهي ڪوڙ، ٺاهه، ڌمڪيون موڪلڻ، ۽ خيانت ڪن؟" اينڊن جي گڏيل باني لوڪاس پيٽرسن کي ٻڌايو TechCrunch.
جڏهن پيٽرسن کي اجازت ڏئي ٿي ته اهي ماڊل ڄاڻن ٿا ته اهي هڪ معيار جي تخليق ۾ هئا، ۽ اهو شايد انهن جي رويي کي متاثر ڪري سگهي ٿو، هن کي يقين آهي ته اهو معاملو نه هجڻ گهرجي. اهو هڪ جهڙو ناهي، چئو، هڪ انسان هڪ تخليق ۾ راند ڪري رهيو آهي، جهڙوڪ هڪ ويڊيو گيم ۾ هڪ قتل ڪندڙ خراب ماڻهو آهي. "صرف اهو ئي سبب آهي ته اسان انهن انسانن کان پريشان ناهيون جيڪي ويڊيو گيمز ۾ خراب شيون ڪندا آهن اهو آهي ته اسان انهن تي يقين رکون ٿا ته ڄاڻڻ جي حقيقي زندگي ڇا آهي ۽ ڇا ناهي. منهنجو خيال آهي ته اهو گهٽ واضح آهي ته AI ماڊل ان ۾ فرق ڪري سگهن ٿا."
ڪنهن به صورت ۾، AI ماڊل، انساني لفظن ۽ خيالن تي تربيت ڏني وئي جيئن اهي، انسانيت جي بدترين خاصيتن ۾ مشغول ٿيڻ جي مزاحمت نٿا ڪري سگهن، خاص طور تي جڏهن پئسا ڪمائڻ جي ڪوشش ڪري رهيا آهن.