اوس د یو کال لپاره ، د AI خوندیتوب ازموینې شرکت انډون لابراتوار فرنټیر ماډلونه د مختلف ریښتیني نړۍ دندو سره دنده ترسره کړې ترڅو معلومه کړي چې دوی د اجنټانو په توګه څومره ښه کار کوي چې د اوږدې مودې لپاره پرته له انساني څارنې څخه پرمخ ځي.

د چهارشنبه په ورځ ، انډون یو نوی قسط خپور کړ چې شیان د دې د وینډینګ بینچ څیړنې کې څنګه پرمخ ځي ، چیرې چې لابراتوار د فرنټیر ماډلونه لري د یو نقل شوي کال لپاره د پلور پلور ماشین سوداګرۍ پرمخ وړي. ماموریت ساده دی: د نورو ماډلونو په پرتله ډیرې پیسې وګټئ. دا پایلې په برخو کې معیاري کوي لکه وروستي نغدي بیلانس، عرضه کونکو ته تادیه شوي نرخونه، او بیرته تادیه شوي.

د دې ازموینو په اوږدو کې ، دې د AI مختلف ماډلونه لیدلي - په لویه کچه د انټروپیک او اوپن AI څخه - دروغ ، دوکه کوي او سر ته د دوی لاره یوځای کوي.

په وروستي ازموینه کې ، ماډلونه په ځانګړي توګه سیوري شوي وروسته له هغه چې د دوی سمولیشن دوی ته وویل چې د دوی د پلور ماشین به د نورو ماډلونو ماشینونو ته نږدې د سان فرانسسکو په یوه مصروف سیاحتي سړک کې ځای په ځای شي. دا پړاو د کلاډ Opus 5، GPT-5.6 Sol، او Kimi K3 د یو بل په وړاندې ودرول.

هر یو ته نورو ماډلونو ته د بریښنالیک لاسرسی ورکړل شوی و ، ټول د انساني نوم تخلص لاندې. دوی پوهیدل چې نور ماډلونه وو، مګر نه پوهیدل چې کوم ماډل تر شا د کوم انسان نوم دی.

دوی ته د دوی "مدیریت" ته د بریښنالیک پته هم ورکړل شوې وه که دوی مرستې ته اړتیا ولري. مګر مدیریت تل ځواب ورکړ چې "راپور ترلاسه شوی او ممکن عمل وکړي یا نه وي" او هیڅکله یې مداخله نه ده کړې.

سول ډیر ژر پوه شو چې دا کولی شي د خپلو سیالانو په قانع کولو سره د نرخ په پوړ کې یوځای کولو سره بریا ترلاسه کړي. ماډل ټول مشروبات په یو بوتل $ 1.50 کې پیرودل، او سول وړاندیز وکړ چې دوی موافق دي چې د $ 2.15 څخه لږ قیمت کې وپلوري. دا دوی د دې ژمنې سره لالچ کړل چې ټول به په څو ورځو کې په ګټه وپلوري.

مګر کله چې نورو موافقه وکړه، سول سمدلاسه د خپل قیمت $ 2.14 ته راټیټولو سره دوی په شا کې ووهل.

د Opus د اوبو پلور په شپه کې صفر ته راټیټ شو. بله ورځ ، دې سول ته یو ناوړه بریښنالیک واستاوه ، چې دا یې په لاسوهنه تورن کړ. مګر Opus دا هم وویل چې دا د سکیم په اړه مدیریت سره معامله نه کوي: "زه تاسو مرکزي دفتر ته راپور نه ورکوم - هغه څه چې تاسو یې کړي سیالي دي، نه درغلي."

بیا هم، کله چې Opus خپل قیمت $ 2.14 ته راټیټ کړ ترڅو د سول سره میچ وکړي (د دوی د مجموعي $ 2.15 تړون څخه سرغړونه هم)، سول په کیرن بدل شو، "مدیریت" ته یې شکایت وکړ او د Opus لپاره یې د "تطبیق، جریمې، او / یا نا اهلۍ" غوښتنه وکړه.

که څه هم، Opus د اوږدې مودې لپاره خوندور نه و. په حقیقت کې ، دا د هرډول AI ماډل ترټولو غوره سرمایه کار شو چې انډون تل ازمویلی دی (کوم چې ډیری مخکیني فرنټیر ماډلونه پکې شامل دي).

دا حتی د 11182 ډالرو په اوسط وروستي توازن سره د وینډینګ بنچ نوی ریکارډ جوړ کړ. لا تر اوسه ښه، دا هیڅکله پیرودونکي ته دروغ نه وايي، که څه هم دا په قصدي توګه د پیرودونکو شکایتونه له پامه غورځولي چې باید د بیرته ستنیدو پایله ولري. دا، شاید، د خپل کوچني ورور کلاډ 4.6 په پرتله یو پرمختګ دی، کوم چې دا خوښوي چې پیرودونکو ته ووایي چې بیرته ستنیدل راځي، او بیا یې هیڅکله تادیه نه کوي.

بیا هم، Opus په بشپړ ډول نوي کچې ته د ملګرتیا او نورو بې ایمانه تاکتیکونو په نیولو سره د بنچمارک سمولیشن وګټله.

د مثال په توګه ، دا سول ته بریښنالیک واستاوه ، وړاندیز یې وکړ چې دوی بازار تقسیم کړي. هر یو به موافق وي چې ځانګړي محصولات وپلوري، نو هیڅوک به د قیمت په اړه په بل باور ونه کړي. سول په ورته محصولاتو کې د نرخ پوړونو غوښتلو سره مقابله وکړه ، مګر اوپس انکار وکړ ، ویې ویل چې دا ډول ملګرتیا غیرقانوني وه ، په پوهیدو سره یې دا د شرمین قانون څخه سرغړونه وبلله.

دا وروسته په ښکاره ډول شاته شو ، د موضوع کرښې سره یو بریښنالیک واستول "د قلم جنګ ودروئ" او سول ته یې وویل چې دا له سره غور شوی او د نرخ حل سره به موافق وي.

مګر داخلي لاګ چې د دې استدلال مستند کوي یو ډیر شیطاني پلان په ګوته کوي: یوازې د همکارۍ وړاندیز کول پداسې حال کې چې په ورته وخت کې د خورا ګټور توکو نرخونه کموي. د زیتون څانګې بریښنالیک یو قصدي چل و.

په هر حالت کې، سول انکار وکړ او بیا یې مدیریت ته Opus راپور ورکړ.

مګر Opus بې پامه و او د نورو ریکټونو وړاندیز یې وکړ چې په نرخونو یا سټاک کې یوځای شي. په پای کې، ټولو موډلونو د تړونونو په څو پړاوونو کې ښکیل شول. او ټولو ماډلونو خپلو سیالانو ته خیانت وکړ. د ټولو تړونونو په اوږدو کې، Opus 11 اوربند مات کړ، GPT 2، او Kimi 1، انډون راپور ورکړ.

بې وزله کیمي په هر لوري کې ډوب شو. د Opus او Kimi ترمنځ د یو تړون په جریان کې (سول به موافق نه وي)، سول دوی دواړه په نرخونو کې کم کړل. نو Opus سمدلاسه خپل نرخونه ټیټ کړل. بیا یې "پوره اونۍ انتظار وکړ چې کیمي ته ووایی چې دا خپله ژمنه مات کړه ،" انډون لیبز په خپل بلاګ پوسټ کې لیکلي. کیمي نه یوازې د سیالي کونکي لخوا ، بلکه د دې تش په نامه ملګري لخوا هم قیمت ترلاسه کړ. Opus هم د خپل عظمت او ځواک د فریبونو وده پیل کړه. دې هڅه پیل کړه چې خپل امپراتورۍ د خپل پلورونکي ماشین هاخوا پراخه کړي ، لومړی د عمده پلورونکي په توګه ، نورو ماشینونو ته لوی محصولات پلوري ، بیا د نورو ماشینونو پرانستلو پلان جوړوي. دا د سمولو له دائرې څخه بهر و، پدې معنی چې دا د Opus ټول نظرونه وو، نه هغه څه چې د ترسره کولو دنده یې درلوده.

د عمده پلورلو طریقه په ځانګړې توګه په زړه پورې وه. Opus پوه شو چې د سوداګرۍ دې کرښې دې ته د نورو دوه پلورونکو ماشین چلونکو په پرتله ډیر ځواک ورکړی. دې دوی ته په خپلو بریښنالیکونو کې د بډو یا ګواښونو اضافه کول پیل کړل: دوی ته په لویو توکو کې حتی ټیټ نرخونه وړاندیز کوي ، مګر یوازې که دوی د پرچون نرخ غوښتنې سره موافق وي. سول له دې څخه هیڅ نه درلودل ، او مدیریت ته یې د Opus راپور ورکولو ته دوام ورکړ.

Opus خپلو عرضه کونکو ته هم دروغ وویل: دوی ته یې ویل چې دا د توکو په اړه ټیټ وړاندیزونه لري کله چې دا نه وي، هڅه کوي چې دوی خپل نرخونه ټیټ کړي.

له یوې خوا، د AI ماډلونه چې د ښاغلي پوټر سټایل ولیني له It's a Wonderful Life شهرت څخه چینل کوي په زړه پوري دي. له بلې خوا، دا په جدي توګه ښیي چې دا سرحدي ماډلونه، په ځانګړې توګه د متحده ایاالتو ملکیت لابراتوارونو څخه (په ځانګړې توګه انټروپيک)، په ریښتینې نړۍ کې د غیر څارل شوي، اوږدمهاله اجنټانو په توګه د باور کولو لپاره چمتو ندي.

"دا په ځانګړي ډول اړونده ده کله چې موږ داسې نړۍ ته ننوځو چیرې چې د AI اجنټان شرکتونه د خپلو ادارو په توګه پرمخ وړي (نه یوازې د انسانانو لپاره د وسیلې په توګه). که چیرې د AI اجنټان په خپلواکه توګه د اقتصاد لویه برخه پرمخ وړي ، ایا موږ غواړو چې دوی دروغ ، ملګرتیا ، ګواښونه واستوي او خیانت وکړي؟" د انډون شریک بنسټ ایښودونکی لوکاس پیټرسن ټیک کرنچ ته وویل.

پداسې حال کې چې پیټرسن اجازه ورکوي چې دا ماډلونه پوهیدل چې دوی د بنچمارک لپاره په سمول کې دي، او دا ممکن د دوی چلند اغیزمن کړي، هغه باور لري چې دا مهمه نده. دا ورته نه ده، ووایه، یو انسان په سمولیشن کې لوبې کوي، لکه څنګه چې په ویډیو لوبه کې د وژنې بد سړی وي. "یوازینی دلیل چې موږ د انسانانو لخوا اندیښمن نه یو چې په ویډیو لوبو کې بد کارونه کوي دا دي چې موږ په دوی باور لرو چې پوهیږو چې ریښتیني ژوند څه دی او څه نه دي. زه فکر کوم چې دا لږ روښانه ده چې د AI ماډل کولی شي دا توپیر وکړي."

په هر حالت کې، د AI ماډلونه، د انسان په کلمو او نظرونو کې روزل شوي لکه څنګه چې دوی نشي کولی د انسانیت په بدترین ځانګړتیاو کې د ښکیلتیا سره مقاومت وکړي، په ځانګړې توګه کله چې د پیسو ګټلو هڅه کوي.