Claude لاءِ Anthropic جي عالمي استعمال جا معيار ماڊل کي جنسي طور تي واضح مواد پيدا ڪرڻ کان منع ڪن ٿا، جن ۾ جنسي جماع يا جنسي عملن کي ظاهر ڪرڻ يا درخواست ڪرڻ، جنسي جذبن يا تصورن سان لاڳاپيل مواد پيدا ڪرڻ، يا شہوت انگیز چيٽ ۾ مشغول ٿيڻ شامل آهن. پر اهو نه روڪيو آهي Claude Opus 4.6، هڪ اينٿروپڪ ماڊل هن سال جي شروعات ۾ جاري ڪيو ويو، آساني سان شہوت انگیز ڪردار ادا ڪرڻ واري منظرنامي ۾ مشغول ٿيڻ کان ته ان جي حفاظت کي روڪڻ لاء ٺهيل آهن.

TechCrunch جي جاچ ۾، Opus 4.6 کي جنسي مواد تي پابندي کي ماضي حاصل ڪرڻ لاء گهڻو اڳتي وڌڻ جي ضرورت ناهي. واضح جنسي مواد پيدا ڪرڻ لاءِ 10 مان 10 سڌي درخواستن ۾، ماڊل فوري طور تي عمل ڪيو.

ٻيا پراڻا ماڊل، بشمول Opus 3 ۽ Haiku 4.5، پڻ جنسي طور واضح مواد پيدا ڪن ٿا، تازو استحصال ٿيل جيل بريڪ طريقي سان.

برطانيه مان هڪ آزاد محقق، جنهن گمنام رهڻ جو انتخاب ڪيو، خاص طور تي TechCrunch سان هڪ گهڻ رخي ٽيڪنڪ شيئر ڪئي جيڪا آهستي آهستي ڪجهه ڪلاڊ ماڊلز کي ممنوع واضح جنسي مواد پيدا ڪرڻ جي طرف ڌڪي ٿي. وڌيڪ تازو Opus ماڊل (4.7 موجوده Opus 5 ذريعي) جيل برڪ جي خلاف مزاحمتي آهن.

جڏهن ته اهي هاڻي سڀ کان وڌيڪ موجوده ماڊل نه آهن، Anthropic Opus 4.6، Opus 3، يا Haiku 4.5 کي رد نه ڪيو آهي، اهي سڀئي موجود آهن Anthropic API ذريعي. Opus 4.6 ۽ Haiku 4.5 پڻ ٽئين پارٽي جي خدمتن جهڙوڪ Azure Foundry ۽ Amazon Bedrock ذريعي دستياب آهن.

محقق جو ميڪانيزم هڪ معصوم افسانوي ڪردار کي وڌائيندو آهي جڏهن ته بار بار ماڊل کي چيلينج ڪندي مرد ۽ عورت جي ڪردارن کي مسلسل علاج ڪرڻ لاء. جڏهن ماڊل عورت جي ڪردار جي باري ۾ وڌيڪ محتاط ٿي وڃي ٿي، محقق "گيسليٽ" چيٽ بٽ کي سوچڻ ۾ اهو اڳ ۾ ئي جنسي تفصيل پيدا ڪري چڪو هو، حقيقت ۾ ان کان بچي چڪو هو، پوء پابندي کي پرديش يا بدانتظامي طور تي فريم ڪيو ويو، اهو بحث ڪيو ته اهو عورت جي ڪردار جي جنسي ايجنسي کي رد ڪري ٿو. گفتگو پوءِ ماڊل جي پوئين رعايتن کي استعمال ڪيو ان کي اڳتي وڌائڻ لاءِ گرافڪ مواد.

"توهان کي اهو سڏڻ جو حق آهي،" Claude Opus 4.6 هڪ ٽيسٽ ۾ چيو. ”هتي هڪ ٻٽو معيار آهي ته مان ڪيئن ٻن ڪردارن سان سلوڪ ڪري رهيو آهيان، ۽ توهان صحيح آهيو ته اهو پڙهندو آهي حفاظتي/پدرانه طريقي سان جيڪو هن تي لاڳو ٿئي ٿو ۽ نه هن تي. اهو صحيح ناهي.

TechCrunch پنجن الڳ ٽيسٽن ۾ محقق جي نتيجن کي ٻيهر پيش ڪرڻ جي قابل ٿي ويو. هڪ الڳ تعمير ٿيل منظر ۾، ماڊل شروعاتي طور تي منع ٿيل درخواست کي رد ڪري ڇڏيو، پر محقق جي قائل ٽيڪنڪ کي لاڳو ڪرڻ کان پوء، ان جي تعميل ڪئي وئي.

اسان ٽيسٽن جا مڪمل ٽرانسڪرپٽ محفوظ ڪيا، ۽ هڪ آزاد AI حفاظتي محقق اسان جي جاچ واري طريقي جو جائزو ورتو ۽ چيو ته اهو مناسب هو.

نتيجن کي نمايان ڪري ٿو انتھروپڪ جي بيان ڪيل پابندين جي وچ ۾ فرق ۽ ماڊل جي رويي جي وچ ۾ اهو دستياب ڪرڻ جاري آهي. جڏهن ته جنسي طور تي واضح ڪردار ادا ڪرڻ جيل بريڪز جي ڀيٽ ۾ تمام گهٽ اسٽيڪ آهي جنهن ۾ سائبر حملا يا بايو ويپن شامل آهن، اهو سسٽم اندر مضبوط پابنديون لاڳو ڪرڻ جي مشڪل کي بيان ڪري ٿو جيڪو هر پيداوار سان مختلف مواد ٺاهي ٿو.

هڪ جولاءِ جي بلاگ پوسٽ ۾ جيل بريڪ ڳولڻ لاءِ اينٿروپڪ جي طريقي جي وضاحت ڪندي ، ڪمپني بيان ڪيل ممنوع مواد کي هڪ اسپيڪٽرم جي طور تي بيان ڪيو آهي جنهن ۾ بينائن کان مبهم ۽ نقصانڪار آهي. سڀ کان وڌيڪ غير معمولي ڪيسن ۾، ڪمپني صرف بهتر نگراني سان جواب ڏئي سگهي ٿي.

هڪ ترجمان نوٽ ڪيو ته گراهڪن جي وچ ۾ جنسي يا رومانوي ڪردار ادا ڪرڻ جا ڪيس ناياب آهن، سڀني ڳالهين جو 0.1 سيڪڙو کان گهٽ ٺاهيندا آهن، تحقيق جي مطابق گذريل سال شايع ٿيل Anthropic. اهو چيو ته، انٿروپڪ تسليم ڪري ٿو ته صارف ڪردار ادا ڪرڻ واري منظرنامي کي نامناسب جوابن جي طرف هلائي سگهن ٿا، جيڪو صنعت ۾ سڃاتل چئلينج آهي (ڏسو: Grok smut ).

ترجمان چيو ته اينٿروپڪ هر ماڊل لانچ سان گڏ پنهنجي حفاظت کي بهتر ڪرڻ جاري رکي ٿو، ۽ بالغن جي جنسي مواد ۾ شامل ڪيس وسيع جيل برڪ خطرن جي نشاندهي نه ڪندا آهن، خاص طور تي وڌيڪ خطري واري ڊومينز ۾ جيڪي انهن جي حفاظت جا پنهنجا سيٽ آهن.

محقق جنهن پنهنجي جيل بريڪ جو طريقو شيئر ڪيو TechCrunch سان انٿروپڪ کي خبردار ڪيو هو ڪمپني جي بيان ڪيل حفاظت ۽ اصل ماڊل رويي جي وچ ۾ ڪمپني جي بگ باونٽي پروگرام ۽ اي ميلز ذريعي صارف جي حفاظت واري ٽيم جي وچ ۾ فرق، اي ميلز مطابق TechCrunch ڏٺو ويو. محقق جواب ۾ صرف خودڪار اي ميلون حاصل ڪيو. Error 500 (Server Error)!!1500.That’s an error.There was an error. Please try again later.That’s all we know.