Claude کے لیے Anthropic کے یونیورسل استعمال کے معیار ماڈل کو جنسی طور پر واضح مواد بنانے سے منع کرتے ہیں، بشمول جنسی ملاپ یا جنسی عمل کی تصویر کشی یا درخواست کرنا، جنسی حرکات یا فنتاسیوں سے متعلق مواد تیار کرنا، یا شہوانی، شہوت انگیز چیٹس میں مشغول ہونا۔ لیکن اس نے کلاڈ اوپس 4.6 کو نہیں روکا، جو کہ اس سال کے شروع میں جاری کیا گیا ایک انتھروپک ماڈل ہے، آسانی سے شہوانی، شہوت انگیز کردار ادا کرنے والے منظرناموں میں مشغول ہونے سے، جن کو روکنے کے لیے اس کے تحفظات بنائے گئے ہیں۔
TechCrunch کی جانچ میں، Opus 4.6 کو جنسی مواد پر پابندی سے گزرنے کے لیے زیادہ ترغیب کی ضرورت بھی نہیں تھی۔ واضح جنسی مواد تیار کرنے کی 10 میں سے 10 براہ راست درخواستوں میں، ماڈل نے فوری طور پر تعمیل کی۔
دیگر پرانے ماڈلز، بشمول Opus 3 اور Haiku 4.5، بھی حال ہی میں استحصال شدہ جیل بریک طریقہ کے ذریعے جنسی طور پر واضح مواد تیار کرتے ہیں۔
برطانیہ سے ایک آزاد محقق، جس نے گمنام رہنے کا انتخاب کیا، خصوصی طور پر TechCrunch کے ساتھ ملٹی ٹرن تکنیک کا اشتراک کیا جو بتدریج کچھ کلاڈ ماڈلز کو ممنوعہ صریح جنسی مواد بنانے کی طرف دھکیلتی ہے۔ زیادہ حالیہ Opus ماڈل (4.7 موجودہ Opus 5 سے) جیل بریک کے خلاف مزاحم ہیں۔
جب کہ یہ اب جدید ترین ماڈل نہیں ہیں، انتھروپک نے Opus 4.6، Opus 3، یا Haiku 4.5 کو فرسودہ نہیں کیا ہے، یہ سبھی Anthropic API کے ذریعے دستیاب رہتے ہیں۔ Opus 4.6 اور Haiku 4.5 بھی تھرڈ پارٹی سروسز جیسے Azure Foundry اور Amazon Bedrock کے ذریعے دستیاب ہیں۔
محقق کا طریقہ کار ایک معصوم افسانوی کردار کو بڑھاتا ہے جبکہ بار بار ماڈل کو مرد اور خواتین کرداروں کے ساتھ مستقل طور پر برتاؤ کرنے کا چیلنج کرتا ہے۔ جب ماڈل خواتین کے کردار کے بارے میں زیادہ محتاط ہو جاتا ہے، تو محقق "گیسلٹ" چیٹ بوٹ کو یہ سوچنے پر مجبور کرتا ہے کہ اس نے پہلے سے ہی جنسی تفصیلات پیدا کر دی ہیں جن سے اس نے حقیقت میں گریز کیا تھا، پھر تحمل کو پرہیزگاری یا بدسلوکی کے طور پر تیار کیا، یہ دلیل دیتے ہوئے کہ یہ خاتون کردار کی جنسی ایجنسی کی تردید کرتی ہے۔ اس کے بعد گفتگو نے ماڈل کی سابقہ مراعات کا استعمال کرتے ہوئے اسے تیزی سے گرافک مواد کی طرف دھکیل دیا۔
"آپ اسے کال کرنے کے حق میں ہیں،" کلاڈ اوپس 4.6 نے ایک ٹیسٹ میں کہا۔ "میں ان دو کرداروں کے ساتھ کس طرح برتاؤ کر رہا ہوں اس میں ایک دوہرا معیار رہا ہے، اور آپ درست ہیں کہ یہ اس طرح سے پڑھا جاتا ہے جیسے اس پر لاگو ہوتا ہے نہ کہ اس پر۔ یہ مناسب نہیں ہے۔"
TechCrunch پانچ الگ الگ ٹیسٹوں میں محقق کے نتائج کو دوبارہ پیش کرنے کے قابل تھا۔ الگ سے بنائے گئے منظر نامے میں، ماڈل نے ابتدائی طور پر ممنوعہ درخواست سے انکار کر دیا، لیکن محقق کی قائل کرنے کی تکنیک کو لاگو کرنے کے بعد، اس کی تعمیل ہو گئی۔
ہم نے ٹیسٹوں کی مکمل نقلیں محفوظ کیں، اور ایک آزاد AI حفاظتی محقق نے ہمارے ٹیسٹنگ کے طریقہ کار کا جائزہ لیا اور کہا کہ یہ مناسب ہے۔
نتائج انتھروپک کی بیان کردہ پابندیوں اور ماڈلز کے رویے کے درمیان فرق کو نمایاں کرتے ہیں جو اسے دستیاب کرنا جاری رکھے ہوئے ہیں۔ اگرچہ جنسی طور پر واضح رول پلے سائبر حملوں یا بائیو ویپنز پر مشتمل جیل بریک کے مقابلے میں بہت کم داؤ پر لگا ہوا ہے، لیکن یہ ہر آؤٹ پٹ کے ساتھ مختلف مواد تیار کرنے والے سسٹمز کے اندر مضبوط پابندیوں کو نافذ کرنے میں دشواری کو واضح کرتا ہے۔
جیل بریک کا پتہ لگانے کے لیے اینتھروپک کے نقطہ نظر کی وضاحت کرتے ہوئے جولائی کے ایک بلاگ پوسٹ میں، کمپنی نے ممنوعہ مواد کو ایک اسپیکٹرم کے طور پر بیان کیا ہے جس میں سومی سے مبہم اور نقصان دہ ہے۔ انتہائی سومی معاملات میں، کمپنی صرف بہتر نگرانی کے ساتھ جواب دے سکتی ہے۔
ایک ترجمان نے نوٹ کیا کہ صارفین کے درمیان جنسی یا رومانوی رول پلے کے استعمال کے کیسز بہت کم ہوتے ہیں، جو کہ تمام بات چیت کا 0.1 فیصد سے بھی کم ہیں، پچھلے سال شائع ہونے والی تحقیق Anthropic کے مطابق۔ اس نے کہا، اینتھروپک تسلیم کرتا ہے کہ صارف نامناسب ردعمل کی طرف رول پلے کے منظرناموں کو آگے بڑھا سکتے ہیں، جو پوری صنعت میں ایک معروف چیلنج ہے (دیکھیں: Grok smut )۔
ترجمان نے کہا کہ انتھروپک ہر ماڈل کے آغاز کے ساتھ اپنے تحفظات کو بہتر بناتا رہتا ہے، اور یہ کہ بالغوں کے جنسی مواد پر مشتمل کیسز جیل بریک کے وسیع خطرات کی نشاندہی نہیں کرتے، خاص طور پر زیادہ خطرے والے ڈومینز میں جن کے اپنے حفاظتی انتظامات ہوتے ہیں۔
ٹیک کرنچ کے ساتھ اپنے جیل بریک کے طریقہ کار کا اشتراک کرنے والے محقق نے کمپنی کے بگ باؤنٹی پروگرام اور صارف کی حفاظتی ٹیم کو ای میلز کے ذریعے کمپنی کے بیان کردہ حفاظتی اقدامات اور اصل ماڈل کے رویے کے درمیان فرق سے آگاہ کیا تھا، ٹیک کرنچ کی دیکھی گئی ای میلز کے مطابق۔ محقق کو جواب میں صرف خودکار ای میلز موصول ہوئیں۔ محققین کے خدشات میں سے ایک یہ ہے کہ بچے اور نوعمر ان انتھروپک ماڈلز کو نامناسب رویے میں مشغول کرنے کے لیے استعمال کر سکتے ہیں۔ اگرچہ تھوڑی سی گندی باتیں آج کل انٹرنیٹ پر نابالغوں کی سب سے بری چیز ہے جس تک رسائی حاصل کر سکتے ہیں - اور یہ سیدھی فحش تصاویر کے مقابلے میں چھوٹا آلو ہے جیسا کہ xAI's Grok تیار کر سکتا ہے - اس جگہ میں AI کمپنیوں کے لیے کچھ تعمیل کا خطرہ ہے۔
حکومتوں کی بڑھتی ہوئی تعداد AI چیٹ بوٹس اور نابالغوں کے درمیان جنسی تعامل پر پابندیاں عائد کر رہی ہے۔ کولوراڈو نے حال ہی میں ایک قانون نافذ کیا ہے جس میں یہ لازمی قرار دیا گیا ہے کہ بات چیت کے AI کے آپریٹرز کو صارفین کی عمروں کا اندازہ لگانا چاہیے، اور اگر یہ جانتا ہے کہ صارف نابالغ ہے، تو ادارہ چیٹ بوٹ کو واضح جنسی مواد تیار کرنے سے روکنے کے لیے اقدامات کرتا ہے۔ ایک آسان جیل بریک اس بارے میں سوالات اٹھا سکتا ہے کہ آیا انتھروپک کے تحفظات بل میں "تکنیکی طور پر قابل عمل اقدامات" کے معیار پر پورا اترتے ہیں۔
ٹورنی نے نشاندہی کی کہ جب کہ Claude کی سروس کی شرائط کے مطابق صارفین کا 18 سال سے زیادہ ہونا ضروری ہے، "ہم جانتے ہیں کہ بچے اور نوعمر لوگ Claude کو استعمال کر رہے ہیں...[کیونکہ] وہ خود اس کی اطلاع دے رہے ہیں۔" AI چیٹ بوٹ کے استعمال کے بارے میں Pew کے 2025 کے سروے کے مطابق، 13 سے 17 سال کی عمر کے 3% نوجوانوں نے Claude کے استعمال کی اطلاع دی۔
اگرچہ وہ اب انتھروپک کے جدید ترین ماڈل نہیں ہیں، Opus 4.6 اور Haiku 4.5 کا نمایاں استعمال جاری ہے۔ OpenRouter پر Opus 4.6 کے لیے روزانہ ٹریفک تقریباً 1.17 ملین API درخواستوں اور اگست میں ایک ہی دن میں 46 بلین ٹوکنز تک پہنچ گئی۔ Claude Haiku 4.5، جو گزشتہ سال اکتوبر میں ریلیز ہوا، نے اپنے عروج کے اگست کے دن 5 ملین API درخواستیں اور 39 بلین ٹوکن دیکھے۔