اینتھروپک نے جُمُعَہ کو ایک بلاگ پوسٹ شائع کی جس میں کچھ بنیادی سوالات کے جوابات دینے کی کوشش کی گئی کہ یہ اپنے چیٹ بوٹ کلاڈ کے ذریعہ تیار کردہ متن کو کس طرح واٹر مارک کرے گا۔ جیسے: واٹر مارکنگ دراصل کیسے کام کرے گی؟ کیا اسے ایڈیٹنگ سے چھپایا جا سکتا ہے؟ اور یہ کوڈ کو کیسے متاثر کرتا ہے؟
کلاڈ کے صارفین اس اقدام پر بحث کر رہے ہیں جب سے کمپنی نے اس ہفتے کے شروع میں انکشاف کیا تھا کہ وہ یہ واٹر مارکنگ EU AI ایکٹ کے ٹرانسپِیرنسی کوڈ کی تعمیل کرنے کے لیے کر رہی ہے، جس کے لیے AI کمپنیوں کو ایسے سسٹمز استعمال کرنے کی ضرورت ہے جو AI سے تیار کردہ مواد کی شناخت ممکن بناتے ہیں۔
Reddit پر، مثال کے طور پر، ایک پوسٹر نے اسے بے گناہ Claude صارفین کے خلاف سازش قرار دیا، جب کہ دوسرے نے دعویٰ کیا، "صرف ایک وجہ یہ ہے کہ آپ لوگوں سے جھوٹ بولنا نہیں چاہتے۔" اور بزنس انسائیڈر رپورٹ کرتا ہے کہ X پر "درجنوں" صارفین نے نتیجہ کے طور پر اپنی کلاڈ سبسکرپشنز منسوخ کرنے کا دعویٰ کیا ہے۔
اینتھروپک کی نئی پوسٹ واٹر مارکنگ کے تصور کے عمومی جائزہ کے ساتھ شروع ہوتی ہے، جس میں یہ وضاحت کی گئی ہے کہ جب "کم داؤ والے انتخاب" کرتے ہیں - جیسے موسم کو بیان کرنے کے لیے الفاظ "اوورکاسٹ" اور "گرے" کے درمیان انتخاب کرتے ہیں - کلاڈ اپنے جوابات میں ایک ایسا نمونہ بنا سکتا ہے جو "قارئین کے لیے ناقابل شناخت ہے، لیکن ہر اس شخص کے لیے قابل شناخت ہے جس کے پاس کوئی کلید ہے جو اسے انکوڈ کرتی ہے۔
"واٹر مارکنگ کلاڈ کے آؤٹ پٹ کے معیار کو متاثر نہیں کرتی ہے،" کمپنی نے کہا۔ "قارئین کے لیے، واٹر مارک والا جواب غیر واٹر مارک والے سے الگ نہیں ہے۔"
مزید خاص طور پر، Anthropic نے کہا کہ وہ SynthID-Text اپروچ استعمال کرے گا جس کا خاکہ Google DeepMind ٹیم نے 2024 میں دیا تھا، اور یہ کہ وہ واٹر مارک کا پتہ لگانے والا API جاری کرنے کا ارادہ رکھتی ہے۔ اس نے یہ بھی نوٹ کیا کہ واٹر مارکنگ AI کے استعمال کو ظاہر کرنے کے لیے Pangram جیسی کمپنیوں کی طرف سے پیش کردہ AI کا پتہ لگانے کے طریقوں سے الگ ہے جو تحریر میں "بتاتی ہے" تلاش کرتی ہے (جیسے کہ تعمیر "وہ [X] نہیں ہے، یہ [Y] ہے") AI کے استعمال کو ظاہر کرنے کے لیے: "ان نمونوں کو اٹھانا بنیادی طور پر واٹر مارک کو چیک کرنے سے مختلف ہے۔"
کیا کوئی واٹر مارک کو چھپانے کے لیے متن کو دوبارہ لکھ سکتا ہے؟ اینتھروپک نے کہا کہ یہ ممکن ہے، لیکن "ہلکی ترمیم شاید واٹر مارک کو مکمل طور پر نہیں ہٹائے گی،" جبکہ "ایک مکمل دوبارہ لکھنا جہاں ہر لفظ کو تبدیل کیا جائے گا۔"
"مؤخر الذکر صورت میں، یقینا، یہ قابل بحث ہے کہ آیا متن کو مزید AI سے تیار کردہ کے طور پر بیان کیا جا سکتا ہے،" کمپنی نے کہا۔
جہاں تک کہ آیا واٹر مارک متن میں قابل شناخت ہوگا جو صرف کلاڈ کے ذریعہ پڑھا گیا تھا یا اس میں ترمیم کی گئی تھی، انتھروپک نے کہا کہ اس کا انحصار اس بات پر ہوگا کہ "متن کی لمبائی اور کلاڈ نے اس میں کتنی بھاری ترمیم کی ہے۔" اگر اس میں صرف ہلکے سے ترمیم کی گئی ہے تو، "تقریباً تمام الفاظ" انسانی مصنف نے لکھے ہوں گے اور "واٹر مارک کے منسلک کرنے کے لیے بہت کم (اگر کچھ ہے)"۔
کوڈ، اس دوران، دوسرے متن کے مقابلے میں کم واٹر مارک ہونا چاہیے، کیونکہ ماڈل کو ورکنگ کوڈ بنانے کی ضرورت ہوگی اور اسے مختلف مساوی طور پر درست اختیارات میں سے انتخاب کرنے کی آزادی نہیں ہوگی۔
"یہ کہنے کے بعد، ان علاقوں میں جہاں کوڈ کے اندر مخصوص الفاظ یا اصطلاحات کے درمیان صوابدیدی انتخاب ہے، واٹر مارک استعمال کیا جا سکتا ہے، جیسے کوڈ کے اندر تبصرے،" اینتھروپک نے کہا۔ "لیکن تعریف کے مطابق، اس کا پیدا کردہ اصل کوڈ پر نہ ہونے کے برابر اثر پڑے گا۔"
اینتھروپک نے یہ بھی کہا کہ کلاڈ واٹر مارک ٹیکسٹ تیار کرنے والا واحد AI چیٹ بوٹ نہیں ہوگا، کیونکہ "دیگر بڑے ماڈل ڈویلپرز نے اسی کوڈ آف پریکٹس پر دستخط کیے ہیں اور وہ اپنے واٹر مارکس کو نافذ کریں گے۔"