Пользователи Claude обсуждают введение водяных знаков с тех пор, как компания объявила на этой неделе о своем намерении внедрить эту технологию в соответствии с Кодексом прозрачности Закона ЕС об ИИ, который требует от компаний по разработке ИИ использовать системы, позволяющие идентифицировать контент, созданный ИИ. На Reddit, например, один из пользователей охарактеризовал это как заговор против невинных пользователей Claude, в то время как другой заявил: «Единственная причина, по которой вы не хотите этого, — это обман людей». Business Insider сообщает, что «десятки» пользователей на платформе X заявили о том, что отменили свои подписки на Claude в результате этого решения.

Новая публикация Anthropic начинается с общего обзора концепции водяных знаков, объясняя, что при принятии «незначительных решений» — например, выборе между словами «облачно» и «серый» для описания погоды — Claude может создавать шаблон в своих ответах, который «недоступен для читателя, но обнаружим для любого, у кого есть ключ, который его кодирует». Компания отметила: «Водяные знаки не влияют на качество вывода Claude. Для читателя ответ с водяным знаком неотличим от ответа без него». Более конкретно, Anthropic сообщила, что будет использовать подход SynthID-Text, который команда Google DeepMind описала в 2024 году, и что планирует выпустить API для обнаружения водяных знаков.

Компания также отметила, что водяные знаки отличаются от подходов к обнаружению ИИ, предлагаемых такими компаниями, как Pangram, которые ищут «знаки» в тексте (например, конструкции «это не [X], это [Y]»), чтобы выявить использование ИИ: «Обнаружение этих паттернов принципиально отличается от проверки на наличие водяного знака». Возможно ли переписать текст, чтобы скрыть водяной знак? Anthropic ответила, что это возможно, но «незначительное редактирование, вероятно, не удалит водяной знак полностью», в то время как «полная перепись, при которой каждое слово заменяется, удалит его». «В последнем случае, конечно, можно утверждать, что текст больше нельзя описывать как созданный ИИ», — добавила компания.

Что касается того, будет ли водяной знак обнаружим в тексте, который был только вычитан или отредактирован Claude, Anthropic заявила, что это будет зависеть от «длины текста и того, насколько сильно его редактировал Claude». Если текст был лишь слегка отредактирован, «почти все слова» будут написаны человеком, и «водяному знаку будет очень трудно прикрепиться». Код, в свою очередь, должен иметь меньший водяной знак, чем другой текст, поскольку модель должна создавать рабочий код и не будет иметь свободы выбора между различными равноценными вариантами. «Тем не менее, в областях, где существует произвольный выбор между конкретными словами или терминами в коде, водяной знак может быть использован, например, в комментариях к коду», — отметила Anthropic. «Но по определению он будет иметь незначительное влияние на фактически созданный код». Anthropic также сообщила, что Claude не будет единственным чат-ботом ИИ, генерирующим текст с водяными знаками, так как «другие крупные разработчики моделей подписали тот же Кодекс практики и будут внедрять свои собственные водяные знаки».

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *