Антропоик опубликовал в блоге пост в пятницу, пытаясь ответить на некоторые основные вопросы о том, как он будет ставить водяные знаки на текст, генерируемый его чат-ботом Клодом. Например: как на самом деле будет работать водяные знаки? Можно ли их скрыть при редактировании? И как это влияет на код?
Пользователи Клода обсуждают этот шаг с тех пор, как компания объявила ранее на этой неделе, что будет делать такие водяные знаки, чтобы соответствовать Кодексу прозрачности Акта ЕС об искусственном интеллекте, который требует от компаний, занимающихся искусственным интеллектом, использовать системы, позволяющие идентифицировать контент, созданный с помощью ИИ.
На Reddit, например, один пользователь охарактеризовал это как заговор против невинных пользователей Клода, в то время как другой утверждал: «Единственная причина, по которой вы не захотите этого, — это ложь людям». И Business Insider сообщает, что «десятки» пользователей в X заявили, что в результате отменили свои подписки на Клода.
Новый пост Антропоик начинается с общего обзора концепции водяных знаков, объясняя, что при принятии «решений с низкими ставками» — например, при выборе между словами «пасмурный» и «серый» для описания погоды — Клод может создать закономерность в своих ответах, которая «незаметна для читателя, но обнаруживается любым, у кого есть ключ, который её кодирует».
«Водяные знаки не влияют на качество вывода Клода, — заявила компания. — Для читателя ответ с водяными знаками неотличим от ответа без водяных знаков».
Более конкретно, Антропоик сказал, что будет использовать подход SynthID Text, который команда Google DeepMind описала в 2024 году, и что планирует выпустить API обнаружения водяных знаков. Также было отмечено, что использование водяных знаков отличается от подходов к обнаружению ИИ, предлагаемых такими компаниями, как Pangram, которые ищут «указания» в тексте (например, конструкция «это не [X], это [Y]») для выявления использования ИИ: «Выявлять эти закономерности принципиально отличается от проверки наличия водяных знаков».
Может кто-нибудь просто переписать текст, чтобы скрыть водяной знак? Anthropic сказала, что это возможно, но «лёгкое редактирование, вероятно, не удалит водяной знак полностью», в то время как «полностью переписать, где каждое слово будет заменено, будет».
«В последнем случае, конечно, можно спорить, можно ли ещё описывать текст как сгенерированный ИИ», — сказала компания.
Что касается того, будет ли заметен водяной знак в тексте, который был только вычищен или отредактирован Клодом, Anthropic сказала, что это будет зависеть от «длины текста и того, насколько сильно Клод его отредактировал». Если он был только слегка отредактирован, «почти все слова» будут написаны человеком-автором, и «водяному знаку практически не к чему будет привязаться (если вообще к чему-то)».
Между тем код должен иметь меньше водяного знака, чем другой текст, потому что модели нужно будет создать работающий код, и у неё не будет свободы выбора между множеством одинаково допустимых вариантов.
«Сказав это, в областях, где существует произвольный выбор между определёнными словами или терминами в коде, водяной знак может быть использован, например, в комментариях в коде», — сказала Anthropic. «Но по определению это окажет незначительное влияние на фактически созданный код».
Anthropic также сообщила, что Клод будет не единственным чат-ботом с ИИ, генерирующим текст с водяными знаками, поскольку «другие крупные разработчики моделей подписали тот же Кодекс практики и будут внедрять свои собственные водяные знаки».
Читайте также другие новости на нашем сайте: Главная страница
Источник: techcrunch.com

Добавить комментарий