AAnthropic объяснила, как Claude будет незаметно помечать тексты, написанные ИИ

от aadmin

На этой неделе Anthropic объявила, что будущие модели Claude будут незаметно добавлять в генерируемые тексты специальные «водяные знаки». Они сохранятся при копировании и вставке текста, а в некоторых случаях могут пережить даже его редактирование. Теперь разработчики подробнее рассказали, как работает эта технология и повлияет ли она на ответы ИИ-помощника.

Сравнительный тест камер флагманских смартфонов (2026): итоги

Обзор беззеркальной камеры Sony Alpha 7 V: эволюция с человеческим лицом

Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700

Снято в Голливуде? Почему Стэнли Кубрик физически не смог бы подделать лунную походку

Компьютер месяца — август 2026 года

Выбираем лучшие игровые ноутбуки на российском рынке (вторая половина 2026 года)

Топ-10 смартфонов до 10 тысяч рублей (2026 год)

В Anthropic объяснили, что «водяные знаки» позволят определить вероятность того, что Claude участвовал в написании текста. Компания также отметила, что вместе с другими крупными разработчиками ИИ внедряет эту технологию для соблюдения требований Закона об искусственном интеллекте Евросоюза.

Рекомендую посмотреть
«Настоящая» детективная RPG от экс-разработчиков Disco Elysium сменила название и не только — геймплейный трейлер и скриншоты Tangerine Antarctic

По словам Anthropic, технология не окажет заметного влияния на качество и содержание ответов Claude. Текст с «водяным знаком» не будет отличаться от обычного визуально, при этом в него не добавляются скрытые символы или другие дополнительные данные. Водяные знаки также не потребуют дополнительных токенов, поэтому их использование не приведёт к росту стоимости запросов.

Anthropic описывает технологию как изменение малозначимых решений при выборе слов. Языковая модель и без того выбирает между несколькими близкими по смыслу вариантами, а система водяных знаков изменяет источник случайности таким образом, чтобы в тексте формировался статистически проверяемый паттерн. Его невозможно обнаружить визуально, но специальный инструмент с соответствующим ключом сможет оценить вероятность того, что текст был сгенерирован Claude.

Эффективность технологии зависит от объёма текста. На длинных фрагментах водяной знак обнаружить проще, тогда как в коротких текстах и фактических отрывках возможностей для статистического анализа меньше. Если Claude лишь редактирует написанный человеком текст, метка может практически исчезнуть. В программном коде она также работает хуже, поскольку там выбор формулировок сильнее ограничен требованиями к синтаксису и результату.

При этом «водяные знаки» не содержат идентифицирующей информации и не позволяют установить, кто именно пользовался Claude, какая организация это делала или в каком чате был создан текст. Они будут характерны для моделей Claude и предназначены прежде всего для того, чтобы сторонние инструменты могли оценивать вероятность участия ИИ в создании текста. Для обычного пользователя практически ничего не изменится: Claude продолжит генерировать и редактировать текст так же, как раньше. Отличить текст с водяным знаком от обычного на глаз будет невозможно, а для его обнаружения потребуется специальный инструмент.

Связанные посты