Ответы Claude получат невидимые водяные знаки — Affelist

Anthropic добавит невидимые водяные знаки в контент, созданный ИИ

Anthropic готовится внедрить систему скрытой маркировки контента, создаваемого ее AI-инструментами. Невидимые водяные знаки планируется встраивать непосредственно в результаты работы ИИ — от обычных текстовых ответов до программного кода, изображений и файлов. Пользователь визуально не заметит такую метку, однако специальные инструменты смогут определить происхождение контента.

Невидимая маркировка появится в разных типах контента

Система не должна ограничиваться обычными ответами чат-бота. Anthropic планирует распространять технологию на различные материалы, которые могут создавать AI-агенты.

Маркировка сможет присутствовать в текстах, сгенерированных файлах, изображениях и программном коде. Таким образом компания рассчитывает сохранить возможность идентификации AI-контента независимо от его формата.

Особенно актуальным такой подход становится по мере развития автономных агентов, результаты работы которых пользователи все чаще переносят за пределы первоначального AI-сервиса.

Водяной знак будет незаметен пользователю

Ключевой особенностью технологии должна стать ее скрытая работа. В отличие от визуальных предупреждений или подписей о генерации с помощью ИИ, водяной знак не будет заметен при обычном просмотре материала.

Предполагается, что маркировка сможет сохраняться даже после стандартных действий с контентом, включая его копирование и последующую вставку в другое место.

За счет этого определить AI-происхождение материала потенциально можно будет уже после того, как он покинул интерфейс, в котором первоначально был создан.

Технологию планируют использовать в продуктах с AI-агентами

Маркировка должна распространяться на платформы Anthropic, предоставляющие доступ к агентным возможностям Claude.

В частности, механизм может применяться при работе с инструментами для программирования и другими сервисами, где AI-агенты самостоятельно создают или изменяют контент.

Для разработчиков это особенно важно в случае с кодом: скрытая маркировка потенциально позволит отличать материалы, созданные или обработанные AI-системой, без добавления видимых комментариев непосредственно в исходники.

Проверить наличие метки смогут пользователи и сторонние сервисы

Anthropic также намерена предоставить средства для определения скрытой маркировки.

Инструменты проверки должны позволить установить, содержит ли конкретный материал соответствующий водяной знак. Доступ к такой проверке планируется предоставить не только самим пользователям, но и сторонним сервисам.

В перспективе это может позволить другим платформам автоматически определять контент, созданный с помощью инструментов Anthropic, и учитывать эту информацию при модерации или проверке происхождения материалов.

Водяные знаки могут стать способом идентификации AI-контента

Распространение генеративного ИИ значительно усложнило определение происхождения текстов, изображений и программного кода. При этом обычные детекторы, пытающиеся определить AI-контент исключительно по его характеристикам, не всегда дают надежный результат.

Встраиваемая маркировка предлагает другой подход: вместо попытки угадать происхождение готового материала информация о нем закладывается непосредственно во время генерации.

Практическая эффективность такой системы будет зависеть от того, насколько устойчивыми окажутся метки после редактирования, переформулирования, изменения файлов или других преобразований контента.

Если Anthropic удастся сделать маркировку достаточно устойчивой, технология может стать дополнительным инструментом для подтверждения происхождения материалов на фоне стремительного роста объемов AI-контента.

Affelist
Добавить комментарий