
Компания Anthropic внедрила систему невидимых вотермарков для всех новых моделей своей нейросети Claude. Теперь каждый сгенерированный текст содержит скрытую метку, которая встраивается непосредственно в контент и остается незаметной при чтении. Это нововведение затрагивает ответы, созданные в приложении, через API, а также в инструментах Claude Code, Cowork и Тэг.
Вотермарки устойчивы к копированию и вставке, что позволяет отслеживать происхождение текста даже после его распространения. Для файлов, таких как SVG, PNG и JPG, Anthropic использует отдельную систему — подписанные метаданные по стандарту C2PA. Это обеспечивает дополнительный уровень защиты и верификации для визуального контента.
Важно отметить, что маркировка применяется только к моделям, выпущенным после 2 августа. Более старые версии пока не получили обновлений, хотя компания заявляет, что работает над их внедрением. Однако точные сроки не раскрываются.
Причиной такого шага стал новый закон Европейского Союза об искусственном интеллекте, который требует маркировать весь сгенерированный контент. Anthropic решила не ограничиваться только европейскими пользователями и включила вотермарки для всех пользователей по всему миру. Это упрощает соблюдение нормативных требований и повышает прозрачность использования ИИ.
Для пользователей это означает, что теперь можно легко отличить контент, созданный Claude, от человеческого. Однако это также накладывает определенные ограничения: например, при написании академических работ или других материалов, где требуется оригинальность, следует учитывать наличие скрытых меток.
Внедрение вотермарков — важный шаг в развитии ответственного ИИ. Оно помогает бороться с дезинформацией и обеспечивает доверие к генерируемому контенту. Хотя технология пока не совершенна, она уже демонстрирует стремление Anthropic к прозрачности и соблюдению международных стандартов.
В будущем можно ожидать, что подобные меры станут стандартом для всех крупных разработчиков ИИ. Это позволит создать более безопасную цифровую среду и защитить пользователей от потенциальных злоупотреблений.




