Anthropic раскрыла механизм «невидимых водяных знаков» в Claude

Фото: ITmedia
Краткий ответ
Anthropic внедрила в тексты, генерируемые ИИ-моделью Claude, статистические водяные знаки с помощью секретного ключа.
Компания Anthropic, разработчик ИИ-модели Claude, раскрыла технические детали механизма внедрения «невидимых» водяных знаков в генерируемые тексты. Технология использует секретный ключ для формирования статистических паттернов, которые не ухудшают качество ответов, скорость работы или стоимость сервиса.
По словам представителей Anthropic, основной целью нововведения является соответствие требованиям европейского регламента EU AI Act, регулирующего использование искусственного интеллекта. Однако водяные знаки применяются ко всем пользователям модели вне зависимости от региона. При этом отмечается, что технология имеет ограничения: она малоэффективна для коротких фраз, программного кода или других специфических форматов контента.
Водяные знаки не видны пользователю и не влияют на восприятие текста, но позволяют идентифицировать его происхождение при необходимости. Полная переработка текста может привести к исчезновению этих маркеров, что также указано в документации компании.
Частые вопросы
- Что такое водяные знаки в текстах ИИ-моделей?
- Это скрытые статистические паттерны, внедряемые в генерируемый текст для идентификации его происхождения. Они позволяют определить, что текст создан ИИ, но не влияют на его содержание или качество.
- Почему Anthropic внедряет водяные знаки в Claude?
- Основная цель — соответствие требованиям европейского законодательства (EU AI Act), а также повышение прозрачности использования ИИ. Технология применяется глобально, но не во всех типах контента.
- Можно ли удалить водяные знаки из текста?
- Да, при полной переработке текста или его значительном изменении водяные знаки могут исчезнуть. Также они плохо работают с короткими фразами или программным кодом.
Лента для Дзен: /feed/dzen.xml · RSS: /feed.xml