Anthropic внедрит водяные знаки в текст, сгенерированный ИИ Claude

Фото: BleepingComputer
Краткий ответ
Anthropic внедряет невидимые водяные знаки в текст, генерируемый ИИ-моделью Claude, чтобы соответствовать требованиям Евросоюза. Технология основана на изменении процесса выбора токенов и не влияет на качество контента.
Компания Anthropic, разработчик ИИ-модели Claude, объявила о внедрении технологии невидимых водяных знаков для текстов, генерируемых её системой. Это решение направлено на соответствие требованиям Евросоюза, обязывающим разработчиков ИИ маркировать контент, созданный искусственным интеллектом. Водяные знаки будут применяться ко всем новым моделям Claude по всему миру, а позже — и к версиям, выпущенным до августа 2026 года.
Технология основана на подходе Google DeepMind SynthID-Text и работает на уровне выбора токенов во время генерации текста. Вместо добавления скрытых символов или изменения готового контента, система модифицирует процесс случайного выбора следующего слова, используя секретный ключ. Это создаёт статистический паттерн, который можно обнаружить с помощью специального детектора, но он остаётся незаметным для пользователей. По данным Anthropic, водяные знаки не влияют на качество, креативность или читаемость текстов.
Исключения предусмотрены для фактов и кода: если существует только один правильный вариант ответа (например, «2 + 2 = 4»), водяные знаки не применяются. Аналогично, в коде они используются только там, где возможен произвольный выбор, например, в комментариях. Для обнаружения водяных знаков Anthropic планирует выпустить API, который позволит оценить вероятность того, что текст был создан или отредактирован с помощью Claude.
Для изображений в форматах PNG, JPG и SVG компания использует другой подход: вместо внедрения водяных знаков в файл добавляется криптографически подписанный метаданные C2PA, указывающие на участие Claude в создании или обработке контента.
Частые вопросы
- Что такое водяные знаки в текстах ИИ?
- Это невидимые маркеры, внедряемые в текст во время генерации, которые позволяют определить, что контент создан ИИ-моделью. Они не влияют на качество или читаемость текста.
- Как работают водяные знаки в Claude?
- Технология изменяет процесс выбора токенов при генерации текста, используя секретный ключ. Это создаёт статистический паттерн, который можно обнаружить с помощью специального детектора, но не видно пользователю.
- Повлияют ли водяные знаки на качество текстов Claude?
- Нет, по данным Anthropic, водяные знаки не снижают креативность, читаемость или точность генерируемого контента. Они не добавляют скрытых символов и не замедляют генерацию.
- Можно ли обойти водяные знаки в текстах Claude?
- Полное переписывание текста может удалить водяные знаки, но лёгкое редактирование или правки не устранят их полностью. Для надёжного обнаружения требуется достаточно длинный фрагмент текста.
Лента для Дзен: /feed/dzen.xml · RSS: /feed.xml