Нейросеть Claude будет незаметно помечать свои ответы

Фото: Zuma / TASS
Старые модели Claude пока не имеют встроенной маркировки, но Anthropic работает над их обновлением.
Добавить в основныеисточники Google
Американская технологическая компания в сфере ИИ Anthropic начинает использовать скрытую маркировку в тексты, генерируемые обновленными версиями моделей Claude, сообщает Interesting Engineering.
Это делается для соблюдения требований прозрачности, установленных Евросоюзом.
Нововведение реализовано на уровне самого алгоритма: все новые модели автоматически помечают водяными знаками создаваемый продукт. Причиной стала ст. 50 Европейского закона об ИИ. Anthropic также присоединилась к добровольному кодексу практики ЕС, касающемуся ИИ-контента.
Для разных типов данных предусмотрены разные методы: в текст встраиваются невидимые водяные знаки, а для изображений и поддерживаемых форматов используются подписанные метаданные о происхождении по стандарту C2PA. Маркировка будет применяться ко всем пользователям по всему миру, не только в Европе.
Как пояснили в компании, «едва заметный сигнал» будет встроен прямо в ответы Claude. Прочитав текст, обычный пользователь не сможет его распознать, но метка сохранится при копировании и, как ожидается, сможет пережить редактирование.
Маркировка затронет все продукты Anthropic: API, Claude, Claude Code, Claude Cowork и Claude Tag. Облачные клиенты, работающие через AWS, Google Cloud и Microsoft Foundry, также получат размеченные результаты.
Компания обещала опубликовать техническую документацию по обнаружению водяных знаков, чтобы пользователи и независимые эксперты могли проверять подлинность контента.
При этом существует ограничение: метаданные могут теряться при конвертации файлов, создании скриншотов или повторном сохранении.
Старые модели Claude пока не имеют встроенной маркировки, но Anthropic работает над их обновлением в течение переходного периода, предусмотренного законодательством Евросоюза.

