Нейросеть Claude будет незаметно помечать свои ответы

Обновлено:
клауд антропик

Фото: Zuma / TASS

Старые модели Claude пока не имеют встроенной маркировки, но Anthropic работает над их обновлением.

Добавить в основные
источники Google

Американская технологическая компания в сфере ИИ Anthropic начинает использовать скрытую маркировку в тексты, генерируемые обновленными версиями моделей Claude, сообщает Interesting Engineering.

Это делается для соблюдения требований прозрачности, установленных Евросоюзом.

Нововведение реализовано на уровне самого алгоритма: все новые модели автоматически помечают водяными знаками создаваемый продукт. Причиной стала ст. 50 Европейского закона об ИИ. Anthropic также присоединилась к добровольному кодексу практики ЕС, касающемуся ИИ-контента.

Для разных типов данных предусмотрены разные методы: в текст встраиваются невидимые водяные знаки, а для изображений и поддерживаемых форматов используются подписанные метаданные о происхождении по стандарту C2PA. Маркировка будет применяться ко всем пользователям по всему миру, не только в Европе.

Как пояснили в компании, «едва заметный сигнал» будет встроен прямо в ответы Claude. Прочитав текст, обычный пользователь не сможет его распознать, но метка сохранится при копировании и, как ожидается, сможет пережить редактирование.

Маркировка затронет все продукты Anthropic: API, Claude, Claude Code, Claude Cowork и Claude Tag. Облачные клиенты, работающие через AWS, Google Cloud и Microsoft Foundry, также получат размеченные результаты.

Компания обещала опубликовать техническую документацию по обнаружению водяных знаков, чтобы пользователи и независимые эксперты могли проверять подлинность контента.

При этом существует ограничение: метаданные могут теряться при конвертации файлов, создании скриншотов или повторном сохранении.

Старые модели Claude пока не имеют встроенной маркировки, но Anthropic работает над их обновлением в течение переходного периода, предусмотренного законодательством Евросоюза.