Anthropic интегрирует технологию водяных знаков SynthID-Text от Google в модели Claude
Компания Anthropic планирует внедрить технологию водяных знаков SynthID-Text от Google DeepMind во все свои модели AI Claude, начиная с 2 августа 2026 года. Эта интеграция позволит встраивать скрытый статистический отпечаток в текст, сгенерированный ИИ, что даст возможность его обнаружения любому, кто обладает соответствующим криптографическим ключом.
Этот шаг соответствует статье 50(2) Кодекса практики Закона о ИИ ЕС, который требует, чтобы результаты работы ИИ были идентифицируемыми. Примечательно, что эта технология водяных знаков будет применяться по всему миру, а не только в Европе.
Как работает SynthID-Text
SynthID-Text функционирует на уровне выбора токенов в языковой модели, тонко влияя на случайность выбора слов, не ухудшая качество вывода. Например, если оба слова "облачный" и "пасмурный" могут быть следующими, водяной знак может слегка предпочесть "пасмурный", что останется статистически неуловимым для человеческих читателей, но будет идентифицируемо с помощью алгоритма обнаружения.
Anthropic утверждает, что этот водяной знак не снизит качество или читаемость текста. Собственные тесты Google с использованием SynthID-Text на модели Gemini, как сообщается, подтвердили это, не выявив потери качества в 20 миллионах ответов. Водяной знак остается неизменным даже после незначительных правок или перефразирования, разрушается только при обширных переписываниях.
Широкие последствия
Это объявление происходит на фоне более широкого регуляторного давления, при котором крупные технологические компании, такие как Google, Meta, Microsoft и OpenAI, обязались к аналогичным мерам по обеспечению происхождения контента. Anthropic планирует оснастить существующие модели Claude водяными знаками к 2 декабря 2026 года и также внедрит метаданные C2PA для поддерживаемых файлов изображений.
Тем не менее, новые исследования показывают, что процесс водяного знака может непреднамеренно повлиять на другие аспекты поведения модели, такие как инструменты, используемые во время генерации текста, и соблюдение протоколов безопасности. Anthropic готовится выпустить API для обнаружения, который позволит третьим лицам проверять, был ли текст сгенерирован Claude.
FAQ
Что такое SynthID-Text и как это работает?
SynthID-Text — это технология водяных знаков, разработанная Google DeepMind, которая встраивает скрытый статистический отпечаток в текст, сгенерированный ИИ. Она работает на уровне выбора токенов языковой модели, тонко влияя на выбор слов, чтобы создать водяной знак, который статистически не обнаружим для человеческих читателей, но может быть идентифицирован с помощью алгоритма обнаружения.
Когда Anthropic внедрит SynthID-Text в свои модели Claude?
Anthropic планирует внедрить технологию водяных знаков SynthID-Text от Google DeepMind во все свои модели ИИ Claude, начиная с 2 августа 2026 года.
Повлияет ли водяной знак на качество текста, генерируемого моделями Claude?
Anthropic утверждает, что водяной знак не ухудшит качество или читаемость текста. Тесты Google с SynthID-Text на модели Gemini не показали потери качества в 20 миллионах ответов.
Каковы более широкие последствия этой технологии водяных знаков?
Интеграция SynthID-Text соответствует регуляторным мерам, таким как Статья 50(2) Кодекса практики Закона о ИИ ЕС, который требует, чтобы результаты ИИ были идентифицируемыми. Крупные технологические компании также обязуются к подобным мерам по установлению происхождения контента, что отражает более широкое стремление к прозрачности в контенте, сгенерированном ИИ.
Будет ли способ проверить, был ли текст сгенерирован Claude?
Да, Anthropic готовит к выпуску API для обнаружения для третьих сторон, позволяющий им проверять, был ли текст сгенерирован Claude, обеспечивая ответственность и прослеживаемость в контенте, сгенерированном ИИ.
Комментарии
Комментарии публикуются после модерации.
Пока нет комментариев — напишите первым.