Введение
Anthropic начала внедрять машиночитаемые маркеры для контента, генерируемого поддерживаемыми моделями Claude.
Изменение включает два уровня:
- Водяные знаки, встраиваемые в генерируемый текст.
- Метаданные provenance с цифровой подписью для поддерживаемых генерируемых файлов.
Эта политика связана с обязательствами Anthropic в рамках Кодекса поведения ЕС по прозрачности ИИ-контента согласно статье 50(2) Закона ЕС об искусственном интеллекте.
Однако масштаб внедрения выходит за пределы ЕС.
Anthropic заявляет, что когда модели Claude поддерживают маркировку, эти маркеры применяются ко всем каналам предоставления данной модели по всему миру. Независимо от того, исходит ли вывод из потребительского интерфейса Claude, API, Claude Code, Claude Cowork, Claude Tag или поддерживаемых интеграций облачных провайдеров, текстовая маркировка на уровне модели должна присутствовать.
Это не означает, что весь ранее сгенерированный текст Claude теперь можно обнаружить.
Существует несколько важных ограничений:
- Модели, выпущенные до внедрения функции маркировки, могут не иметь маркеров.
- Значительное редактирование, переписывание, перевод или смешивание с другим текстом может ослабить или удалить обнаруживаемый сигнал.
- Очень короткие фрагменты текста могут не содержать достаточного сигнала для надёжного обнаружения.
- Скриншоты, конвертация форматов, повторное сохранение или неподдерживаемые платформы могут удалить метаданные файлов.
- Обнаружение маркера Claude означает, что контент возможно был обработан Claude; это не доказывает, что Claude является первоначальным автором.
Эти различия — именно то, что отличает полезный сигнал происхождения от универсальных детекторов авторства ИИ.
Почему Anthropic добавляет машиночитаемые маркеры
Непосредственный нормативный контекст — Закон ЕС об искусственном интеллекте.
Статья 50 вводит обязательства по прозрачности для определённых систем ИИ и ИИ-генерируемого контента. Кодекс поведения по прозрачности, разработанный Европейской комиссией, призван помочь провайдерам и развёртывающим сторонам выполнять эти обязательства.
Комиссия описывает соответствующие требования как охватывающие:
- Машиночитаемую маркировку ИИ-генерируемого или манипулируемого контента.
- Обнаружение этих маркеров.
- Маркировку дипфейков.
- Маркировку определённого ИИ-генерируемого или манипулируемого текста, публикуемого для информирования общественности.
Обязательства по прозрачности вступают в силу 2 августа 2026 года.
Anthropic, как провайдер генеративных моделей и систем ИИ, подписала Кодекс поведения по прозрачности согласно статье 50(2).
Система маркировки Claude — это путь реализации этих обязательств компанией.
Ключевой момент: законодательные требования касаются прозрачности и сигналов происхождения, а не обязательного отображения видимых предупреждений читателям для каждого предложения, сгенерированного ИИ.
Машиночитаемые маркеры могут работать незаметно в контенте, оставаясь при этом доступными для проверки совместимыми инструментами.
Claude использует два взаимодополняющих уровня маркировки
Дизайн Anthropic разделяет происхождение текста и происхождение файлов.
| Уровень | К чему применяется | Что делает | Основные ограничения |
|---|---|---|---|
| Встроенный водяной знак | Генерируемый текст | Помещает незаметный машиночитаемый сигнал в сам текст | Может быть ослаблен после значительного редактирования, перевода, переписывания или сокращения |
| Подписанные метаданные provenance | Поддерживаемые генерируемые файлы | Добавляет подписанную информацию о происхождении/истории в соответствии со стандартом C2PA | Метаданные могут быть удалены при конвертации форматов, скриншотах, повторном сохранении или в неподдерживаемых рабочих процессах |
Одновременное использование обоих уровней критически важно, потому что текст и файлы выходят из строя по-разному.
Системы, полагающиеся только на метаданные, легко теряют информацию при конвертации файлов.
Сигналы, основанные только на тексте, не могут описать более богатую историю сгенерированных изображений или других файлов.
Поэтому Anthropic использует многоуровневый подход, а не рассматривает одну технологию как достаточную для всех типов выходных данных.
Уровень первый: невидимый водяной знак во встроенном тексте
Для поддерживаемых моделей текст, сгенерированный Claude, содержит незаметный водяной знак, встроенный непосредственно в текст.
Anthropic заявляет, что водяной знак:
- Невидим для читателей.
- Не изменяет предполагаемый смысл.
- Не снижает читабельность.
- Распространяется вместе с текстом при копировании и вставке.
- Может сохраняться после некоторых операций редактирования.
- Применяется на уровне модели, а не только в одном продуктном интерфейсе.
Последний пункт особенно важен.
Водяной знак — это не просто HTML-тег, добавляемый сайтом Claude.
Anthropic утверждает, что водяной знак встроен на уровне вывода модели, поэтому при доступе к одной и той же модели через разные продукты или платформы Claude поддерживаемый текст сохраняет маркировку.
Копирование и вставка не удаляют водяной знак автоматически
Если пользователь копирует отмеченный текст Claude из одного интерфейса в:
- электронную почту,
- документ,
- CMS-систему,
- приложение для заметок,
- черновик блога,
водяной знак может распространиться вместе с текстом.
Это отличается от видимых меток или обычных метаданных файлов — последние могут исчезнуть сразу после копирования контента из исходного приложения.
Однако «распространяется вместе с текстом» не следует понимать как «не может быть удалён».
Anthropic прямо заявляет, что достаточно значительные преобразования могут сделать сигнал необнаруживаемым.
Влияние редактирования на текстовые водяные знаки
Anthropic перечисляет несколько сценариев, при которых текст Claude может больше не нести обнаруживаемый маркер:
- Значительное редактирование.
- Переписывание.
- Перевод.
- Смешивание с другим письменным контентом.
- Очень короткие выдержки.
Это фундаментальное ограничение текстовых водяных знаков.
Текст легко трансформировать, сохраняя при этом смысл.
Например:
Исходный черновик Claude
→ Человек переписывает 30% содержания
→ Переводчик меняет язык
→ Редактор объединяет его с написанными человеком абзацами
→ Итоговый документ содержит лишь краткие выдержки
В какой-то момент может не остаться достаточной исходной статистической или встроенной структуры, чтобы детектор мог надёжно идентифицировать маркер Claude.
Это означает, что водяной знак следует рассматривать как положительный сигнал происхождения при его наличии, а не как доказательство человеческого авторства при его отсутствии.
Маркер Claude не доказывает, что Claude создал исходный контент
Это одно из важнейших предупреждений Anthropic.
Обнаруженный маркер может означать, что контент был обработан Claude.
Это не равнозначно доказательству того, что Claude придумал все идеи или формулировки.
Представьте пользователя, который вручную пишет отчёт, а затем просит Claude:
- вычитать текст,
- перевести,
- сократить,
- улучшить ясность,
- конвертировать в другой формат,
- резюмировать.
Итоговый вывод может нести маркер Claude.
Несмотря на то, что исходное содержание изначально исходило от пользователя.
Правильное понимание:
Обнаружен маркер Claude
→ Claude, скорее всего, обработал этот контент
А не:
Обнаружен маркер Claude
→ Claude независимо создал всё содержание этого текста
Это различие критически важно для школ, издателей, работодателей, комплаенс-команд и всех, кто пытается выводить авторство из автоматических сигналов.
Уровень второй: подписанные метаданные происхождения файлов
Когда Claude генерирует поддерживаемые типы файлов, Anthropic заявляет, что может добавляться метаданные происхождения с цифровой подписью.
Примеры:
.svg
.png
.jpg
Эти метаданные соответствуют стандарту Коалиции за происхождение и подлинность контента (C2PA).
C2PA — это открытый технический стандарт для записи происхождения цифрового контента.
Его content credentials могут содержать подписанную историю файла, например:
- Используемые инструменты и устройства.
- Время и место создания.
- Заявления о редактировании и обработке.
- Сведения о модели ИИ, использованной для генерации или изменения файла.
Идея заключается в том, что пользователи и системы могут проверять подпись и видеть, какие заявления сделаны о происхождении файла.
В отличие от невидимых текстовых водяных знаков, эти метаданные являются частью структуры файла.
Их можно проверить с помощью совместимых инструментов, даже если сам файл был просмотрен, загружен или передан.
Водяные знаки — это сигнал происхождения, а не детектор авторства ИИ
Важная концептуальная рамка: маркировка Claude — это не универсальный детектор «написал ли это ИИ».
Это механизм для создания записи о том, что контент, вероятно, прошёл через Claude.
Эта запись:
- Может быть проверена,
- Имеет ограничения,
- Требует аккуратной интерпретации,
- Не заменяет человеческое суждение.
Например, отсутствие водяного знака не означает, что текст не был создан ИИ.
Текст может:
- Быть сгенерирован другой моделью ИИ.
- Быть сгенерирован моделью Claude до внедрения маркировки.
- Потерять водяной знак в результате редактирования или повторного форматирования.
- Быть слишком коротким для надёжного обнаружения.
Аналогично, наличие водяного знака не означает, что весь текст был написан Claude с нуля.
Человек мог:
- Использовать Claude для редактирования собственного текста.
- Объединить сгенерированные фрагменты с собственным письмом.
- Использовать Claude для перевода текста, написанного человеком.
Правильная мыслительная модель:
Водяной знак присутствует → Сигнал того, что Claude обработал этот контент
Водяной знак отсутствует → Нет информации; авторство неизвестно
Охват: какие продукты и каналы затронуты
Anthropic заявляет, что система маркировки применяется при следующих условиях:
- Модель поддерживает маркировку.
- Вывод осуществляется через канал Claude, поддерживающий маркировку.
- Генерируемый контент относится к поддерживаемому типу.
Перечисленные продукты и каналы включают:
Claude 消费者界面(claude.ai)
Claude API
Claude Code
Claude Cowork
Claude Tag
Поддерживаемые облачные интеграции
Это важно для команд, использующих Claude в собственных продуктах.
Для разработчиков это означает, что маркировка может распространяться на их пользователей, даже если сами разработчики не добавляли маркеры.
Глобальный охват, а не только ЕС
Хотя стимулом стал Закон ЕС об ИИ, Anthropic внедряет маркировку глобально.
Тот же уровень модели, поддерживающий эту систему, маркирует вывод во всех поддерживаемых интерфейсах Claude.
Выводы API Claude также охвачены
Разработчики, использующие Claude через API, не находятся вне системы маркировки.
Anthropic прямо включает платформу Claude (API) в список охваченных продуктов.
Для поддерживаемых моделей:
Приложение
→ Claude API
→ Сгенерированный текст
→ Встроенный водяной знак Claude
Разработчикам не нужно использовать потребительский сайт Claude, чтобы водяной знак присутствовал.
Это создаёт важный комплаенс-вопрос для компаний, использующих Claude за своими интерфейсами.
Нижестоящие продукты могут:
- Отображать текст напрямую.
- Переписывать текст.
- Резюмировать текст.
- Объединять с содержимым базы данных.
- Конвертировать в документы.
- Передавать другой модели.
- Отправлять конечным пользователям.
Anthropic рекомендует разработчикам самостоятельно оценивать свои обязательства по статье 50 Закона ЕС об ИИ, а не предполагать, что вышестоящая маркировка Claude автоматически удовлетворяет все нижестоящие комплаенс-требования.
Claude
Code также охвачен
Anthropic перечисляет Claude Code в числе охваченных интерфейсов.
Это означает, что текст, сгенерированный через Claude Code с использованием поддерживаемых моделей, может нести тот же встроенный на уровне модели водяной знак.
Это важно, поскольку вывод кодировочного агента может принимать различные формы:
- Пояснения.
- Сообщения коммитов.
- Документация.
- Комментарии в коде.
- Сгенерированный код.
- Markdown-файлы.
- Текст, выводимый в терминал.
Официальная страница помощи описывает водяной знак как универсально применимый к генерируемому тексту.
Тем не менее, Anthropic ещё не опубликовала достаточно технических деталей, чтобы подтвердить надёжные утверждения о том, как детектор работает с различными языками программирования, короткими фрагментами кода, сжатыми файлами или значительно отредактированными базами кода.
Поэтому разработчикам следует избегать использования водяного знака как инструмента сканирования программного обеспечения на соответствие требованиям.
Claude Cowork и Claude Tag также включены
Та же политика распространяется на Claude Cowork и Claude Tag с использованием поддерживаемых моделей.
Это важно, поскольку эти продукты могут создавать рабочие результаты, выходящие за рамки простых ответов в чате.
Пользователи могут попросить Claude:
- Составить отчёт.
- Создать презентацию.
- Подготовить визуальные материалы.
- Сгенерировать документ.
- Подготовить структурированный рабочий результат.
Таким образом, текстовая маркировка и отслеживание происхождения файлов могут появляться в разных частях одного и того же рабочего процесса.
Документ может содержать текст с водяным знаком, в то время как экспортированные поддерживаемые изображения несут подписанные метаданные происхождения.
Ситуация на AWS, Google Cloud и Microsoft Foundry
Anthropic также работает с облачными платформами третьих сторон.
Для поддерживаемых моделей Claude, доступ к которым осуществляется через:
- Amazon Web Services (AWS).
- Google Cloud.
- Microsoft Foundry.
Встроенный текстовый водяной знак также применяется.
Слой отслеживания происхождения файлов носит более условный характер.
Anthropic заявляет, что из-за различий в доступных функциях обработки файлов подписанные метаданные происхождения могут поддерживаться не на каждой облачной платформе.
Практическое различие выглядит следующим образом:
| Путь доступа | Встроенный текстовый водяной знак | Подписанное происхождение файлов |
|---|---|---|
| Интерфейс Claude / Anthropic | Поддерживается для маркированных моделей | Поддерживается там, где позволяют типы файлов и функции |
| Платформа/API Claude | Поддерживается для маркированных моделей | Там, где позволяет обработка файлов Claude |
| AWS | Поддерживается для указанных моделей | Зависит от платформы/функций |
| Google Cloud | Поддерживается для указанных моделей | Зависит от платформы/функций |
| Microsoft Foundry | Поддерживается для указанных моделей | Зависит от платформы/функций |
Это ещё одна причина не описывать всю систему как универсальный водяной знак.
Текстовый слой и файловый слой имеют разные требования к развёртыванию.
Какие модели Claude имеют маркировку?
Текущее правило Anthropic основано на дате выпуска моделей.
В официальной документации сказано:
Модели Claude, выпущенные в ЕС 2 августа 2026 года или после этой даты, поддерживают машиночитаемую маркировку на момент выпуска.
Ранее выпущенные модели не автоматически охватываются вышеуказанным заявлением.
Anthropic сообщает, что работает над добавлением поддержки маркировки для более ранних моделей.
Компания ещё не опубликовала простую постоянную таблицу, указывающую, какие исторические модели Claude в настоящее время несут оба слоя маркировки.
Поэтому надёжное внедрение должно обращаться к текущей документации по моделям, а не полагаться только на слово «Claude» при выводах о поддержке.
Продукты, использующие более старые модели, не должны предполагать:
Модель Claude
= обязательно имеет маркировку
Правильный вопрос:
Поддерживает ли эта конкретная модель Claude маркировку в настоящее время?
Дата 2 августа не означает, что все старые результаты были ретроактивно изменены
Водяной знак применяется в момент генерации или обработки контента поддерживаемой моделью.
Он не изменяет ретроактивно текст, сгенерированный Claude месяцами ранее.
Документы, созданные до внедрения, не получают внезапно скрытый сигнал из-за более позднего обновления модели.
Аналогично, если старая модель не поддерживала маркировку при создании фрагмента текста, отсутствие водяного знака мало что говорит об участии Claude.
Это одна из причин, почему детектор не может служить полноценной исторической базой данных авторства ИИ.
Anthropic разрабатывает инструменты обнаружения
Если никто не может проверить, практическая ценность водяного знака ограничена.
Anthropic заявляет о планах поддержки обнаружения для:
- Пользователей Claude.
- Других третьих сторон.
Компания сообщает, что будущая техническая документация более подробно объяснит механизмы обнаружения.
На момент публикации данной статьи техническое руководство ещё готовится.
Это означает, что существует важное различие между:
Anthropic развернула поддержку маркировки
и:
Любой может немедленно запустить полностью документированный публичный детектор, чтобы проверить любую маркировку Claude
Первое утверждение подтверждено.
Второе является слишком абсолютным.
Что будущий детектор Claude сможет вам сказать
Anthropic описывает обнаружение как проверку того, несёт ли фрагмент текста или файл поддерживаемую маркировку Claude.
При обнаружении поддерживаемой маркировки безопасная интерпретация такова:
Этот контент мог быть обработан Claude.
Эта формулировка важна.
Детектор не должен автоматически утверждать, что:
- Claude написал каждое предложение.
- Не было человеческого вклада.
- Контент является ложным.
- Контент является плагиатом.
- Пользователь нарушил политику.
- Весь документ создан ИИ.
Информация о происхождении является свидетельством истории обработки.
Это не моральное или качественное суждение.
Почему «водяной знак не обнаружен» — слабое доказательство
Anthropic столь же чётко высказывается и об обратной ситуации.
Отсутствие обнаружения водяного знака не доказывает, что контент написан человеком.
Контент, сгенерированный Claude, может не иметь обнаруживаемого сигнала по ряду причин:
- Он создан моделью, которая ещё не поддерживает маркировку.
- Он был значительно отредактирован.
- Он был переписан или перефразирован.
- Он был переведён.
- Он был смешан с другим текстом.
- Он слишком короткий.
- Соответствующие метаданные файла были удалены.
- Используемая платформа или тип файла не поддерживают данный способ маркировки.
Это делает детектор асимметричным.
Положительный результат может дать полезные доказательства.
Отрицательный результат не может надёжно исключить участие ИИ.
Почему это важно для школ и работодателей
Системы обнаружения ИИ часто используются в сценариях высокого риска.
Например:
- Проверка академических нарушений.
- Оценка при найме.
- Журналистика.
- Оценка эффективности сотрудников.
- Издательская деятельность.
- Рабочие процессы с юридическими документами.
Водяные знаки Claude могут улучшить отслеживание происхождения, но их не следует воспринимать как автоматический «детектор вины».
Ответственный процесс должен различать:
Машиночитаемый сигнал Claude
и:
Доказательство нарушения правил кем-либо
Если университет разрешает помощь ИИ при вычитке, но запрещает полностью написанные ИИ работы, то простое обнаружение водяного знака не определяет, какой тип поведения имел место.
Текст может исходить от самого студента и лишь редактироваться с помощью Claude.
Всё равно требуются человеческая политика и контекстуальные доказательства для суждения.
Почему это важно для издателей и редакций
Издатели могут обнаружить, что машиночитаемая информация о происхождении полезна для внутреннего отслеживания рабочих процессов.
Например, редакция может различать:
- Черновики, написанные человеком.
- Редактирование с помощью Claude.
- Переводы Claude.
- Иллюстрации, созданные ИИ.
- Финальные публикации после человеческой редактуры.
Создайте сайт-витрину и привлекайте лиды за минуты
Опишите идею одной фразой, и We0 AI создаст сайт-витрину, страницы и CMS, а после запуска поможет привлечь клиентов и трафик.
Одна полная генерация проекта для бесплатной регистрации
Лучше всего попробовать один полный поток генерации и быстро увидеть первый черновик проекта.
Но системы отслеживания происхождения работают лучше всего в тех процессах, где данные сохраняются.
Если контент многократно копируется между инструментами, удаляющими метаданные, или значительно переписывается, цепочка происхождения становится неполной.
Для чувствительных издательских процессов организациям может потребоваться сохранять:
- Оригинальные файлы.
- Сертификаты содержимого.
- Историю редактирования.
- Записи о помощи ИИ.
- Записи о человеческом утверждении.
Водяной знак — лишь один из сигналов в более широкой системе отслеживания происхождения, а не всё.
Эта система не делает текст ИИ «невозможным скрыть»
Заголовок исходной статьи предполагает, что контент, созданный ИИ, может стать невозможным для скрытия.
Это преувеличивает заявления Anthropic.
Anthropic
В документе четко перечислены случаи, когда водяные знаки могут стать необнаружимыми.
Значительное переписывание ослабляет текстовый сигнал.
Скриншоты и преобразование форматов удаляют метаданные файла.
Неподдерживаемые интерфейсы могут не сохранять все типы водяных знаков.
Более точный вывод таков:
Когда исходный сигнал сохраняется, контент, созданный Claude, становится легче идентифицировать, но эта система не делает участие ИИ постоянно или повсеместно обнаружимым.
Это соответствует более широким техническим реалиям систем атрибуции происхождения.
Устойчивость — это спектр, а не абсолютная гарантия.
Сравнение подхода Claude с C2PA и SynthID
Метод Anthropic сочетает две идеи, уже наблюдаемые в других местах ИИ-индустрии.
C2PA / Content
Credentials
C2PA предоставляет криптографически подписанную информацию о происхождении цифровых активов.
Этот стандарт поддерживается в растущей экосистеме, включающей:
- ИИ-компании.
- Производителей камер.
- Поставщиков программного обеспечения.
- Медиаорганизации.
- Контентные платформы.
Публичный инструмент Content Credentials Verify может проверять наличие совместимых учетных данных в поддерживаемых файлах.
Google SynthID
SynthID от Google DeepMind встраивает незаметные водяные знаки непосредственно в контент, созданный ИИ.
Google заявляет, что SynthID может применяться к:
- Изображениям.
- Аудио.
- Тексту.
- Видео.
Эта концепция ближе к встроенному слою водяных знаков Anthropic, чем к метаданным C2PA.
Сигналы происхождения OpenAI
OpenAI в настоящее время документирует сигналы происхождения для поддерживаемых генерируемых медиа, включая метаданные C2PA и SynthID в поддерживаемых рабочих процессах с изображениями и аудио.
Публичный инструмент проверки OpenAI предназначен для поддерживаемых медиафайлов, а не является универсальным детектором для произвольного ИИ-текста.
Таким образом, более широкое отраслевое направление — это многослойная атрибуция происхождения:
Встроенный сигнал
+
Подписанные метаданные
+
Инструменты проверки
+
Маркировка платформ
Anthropic добавляет текстовые водяные знаки, чтобы более непосредственно интегрировать Claude в эту модель.
Текстовые водяные знаки сложнее, чем метаданные изображений
Текст создает особенно сложные проблемы для атрибуции происхождения.
Изображения могут нести скрытую информацию в пикселях или метаданных, сохраняя при этом тот же визуальный объект.
Текст же часто преобразуется на семантическом уровне.
Пользователи могут:
- Заменять синонимы.
- Изменять порядок предложений.
- Переводить текст.
- Делать резюме.
- Расширять текст.
- Объединять несколько черновиков.
- Позволять другой модели переписывать текст.
Результат может сохранять то же значение, заменяя при этом большую часть исходной последовательности токенов.
Таким образом, надежный текстовый водяной знак должен балансировать между конкурирующими целями:
- Он должен оставаться незаметным.
- Он должен сохранять качество языка.
- Он должен выдерживать повседневное редактирование.
- Он должен быть обнаружимым.
- Он должен быть устойчив к ложным срабатываниям.
- Его не должно быть легко подделать.
Anthropic еще не опубликовала достаточно деталей реализации, чтобы можно было независимо оценить все эти компромиссы.
Почему Anthropic еще не раскрыла все технические детали
Системы водяных знаков сталкиваются с состязательными проблемами.
Если злоумышленники точно знают, как построен водяной знак, они могут попытаться:
- Удалить водяной знак.
- Подделать водяной знак.
- Перенести его на текст, написанный человеком.
- Разработать методы преобразования, обходящие обнаружение.
- Вызвать ложные срабатывания.
В то же время полностью невидимые системы трудно оценить исследователям и регулирующим органам.
Текущая позиция Anthropic является компромиссной.
Она публично документирует:
- Наличие маркера.
- Двухуровневую архитектуру.
- Охват продуктов.
- Основные ограничения.
- Планы по стороннему обнаружению.
Подробные руководства по обнаружению все еще ожидают публикации.
Это оставляет пространство для компании, чтобы позже опубликовать более полную техническую основу.
Статья 50 Закона ЕС об ИИ шире, чем Claude
Система маркировки Anthropic должна пониматься как реализация одним конкретным поставщиком более широкого европейского режима прозрачности.
Европейская комиссия заявляет, что Статья 50 касается обязательств поставщиков и развертывающих организаций по прозрачности в отношении
генеративных систем ИИ.
Кодекс практики является добровольным как механизм соответствия, но сами юридические обязательства Статьи 50 не являются просто добровольными.
Кодекс содержит отдельные разделы:
- Поставщики: маркировка и обнаружение.
- Развертывающие организации: маркировка дипфейков и некоторых текстов, созданных или обработанных ИИ.
Таким образом, фактические обязательства могут различаться в зависимости от того, является ли организация:
Создателем генеративной ИИ-системы
или:
Использует генеративную ИИ-систему для публикации контента
Разработчикам не следует предполагать, что использование соответствующей требованиям вышестоящей модели автоматически удовлетворяет всем обязательствам нижестоящего развертывающего.
Кодекс прозрачности отличается от кодекса GPAI
В ЕС существует несколько кодексов практики в области ИИ, что может вызывать путаницу.
«Кодекс практики прозрачности для ИИ-контента» касается обязательств по маркировке и аннотированию в соответствии со Статьей 50.
Предыдущий «Кодекс практики для общего назначения ИИ» касается обязательств поставщиков моделей общего назначения, включая такие области, как:
- Документация по прозрачности.
- Авторское право.
- Безопасность и защищенность моделей с системными рисками.
Anthropic также является подписантом кодекса GPAI.
Статья о маркировке Claude конкретно ссылается на Кодекс прозрачности в соответствии со Статьей 50(2).
Эти две структуры соответствия не следует рассматривать как один и тот же документ.
Что следует делать разработчикам, использующим Claude
Рекомендация Anthropic проста: независимо оценивайте свои собственные обязательства.
Вот практический контрольный список для внедрения.
- Идентифицируйте модель Claude
Задокументируйте точную модель, используемую в вашем приложении.
Не полагайтесь на общий ярлык «Claude».
- Подтвердите поддержку маркировки
Проверьте, поддерживает ли данная модель в настоящее время машиночитаемую маркировку.
Более старые модели могут вести себя по-другому.
- Проследите свой выходной конвейер
Задокументируйте все, что происходит после того, как Claude возвращает контент.
Например:
API Claude
→ Постобработка приложения
→ База данных
→ Другая модель
→ Шаблонизатор
→ Экспорт в PDF
→ Клиент
Каждое преобразование может повлиять на атрибуцию происхождения.
- Различайте атрибуцию текста и файлов
Не предполагайте, что метаданные C2PA и текстовые водяные знаки переживут одни и те же операции.
Тестируйте их отдельно.
- Сохраняйте исходные артефакты, когда это необходимо
Для регулируемых или высоконадежных рабочих процессов сохраняйте:
- Исходный вывод модели.
- Исходные сгенерированные файлы.
- Подписанные метаданные.
- Историю преобразований.
- Записи о ручном редактировании.
- Финальную опубликованную версию.
- Не рассматривайте результат обнаружения как доказательство авторства
Положительный маркер может указывать на обработку через Claude.
Но он не обязательно доказывает оригинальное авторство.
- Тестируйте короткие и отредактированные тексты
Ваш сценарий использования может включать:
- Заголовки.
- Фрагменты кода.
- Резюме.
- Переводы.
- Сильно отредактированные отчеты.
Это как раз те сценарии, где обнаружение может быть менее надежным.
- Проверьте обязательства по Статье 50
Если ваш продукт предлагается на рынке ЕС или влияет на него, оцените соответствующие законы и действующие руководства Европейской комиссии в зависимости от вашей конкретной роли.
- Следите за документацией по обнаружению от Anthropic
Anthropic заявляет, что опубликует больше технических руководств.
Не стройте постоянную архитектуру соответствия вокруг предположений о еще не опубликованном детекторе.
Практический рабочий процесс атрибуции происхождения
Для компании, использующей Claude для создания публичного контента, надежный рабочий процесс может выглядеть так:
Человек или исходные данные
↓
Поддерживаемая модель Claude
↓
Исходный маркированный вывод сохранен
↓
Ручное редактирование
↓
Финальный публикуемый файл
↓
Сохранение метаданных происхождения, где это поддерживается
↓
Добавление раскрытий/маркировки там, где это требуется законом или редакционной политикой
↓
Ведение аудиторского следа
Этот подход не полагается на то, что водяной знак переживет каждое преобразование.
Он сохраняет внутреннюю цепочку доказательств, даже если публичный конечный продукт изменился.
Чего следует ожидать создателям контента
Если вы используете поддерживаемые модели Claude для написания черновиков:
- Электронных писем.
- Отчетов.
- Сообщений в блогах.
- Документов.
- Маркетинговых текстов.
- Статей.
Сгенерированный текст может содержать машиночитаемый водяной знак.
Копирование текста в другое приложение не обязательно удаляет водяной знак.
Это не означает, что ваш видимый документ будет показывать надпись «Написано Claude».
Метка предназначена для того, чтобы быть незаметной.
Это также не означает, что каждый будущий читатель сможет мгновенно отсканировать её сегодня.
Руководства Anthropic для сторонних детекторов всё ещё разрабатываются.
Что произойдёт после ручного редактирования?
Не существует фиксированного порога процента правок, после которого водяной знак исчезает.
Anthropic не публиковала универсальный порог, например:
Переписано 20% = обнаружимо
Переписано 50% = необнаружимо
Компания лишь заявляет, что метка может сохраняться после некоторых правок, но может стать необнаружимой после значительного редактирования, переписывания, перевода или перемешивания.
Результат может зависеть от:
- Длины абзаца.
- Типа правок.
- Количества неизменённого текста.
- Конструкции детектора.
- Языка.
- Метода преобразования.
Поэтому к любым инструментам, заявляющим о точном универсальном пороге правок, следует относиться с осторожностью, если Anthropic не опубликовала доказательства, подтверждающие это утверждение.
Что произойдёт со сгенерированными изображениями?
Для поддерживаемых типов генерируемых файлов (например, PNG и JPG) Claude может добавлять подписанные метаданные происхождения в соответствии со стандартом C2PA.
Если метаданные остаются нетронутыми, совместимые инструменты проверки могут их проверить.
Если изображение:
- Подверглось скриншоту.
- Было преобразовано.
- Повторно экспортировано через неподдерживаемое программное обеспечение.
- Загружено в сервис, удаляющий метаданные.
Информация о происхождении может исчезнуть.
Отсутствие сертификата не доказывает, что изображение создано человеком.
Что произойдёт с SVG-файлами?
Anthropic прямо включает SVG в свои примеры типов файлов, поддерживающих подписанные метаданные происхождения.
SVG полезен, поскольку Claude может создавать векторную графику и диаграммы в виде структурированных файлов.
Как и в случае с другими форматами файлов, информация о происхождении сохраняется только в том случае, если цепочка обработки сохраняет метаданные.
Если пользователь просто скопирует SVG-разметку в новый файл, исходные сертификаты могут не сохраниться.
Может ли кто-то подделать водяной знак Claude?
Текущие публичные документы Anthropic не предоставляют достаточной информации, чтобы сделать надёжное суждение о сложности подделки их встроенной текстовой метки.
Это важный открытый вопрос безопасности.
Любая система отслеживания происхождения должна учитывать:
Атаки на удаление
а также:
Атаки на подделку
Злоумышленники могут извлечь выгоду из обоих.
Заставить человеческий контент выглядеть как созданный ИИ может быть так же выгодно, как и скрывать ИИ-происхождение.
Вот почему решения с высокими ставками не должны полагаться только на один автоматизированный сигнал.
Может ли водяной знак остановить дезинформацию от ИИ?
Нет.
Машиночитаемые метки могут повысить прозрачность, но они не могут в одиночку решить проблему дезинформации.
Злоумышленники могут использовать:
- Модели без меток.
- Старые версии моделей.
- Модели с открытым весом с изменённым кодом вывода.
- Ручное переписывание.
- Скриншоты.
- Инструменты для удаления метаданных.
- Полностью написанные людьми ложные заявления.
Отслеживание происхождения помогает ответить на вопрос:
Что мы можем узнать о том, как был создан или обработан контент?
Оно не может ответить на вопрос:
Является ли этот контент правдой?
Проверка фактов и отслеживание происхождения — это взаимодополняющие задачи.
Более полезное будущее — это отслеживание происхождения, а не «детектирование ИИ»
Термин «детектор ИИ» подразумевает бинарный тест:
ИИ
или
человек
Реальное создание контента становится всё более гибридным.
Документ может включать:
- Человеческое исследование.
- Черновик от Claude.
- Человеческое редактирование.
- ИИ-перевод.
- Человеческое одобрение.
- ИИ-вёрстку.
- Человеческую публикацию.
В таком мире более полезный вопрос — не:
«Использовался ли ИИ?»
а:
«Что происходило с этим контентом, какие инструменты участвовали и какие части цепочки можно проверить?»
Именно эту проблему призваны решать стандарты отслеживания происхождения.
Часто задаваемые вопросы
Добавляет ли Claude водяной знак ко всему генерируемому тексту сейчас?
Поддерживаемые модели Claude могут встраивать машиночитаемый водяной знак в генерируемый текст. Anthropic заявляет, что модели, выпущенные в ЕС 2 августа 2026 года или позже, поддерживают маркировку при запуске, а поддержка маркировки для более ранних моделей постепенно добавляется.
Могу ли я увидеть водяной знак Claude в тексте?
Нет. Anthropic описывает водяной знак как незаметный и заявляет, что он не изменяет предполагаемое значение, качество или читаемость ответа. Он предназначен для машиночитаемого обнаружения, а не для видимой метки.
Удалит ли копирование текста Claude в Word или электронную почту водяной знак?
Не обязательно. Anthropic заявляет, что встроенный сигнал распространяется вместе с скопированным текстом и может сохраняться после некоторых правок. Значительное переписывание, перефразирование, перевод, смешивание или сокращение могут сделать метку необнаружимой.
Может ли водяной знак Claude доказать, что весь документ написан Claude?
Нет. Обнаруженная метка может указывать на то, что контент прошёл через Claude, но Claude мог лишь вычитать, перевести, резюмировать или переформатировать материал, написанный человеком. Anthropic прямо предупреждает, что метка не является полным доказательством авторства.
Добавляет ли Claude метаданные C2PA к сгенерированным изображениям?
Anthropic заявляет, что поддерживаемые типы генерируемых файлов (например, SVG, PNG и JPG) могут получать подписанные метаданные происхождения в соответствии со стандартом C2PA. Поддержка может зависеть от продукта, платформы, функции и типа файла.
Активирован ли водяной знак Claude на AWS, Google Cloud и Microsoft Foundry?
Anthropic заявляет, что встроенные текстовые водяные знаки применяются при доступе к поддерживаемым моделям Claude через AWS, Google Cloud или Microsoft Foundry. Из-за различий в возможностях обработки файлов не каждая облачная платформа поддерживает подписанные метаданные происхождения.
Существует ли публичный детектор водяных знаков Claude?
Anthropic заявляет, что разрабатывает поддержку обнаружения для пользователей и третьих сторон и опубликует дополнительные технические руководства. По состоянию на 11 августа 2026 года официальная документация компании не предоставляет полных публичных спецификаций обнаружения для встроенного текстового водяного знака.
Является ли отсутствие водяного знака Claude доказательством того, что текст написан человеком?
Нет. Водяной знак может отсутствовать или быть необнаружимым по следующим причинам: модель предшествует функции водяных знаков, текст слишком короткий, текст был значительно отредактирован или переведён, или метаданные файла были удалены. Отсутствие сигнала водяного знака не является надёжным доказательством того, что текст написан человеком.
Связанные инструменты
- Claude: официальный ИИ-ассистент Anthropic и один из продуктовых интерфейсов, охваченных машиночитаемой маркировкой для поддерживаемых моделей.
- Claude Platform: платформа разработчика Anthropic для создания приложений с использованием моделей Claude, включая поддерживаемые выходные данные моделей с маркировкой.
- Claude Code: агент программирования Anthropic, текстовые выходные данные которого для поддерживаемых моделей следуют той же политике маркировки на уровне модели.
- Content Credentials Verify: официальный инструмент проверки для проверки поддерживаемых учётных данных контента и информации о происхождении в цифровых активах.
- C2PA: организация стандартов, стоящая за спецификацией происхождения открытых учётных данных контента, на которой основаны подписанные метаданные файлов Claude.
- Google SynthID: технология встроенных водяных знаков Google DeepMind для текста, изображений, аудио и видео, сгенерированных ИИ.
- Кодекс поведения ЕС по прозрачности: руководящие принципы Европейской комиссии, поддерживающие соблюдение обязательств по маркировке и labelling в соответствии со статьёй 50 Закона об ИИ.
Связанные ссылки
Anthropic: Как Claude маркирует контент, созданный ИИ: основной официальный источник о текстовых водяных знаках Claude, информации о происхождении C2PA, охвате продуктов, поведении в облаке, планах по обнаружению и ограничениях.
- Кодекс практики ЕС по прозрачности контента, созданного ИИ: страница Европейской комиссии, объясняющая структуру прозрачности для поставщиков и развёртывающих организаций в соответствии со статьёй 50.
- Закон ЕС об искусственном интеллекте: официальный юридический текст, устанавливающий обязательства ЕС по прозрачности ИИ и более широкую нормативную базу.
- Техническая спецификация C2PA: открытая техническая спецификация для криптографически связанных записей о происхождении и учётных данных контента.
- Пояснение к учётным данным контента C2PA: более понятное объяснение того, как записи о происхождении прикрепляются, подписываются и проверяются.
- Content Credentials Verify: публичный инструмент для проверки совместимой информации о происхождении.
Учётные данные в поддерживаемом цифровом контенте.
- Google DeepMind SynthID: официальный обзор системы невидимых водяных знаков Google для нескольких типов генерируемого мультимедиа.
Резюме
Anthropic внедряет машиночитаемую информацию о происхождении для поддерживаемых выходных данных Claude через два взаимодополняющих механизма: невидимый водяной знак, встраиваемый в сгенерированный текст, и подписанные метаданные о происхождении на основе C2PA, прикрепляемые к поддерживаемым файлам.
Эта инициатива связана со структурой прозрачности статьи 50 Закона ЕС об ИИ, однако Anthropic заявляет, что поддерживаемые модели будут применять маркировку глобально для Claude, API, Claude Code, Claude Cowork, Claude Tag и поддерживаемых путей доступа через облачных провайдеров. Новые модели, выпущенные в ЕС 2 августа 2026 года или позднее, поддерживают маркировку с момента выпуска, тогда как более ранние модели всё ещё обновляются.
Система полезна, но она не является идеальным детектором авторства ИИ. Текстовый водяной знак может стать необнаружимым после значительного редактирования или перевода, метаданные файлов могут быть удалены, а обнаруженные сигналы лишь указывают на то, что Claude, возможно, обрабатывал этот контент — они не означают, что Claude создал каждую часть контента.
Фактический сдвиг заключается в переходе от догадок о том, что что-то «выглядит написанным ИИ», к сохранению проверяемых доказательств того, как цифровой контент был создан и обработан.



