Anthropic вводить для Claude технічне маркування, яке не повинно бути помітним у звичайному читанні. Підтримувані моделі вбудовуватимуть у текст машинозчитуваний watermark, а підтримувані файли отримуватимуть цифрово підписану інформацію про походження.
Зміна з’явилася на тлі старту нових правил ЄС. Від 2 серпня 2026 року стаття 50 AI Act вимагає, щоб постачальники генеративних систем робили AI-контент машинозчитувано позначеним і технічно виявлюваним. Нові Claude-моделі, випущені від цієї дати, мають підтримувати маркування від запуску.
Для старих моделей ситуація інша. Вони не обов’язково почали маркувати всі відповіді 2 серпня. Anthropic ще додає підтримку, а європейські правила передбачають для систем, які вже були на ринку, обмежений перехідний період до 2 грудня 2026 року.
Текстовий watermark має бути непомітним. За описом Anthropic, він не змінює значення, якість або читабельність відповіді й створюється на рівні моделі. Це означає, що сигнал не прив’язаний лише до інтерфейсу Claude: він може з’являтися і в результатах через API або підтримувані хмарні канали.
Компанія також заявляє, що мітка може переноситися разом із текстом під час копіювання та вставлення і переживати частину редагувань. Це відрізняє її від звичайних метаданих документа, які легко залишити позаду, скопіювавши лише сам текст.
Водночас технічну схему watermark Anthropic поки не розкрила. Немає підстав стверджувати, що йдеться про конкретний набір невидимих символів. Компанія лише описує мітку як непомітну ознаку тексту і готує документацію та інструменти, які дозволять третім сторонам її виявляти.
У файлах використовується інший підхід. Підтримувані формати можуть отримувати цифрово підписані provenance-метадані. Для відповідних медіафайлів Anthropic використовує C2PA — стандарт, який дозволяє перевіряти дані про походження та історію активу.
Такий підпис не робить файл недоторканним. Метадані можуть зникнути після конвертації чи повторного збереження. Текстовий watermark також може послаблюватися після сильного переписування, перекладу або змішування з іншим контентом. Тому відсутність мітки не є доказом людського походження.
Не менш важливо не робити протилежну помилку. Якщо детектор знайде сигнал Claude, це не обов’язково означатиме, що модель написала весь текст. Вона могла брати участь у перекладі, редагуванні або створенні лише окремих фрагментів.
Anthropic планує застосовувати систему глобально для підтримуваних моделей. Практичне значення стане зрозумілішим після появи сторонніх детекторів. Тоді можна буде оцінити, наскільки добре watermark витримує звичайні правки і чи здатен стати надійним елементом перевірки походження, а не просто ще одним сигналом серед кількох.
