Anthropic з серпня 2026 року вбудовує водяні знаки в кожен текстовий вихід моделей Claude — незалежно від тарифного плану, регіону чи каналу доступу, включно з Claude.ai, API та Claude Code. За словами компанії, частина цих позначок лишається розпізнаваною навіть після того, як користувач відредагував або скоротив згенерований текст.
Це перший випадок, коли велика лабораторія робить водяні знаки стандартною, а не опційною функцією для всієї лінійки моделей — від Haiku до Opus. Досі подібні експерименти, як-от SynthID від Google DeepMind, лишалися нішевими рішеннями для окремих продуктів, а не глобальним стандартом за замовчуванням.
За даними The Decoder, крок покликаний дати змогу третім сторонам ідентифікувати текст, згенерований Claude, і зменшити ризики зловживання моделлю — від академічного шахрайства до масового виробництва дезінформації.
Що саме змінила Anthropic?
Ключова зміна — охоплення: водяний знак тепер стоїть за замовчуванням на кожному текстовому виході Claude, а не лише в окремих пілотних програмах. Позначку отримує і відповідь у чаті Claude.ai, і текст, згенерований через Claude API для стороннього застосунку, і навіть чернетка, яку модель написала всередині Claude Code.
- Позначка вбудовується під час генерації тексту, а не додається постфактум як метадані файлу.
- Механізм діє глобально — Anthropic не обмежила його окремими юрисдикціями чи мовами.
- За заявою компанії, знак частково зберігається навіть після ручного редагування чи скорочення тексту користувачем.
Як водяний знак переживає редагування тексту?
Anthropic не розкрила точний алгоритм, але індустрійна практика підказує загальний принцип роботи подібних схем. Під час генерації кожного наступного токена модель злегка зміщує ймовірності на користь псевдовипадкового підмножини слів, обраного на основі хешу попереднього контексту. Видимий текст лишається природним для читача, але статистичний розподіл слів утворює приховану сигнатуру, яку розпізнає спеціальний детектор.
Саме тому знак «переживає деякі редагування», але не всі: точкові правки чи скорочення залишають достатньо оригінальних токенів для розпізнавання, а суцільний перефраз усього тексту іншою моделлю або людиною, найімовірніше, стирає сигнатуру — статистичний слід прив'язаний до конкретних слів, які модель обрала під час генерації, а не до змісту як такого.
Що це означає для тих, хто будує продукти на Claude?
Для команд, які будують продукти поверх Claude API, ключове практичне питання не в тому, чи є водяний знак — вимкнути його на боці розробника не можна, — а в тому, хто зможе його прочитати. Якщо детектор лишається внутрішнім інструментом Anthropic, білдери не отримують прямого способу перевірити власний контент, а лише знають, що технічно таку перевірку може провести третя сторона.
- Платформи модерації та детекції дезінформації отримують додатковий сигнал довіри без потреби у співпраці з видавцем контенту.
- Освітні сервіси та інструменти академічної доброчесності: питання «текст написав студент чи Claude» стає технічно перевірюваним.
- Продукти контент-маркетингу та SEO: великий обсяг згенерованого тексту може лишатися ідентифіковним постфактум навіть після редакторської правки.
Лишається невизначеність, чи відкриє Anthropic публічний доступ до верифікації водяного знака і чи стане цей підхід де-факто галузевим стандартом, якщо OpenAI, Google та Meta не синхронізують власні механізми. Ширший контекст відповідального впровадження генеративних моделей ми розбирали в матеріалі про баланс між можливостями та загрозами генеративного ШІ.
Висновок AiiN
Наша теза: водяні знаки Anthropic — це передусім зсув відповідальності, а не готовий інструмент детекції для бізнесу. Компанія фіксує факт генерації тексту, але поки не дає AI-білдерам самостійного способу перевірити власний контент, тож реальна цінність функції розкриється лише тоді, коли з'явиться публічний або регульований доступ до детектора. До того часу для продуктових команд це радше сигнал напрямку регулювання — прозорість AI-контенту рано чи пізно стане вимогою, — ніж готовий compliance-інструмент.
Чи можна вимкнути водяний знак у Claude?
Наразі публічно задокументованого перемикача немає: за наявною інформацією, позначка застосовується автоматично до всіх текстових виходів Claude, включно з викликами через API, без опції відключення на боці розробника.
Чи впливає водяний знак на якість або швидкість відповіді Claude?
Anthropic не повідомляла про вимірний вплив на латентність чи якість тексту. Подібні статистичні схеми водяних знаків традиційно проєктують так, щоб вони лишалися непомітними для читача і не змінювали сенсу відповіді.
Чи діє водяний знак на код, який генерує Claude?
Механізм орієнтований передусім на природну мову. Програмний код має жорсткішу синтаксичну структуру і менше «вільних» слів для статистичного зміщення, тож надійність позначки для коду, найімовірніше, нижча, ніж для звичайного тексту.