Anthropic вбудувала в Claude функцію прихованих водяних знаків, яка дозволяє визначити, що конкретний фрагмент тексту згенерований моделлю, а не написаний людиною. Судячи з заголовка релізу, компанія орієнтувалась передусім на прозорість і протидію зловживанням — але отримала не зовсім той відгук користувачів, на який розраховувала.
Частина аудиторії Claude — офісні працівники, які здають звіти та листування як «власну» роботу, і студенти, які подають есе та домашні завдання як самостійні, — раптом опинилися перед ризиком, що їхнє використання ШІ стане видимим для роботодавців і викладачів. Реакція, судячи з заголовка публікації, і полягала в невдоволенні: люди звикли покладатися на Claude непомітно, а нова функція ламає цю зручність.
За даними TechCrunch, саме ця напруга — між очікуванням анонімності при використанні ШІ-асистента і бажанням Anthropic зробити його вихід прозоро відстежуваним — стала джерелом обурення у частини спільноти Claude.
Що саме змінилося в Claude?
Ключова зміна — модель тепер залишає в згенерованому тексті приховану позначку, яка вказує на його штучне походження. На відміну від видимої плашки на кшталт «створено ШІ», такий водяний знак не заважає читанню і не змінює сам текст помітно для ока, але дозволяє його розпізнати спеціальним інструментом перевірки.
Для компанії це логічний крок: питання підробки резюме, дипломних робіт та ділових звітів, згенерованих ШІ без розкриття цього факту, давно турбує роботодавців, університети та регуляторів. Водяний знак — спосіб дати їм інструмент перевірки, не забороняючи людям користуватися Claude як таким.
Чому саме зараз користувачі проти?
Невдоволення виникло не через сам факт існування технології, а через її наслідки для конкретних людей: якщо текст, надісланий менеджеру чи викладачу, можна перевірити на «штучність», ризик викриття переноситься з абстрактного на особисте. Для тих, хто досі використовував Claude, щоб непомітно прискорити рутинні завдання — від службових листів до курсових, — це означає пряму загрозу репутації, оцінці чи навіть звільненню.
- Офісні працівники, які видають чернетки Claude за власний текст у звітах і презентаціях
- Студенти, які здають есе та реферати, згенеровані моделлю, під виглядом самостійної роботи
- Фрилансери, чиї клієнти можуть почати вимагати підтвердження «людського» авторства
Кожна з цих груп раніше покладалася на те, що текст ШІ практично невідрізнимий від людського. Водяний знак цю рівновагу порушує.
Як взагалі працюють такі водяні знаки?
Технічно watermarking тексту зазвичай зводиться до статистичних закономірностей у виборі слів чи токенів, непомітних людині, але видимих для детектора з відповідним ключем. Це не «прихований підпис» у прямому сенсі, а радше зсув ймовірностей під час генерації, який можна виявити лише знаючи метод перевірки. Конкретну реалізацію Anthropic для Claude TechCrunch не розкриває детально, тому судити про її надійність — наприклад, чи виживає позначка після редагування чи перефразування тексту — поки що складно; ймовірно, ефективність такого підходу залежатиме від того, наскільки сильно користувач змінює згенерований текст перед використанням.
Що з цим робити AI-білдерам і компаніям?
Для розробників продуктів на базі Claude API головний висновок — прозорість походження тексту стає частиною інфраструктури, а не опційною фічею. Якщо ваш продукт генерує контент, який кінцеві користувачі видають за власний (звіти, есе, код-рев'ю, маркетингові тексти), варто закладати в план ризик, що замовники чи регулятори з часом отримають інструменти перевірки походження цього контенту. Це особливо стосується HR-tech і edtech-стартапів, які будують продукти навколо генерації текстів від імені користувача, — з появою публічних детекторів дефолтна непомітність результату більше не гарантована.
Практично це означає: якщо продукт орієнтований на «непомітну» автоматизацію писемної роботи, варто чесно попереджати користувачів про можливість детекції, а не будувати бізнес-модель на її відсутності.
Висновок AiiN
Водяні знаки в Claude — це не стільки технічна новина, скільки маркер зміни ролі провайдерів LLM: від нейтрального інструмента до сторони, яка технічно здатна свідчити проти власних користувачів. За нашою оцінкою, конфлікт між зручністю анонімного використання ШІ та тиском з боку роботодавців, шкіл і регуляторів на прозорість тільки посилюватиметься, і компанії на кшталт Anthropic опиняться під подвійним тиском — від тих, хто вимагає детекції, і від тих, хто платить за підписку саме заради непомітності.
Чи можна обійти водяні знаки Claude?
TechCrunch не наводить деталей про стійкість позначки до редагування чи перефразування тексту, тому однозначної відповіді немає; за загальною логікою watermarking-технологій значне переписування зазвичай послаблює або руйнує позначку.
Чи стосується це лише текстів для роботи й навчання?
Заголовок новини акцентує саме на робочих завданнях і навчальних роботах, оскільки там ставки викриття найвищі — звільнення чи академічні санкції, тому основне занепокоєння користувачів зосереджене саме в цих сценаріях.