Anthropic відкрила зовнішній доступ до свого інструменту виявлення тексту, згенерованого моделями Claude, — раніше він працював лише всередині компанії, а тепер його можуть використовувати фактчекери, журналісти та державні регулятори. За даними The Decoder, це частина ширшої стратегії Anthropic щодо прозорості й підзвітності генеративного ШІ.
Питання «людина це написала чи модель» за останній рік перестало бути суто академічним. Воно спливає в судових позовах про академічну доброчесність, у скандалах з фейковими рецензіями наукових статей, у редакційних розслідуваннях, коли видання ловлять позаштатних авторів на неанонсованому використанні ChatGPT чи Claude. Anthropic реагує інструментальною відповіддю — принаймні для текстів, згенерованих власною моделлю.
Але детектор AI-тексту — це вузько сфокусований інструмент з обмеженнями, які варто розуміти одразу, а не після першої помилкової ідентифікації.
Що саме зробила Anthropic?
Компанія розширила коло користувачів свого детектора генерованого Claude тексту з внутрішніх команд до зовнішньої аудиторії — фактчекерів, журналістів і регуляторів. Раніше подібні інструменти виявлення AI-контенту існували переважно як дослідницькі прототипи або закриті корпоративні розробки; відкриття доступу для сторонніх професійних груп — новий крок саме в питанні того, хто має право перевіряти походження тексту.
Кому і навіщо це потрібно?
Три групи, названі в новині, працюють із текстом професійно і несуть відповідальність за його достовірність:
- Фактчекери — перевіряють джерела масової інформації, де AI-згенеровані фейки поширюються швидше, ніж встигає працювати редакційний контроль.
- Журналісти — стикаються з питанням авторства в питаннях плагіату, підробних прес-релізів і listicle-спаму, що заповнює пошукову видачу.
- Регулятори — готують або впроваджують норми щодо маркування AI-контенту (у ЄС, США та інших юрисдикціях) і потребують технічної можливості перевіряти дотримання цих норм на практиці, а не лише декларативно.
Для кожної з цих груп детектор — не остаточний вирок, а додатковий сигнал у ширшому процесі перевірки.
Наскільки надійна така детекція?
Тут варто зберігати тверезість: інструменти виявлення AI-тексту в індустрії мають історію хибних спрацювань і легко обходяться перефразуванням чи редагуванням людиною. OpenAI закрила власний класифікатор AI-тексту ще 2023 року через низьку точність — показовий прецедент для всієї категорії таких продуктів. Ключове технічне обмеження детектора Anthropic випливає прямо з новини: він розпізнає текст, згенерований саме моделями Claude, а не будь-яким LLM узагалі. Це означає, що інструмент корисний як одна з ланок перевірки, а не як універсальний детектор AI-походження контенту.
Що це означає для індустрії — погляд AiiN
За нашою оцінкою, головне тут не сам інструмент, а прецедент: велика лабораторія передає частину контролю над власним продуктом зовнішнім гравцям, які можуть використати його проти інтересів компанії — наприклад, викрити її ж клієнтів у прихованому масовому генеруванні контенту. Це відрізняється від логіки конкурентів, де виявлення AI-тексту здебільшого лишається задачею сторонніх стартапів без прямого доступу до моделі. Раніше AiiN писав про те, як Anthropic розширює контроль клієнтів над даними в Claude API — і відкриття детектора вкладається в ту саму лінію: компанія системно нарощує інструменти підзвітності навколо своєї моделі, а не лише її можливості. Для медіа й регуляторів це сигнал, що детекція AI-контенту переходить зі статусу нішевого дослідницького продукту в статус інфраструктурної вимоги — такої ж базової, як перевірка орфографії чи модерація коментарів.
Чи виявляє інструмент Anthropic текст ChatGPT або Gemini?
Ні, судячи з логіки продукту — детектор налаштований на розпізнавання тексту, згенерованого саме моделями Claude, а не будь-яким LLM. Для перевірки тексту з інших моделей потрібні окремі інструменти від відповідних розробників або сторонніх компаній.
Чи означає це, що весь текст Claude тепер автоматично позначається?
Новина говорить про доступ до інструменту перевірки для зовнішніх професійних груп, а не про автоматичне маркування кожного фрагмента, згенерованого Claude. Перевірка лишається окремою дією фактчекера, журналіста чи регулятора, а не вбудованою функцією для кінцевого користувача Claude.
Чи замінює такий детектор редакційну перевірку фактів?
Ні. Виявлення AI-походження тексту й перевірка фактів — різні задачі: перше каже, хто (ймовірно) написав текст, друге — чи правдиве те, що в ньому сказано. Детектор Anthropic варто розглядати як додатковий сигнал у робочому процесі, а не заміну редакційної експертизи.