Федеральний суд США розглядає позов, здатний зобов'язати адміністрацію Трампа розкрити внутрішні, досі засекречені критерії, за якими федеральні агентства тестують AI-системи на безпечність перед впровадженням у роботу держави. Йдеться не про публічні гайдлайни на кшталт NIST AI Risk Management Framework, а про конкретні порогові значення й процедури, які визначають, чи модель взагалі допускають до урядового контуру.

За даними Ars Technica AI, питання прозорості цих внутрішніх стандартів постало саме тоді, коли федеральний уряд одночасно нарощує використання комерційних AI-моделей у власній роботі — від оборонного відомства до цивільних агентств — і водночас тримає закритими правила, за якими ці моделі перевіряють перед допуском.

Для розробників моделей це не абстрактна юридична суперечка. Якщо суд зобов'яже адміністрацію оприлюднити критерії, компанії вперше отримають чіткий орієнтир, під який стандарт варто оптимізувати власні safety-тести, замість здогадок про вимоги федерального замовника.

Що саме вимагає суд від адміністрації?

Суть позову — доступ до документів, які описують методологію безпекового тестування AI-систем federal-агентствами: за якими критеріями оцінюють ризики, які пороги вважають прийнятними і хто приймає фінальне рішення про допуск моделі. Ці правила існують, але не публікуються — компанії, що постачають AI держсектору, не бачать повної картини вимог, під які мають підлаштовуватися.

Ключова відмінність від публічних AI-safety фреймворків, як NIST AI RMF, у тому, що йдеться саме про operational-критерії конкретних агентств, а не про загальні рекомендації. Це те, що реально визначає, чи потрапить модель у продакшн федерального відомства.

Чому ці критерії тримають у секреті?

Офіційна логіка засекречення урядових AI-safety стандартів зазвичай будується на аргументі безпеки: якщо розробники моделей знатимуть точні порогові значення тестів, вони зможуть підлаштувати систему саме під проходження перевірки, а не під фактичну надійність — класична проблема Гудхарта в оцінюванні AI. Той самий аргумент історично використовували для засекречення критеріїв кібербезпекових аудитів і процедур сертифікації озброєнь.

Але в цьому позові аргумент іншого порядку — не національна безпека сама по собі, а питання підзвітності: чи має суспільство право знати, за якими правилами держава пускає AI-системи у процеси, що впливають на громадян, від імміграційних рішень до оборонного планування.

Що це змінить для розробників AI-моделей?

Якщо суд зобов'яже розкриття, найбільший ефект відчують компанії, які вже постачають моделі федеральному уряду або претендують на такі контракти:

Це узгоджується з тим, що адміністрація вже показала готовність активно втручатися в судові справи навколо AI — раніше підтримавши OpenAI в суперечці проти NYT, а тепер опиняється по інший бік столу — як відповідач, від якого вимагають прозорості.

Що з цього винести AI-білдерам?

Наша теза: незалежно від результату конкретного позову, тиск на розкриття federal AI-safety критеріїв — симптом ширшого зсуву. Уряд США нарощує залежність від комерційних AI-моделей — Пентагон уже офіційно допустив ChatGPT і Grok у робочі процеси — і що глибша ця залежність, то складніше утримувати критерії допуску закритими без судового тиску. За нашою оцінкою, компаніям, що працюють або планують працювати з держсектором, варто вже зараз документувати власні safety-evals у форматі, сумісному з майбутньою публічною звітністю: розкриття критеріїв, коли воно станеться, накладе вимогу відповідності заднім числом, а не з чистого аркуша.

Що станеться, якщо суд задовольнить позов?

Адміністрація муситиме оприлюднити внутрішні критерії безпекового тестування AI-систем, які federal-агентства використовують перед допуском моделей до роботи. Це дасть розробникам чіткий стандарт замість здогадок про вимоги замовника.

Чи стосується це лише державних AI-систем?

Формально так — позов стосується federal-контуру тестування. Але подібні прецеденти зазвичай мігрують у приватний сектор як de facto бенчмарк, тому непрямий вплив, ймовірно, відчують і комерційні AI-продукти поза держзамовленнями.

Коли очікувати рішення суду?

Точних дат у відкритих джерелах поки немає. За даними Ars Technica AI, справа перебуває на розгляді, і її результат може вплинути на подальшу практику прозорості federal AI-стандартів.