OpenAI офіційно назвала GPT-6 Astra моделлю рівня AGI (Artificial General Intelligence) — вперше в історії компанії така заява прозвучала як офіційна позиція, а не як спекуляція журналістів. Оглядач M.G. Siegler відповів різкою критикою: за його версією, OpenAI зробила це легковажно, і саме ця заява остаточно перетворює AGI з наукового орієнтира на рекламний штамп. За даними Techmeme, критика зʼявилась одразу після анонсу й швидко розійшлась серед оглядачів індустрії ШІ.
Для ринку, де AGI роками лишався розмитим орієнтиром без єдиного технічного визначення, ця історія — не про конкретну модель, а про довіру до самого слова. Коли компанія-лідер публічно ставить власний продукт в один ряд із поняттям загального інтелекту, це змінює правила гри для всіх, хто далі говоритиме про AGI — від конкурентів до регуляторів.
Що саме оголосила OpenAI?
OpenAI подала GPT-6 Astra як модель, що досягла рівня AGI — без публічного оприлюднення єдиного узгодженого тесту чи порогу, який би це підтверджував. Ми вже писали, що GPT-6 Astra наздогнала Claude Opus 5 у кодингу, але не Fable 5.1 — тобто модель сильна, але не є беззаперечним лідером навіть у вузькій дисципліні кодингу, що й підважує претензію на загальний інтелект. Анонс GPT-6 Astra стався одночасно з презентаціями Grok Bot Enterprise і world model від Runway, і ми розбирали цей день детальніше в матеріалі про GPT-6 Astra, Grok Bot Enterprise і world model Runway за один день.
Чому критики кажуть, що це підриває саме поняття AGI?
Проблема в тому, що AGI ніколи не мав загальновизнаного технічного визначення — на відміну від бенчмарків типу MMLU чи SWE-bench, тут немає порогового числа, після якого модель офіційно «стає» AGI. Siegler звинувачує OpenAI саме в тому, що компанія скористалась цією відсутністю формального критерію, аби зробити гучну заяву без перевірюваних доказів. Це принципова відмінність від наукового підходу, де твердження підтверджують відтворюваним експериментом, а не прес-релізом. Якщо термін AGI можна привласнити маркетинговим рішенням однієї компанії, він перестає бути науковою категорією і перетворюється на синонім до «найкраща модель на ринку зараз» — а це вже суто конкурентна риторика, а не технічний опис.
Що це означає для AI-білдерів і всіх, хто читає такі заяви?
Найпряміший наслідок — падіння довіри до самого слова AGI у будь-яких офіційних матеріалах вендорів. Якщо ви приймаєте рішення про архітектуру продукту, вибір моделі чи бюджет на інференс на основі маркетингових заяв компаній, варто ігнорувати ярлики на кшталт «AGI» і дивитись на конкретні бенчмарки та незалежні тести. Ймовірно, після цього прецеденту інші лабораторії теж почнуть обережніше або, навпаки, сміливіше жонглювати терміном AGI у власних анонсах — але це вже питання конкурентної риторики, а не технічного прогресу. За нашою оцінкою, найбільший практичний ризик — не сама модель GPT-6 Astra, а прецедент: наступного разу інвесторам і корпоративним клієнтам буде складніше відрізнити реальний прорив від ребрендингу тієї самої архітектури.
- Не довіряйте формулюванню «модель рівня AGI» без посилання на конкретний, відтворюваний тест
- Порівнюйте нові релізи на незалежних бенчмарках, а не за прес-релізами компаній
- Стежте, чи публікує компанія методологію оцінки — її відсутність сама по собі сигнал
Висновок AiiN
Наша теза проста: заява OpenAI про GPT-6 Astra як AGI важлива не тим, що вона правдива чи хибна, а тим, що вона створює прецедент — тепер будь-яка лабораторія може оголосити свою модель «AGI» без незалежної перевірки, і ринок це проковтне, бо формального визначення, яке можна порушити, просто не існує. Це означає, що слово AGI de facto вибуло з категорії наукових термінів і перейшло в категорію маркетингових ярликів — і для AI-білдерів це сигнал більше довіряти конкретним цифрам, ніж гучним назвам.
AGI — це офіційний технічний термін чи ні?
Ні, єдиного загальновизнаного технічного визначення AGI не існує навіть серед дослідників — саме тому компанії можуть вільно застосовувати цей термін до власних моделей без ризику формального спростування.
Чи означає заява OpenAI, що GPT-6 Astra справді універсальна модель?
Заява сама по собі не є доказом: вона не супроводжується публічним, відтворюваним тестом, а незалежні порівняння показують, що GPT-6 Astra випереджає далеко не всі конкуруючі моделі навіть у вузьких задачах на кшталт кодингу.