OpenAI тихо запустила GPT-5.6 Sol — флагман нового покоління, що за ключовими показниками обходить або дорівнює Anthropic Claude Mythos 5. Але є нюанс, який перетворює технічну перемогу на щось менше: доступ до Sol контролює уряд США і видає його лише вибраним партнерам через API та Codex.
Це не перший прецедент. Той самий уряд раніше примусив Anthropic відключити Claude Fable 5 і Mythos 5 для всіх клієнтів по всьому світу. Тепер під регуляторне сито потрапив і флагман OpenAI. Компанія не приховує невдоволення. За даними The Decoder, OpenAI прямо заявила: «Ми не вважаємо, що такий процес урядового доступу має стати довгостроковим стандартом. Він позбавляє кращих інструментів розробників, підприємства, кіберзахисників і глобальних партнерів».
Для AI-білдерів це означає одне: найпотужніші інструменти 2026 року знову стають привілеєм обраних, а не ринковим продуктом.
Нова лінійка: Sol, Terra, Luna і два режими потужності
GPT-5.6 приносить схему найменування, що нагадує підхід Anthropic. Цифра (5.6) позначає покоління, а Sol, Terra та Luna — постійні рівні продуктивності, які можуть розвиватися незалежно один від одного:
- Sol — флагман, найпотужніший рівень
- Terra — відповідає GPT-5.5 за половину вартості
- Luna — бюджетний варіант
- Sol Max — режим глибшого мислення з підвищеними витратами на інференс
- Sol Ultra — розподіляє складні завдання між паралельними субагентами
Цінова структура: Sol — $5/$30 за мільйон токенів (вхід/вихід), Terra — $2,50/$15, Luna — $1/$6. Промпт-кешування суттєво покращилося: явні точки розриву кешу, гарантований мінімальний час життя 30 хвилин і 90% знижка на читання з кешу.
Бенчмарки: Sol справді обходить Mythos — але є нюанси
OpenAI наводить конкретні числа по кількох ключових областях. На Terminal-Bench 2.1 (агентичне кодування): Sol — 88,8%, Sol Ultra — 91,9%, Claude Mythos 5 — 88,0%, Fable 5 — 84,3%. Різниця невелика, але стабільна по всіх умовах тесту.
На ExploitBench — бенчмарку, що перевіряє здатність автономно знаходити і експлуатувати реальні вразливості в движку V8 Google, — Sol відповідає Mythos Preview при приблизно третині витрат на вихідні токени. На GeneBench v1 (геноміка) Sol перевершує GPT-5.5 (30% проти 22%) з меншим споживанням токенів.
Токенна ефективність — це окрема перевага: якщо Sol виконує те саме завдання за менше токенів, реальна вартість на задачу може виявитися нижчою, ніж у конкурентів. На тлі критики щодо постійного здорожчання AI-моделей це значний аргумент.
Водночас є чітка межа у кібербезпеці: Sol краще знаходить і виправляє вразливості, ніж самостійно проводить повні атаки ланцюжком. Claude Mythos вже демонстрував здатність до наскрізного компромісу підприємства — Sol поки що нижче порогу «Cyber Critical» за OpenAI Preparedness Framework.
Урядовий контроль: новий порядок чи тимчасовий захід?
Найгостріше питання цього релізу — не технічне, а регуляторне. Уряд США встановив прецедент: примусив Anthropic відключити Fable 5 і Mythos 5 глобально. Тепер GPT-5.6 Sol виходить під аналогічним режимом «вибіркового доступу за схваленням на рівні клієнта».
Два паралельних сигнали:
- Урядовий контроль над frontier-моделями стає нормою — як у космічній або ядерній галузях, найпотужніші AI-системи рухаються до ліцензування
- Обидва лідери галузі незадоволені результатом — Anthropic зазнала примусового відключення, OpenAI скаржиться на обмеження, але підкоряється
OpenAI відкрито назвала цю модель «нестійкою» у контексті доступу і натякає, що будь-яке постійне регуляторне обмеження потребуватиме компенсацій або інших механізмів для ринку.
Що це означає для AI-білдерів
Практичний кут на 2026 рік:
- Sol наразі недоступний широкому ринку — лише вибрані партнери, без дати відкритого запуску
- Terra — найвигідніший вибір прямо зараз: відповідає GPT-5.5 за половину ціни, без урядових обмежень
- Оновлене кешування суттєве для агентів: явні cache breakpoints і 30-хвилинний гарантований TTL покращують передбачуваність витрат у довгих сесіях
- Cerebras у липні: Sol плюс 750 токенів/сек — для time-critical агентів це може змінити архітектурні рішення щодо streaming і latency
- Регуляторна невизначеність — архітектурний ризик: якщо уряд може «вимкнути» frontier-модель у будь-який момент, fallback на менш потужні моделі стає не параноєю, а гігієною
Висновок AiiN: GPT-5.6 Sol — технічно сильний реліз із реальними перевагами в агентичному кодуванні та токенній ефективності. Але більша новина тут не в балах Terminal-Bench, а в тому, що найпотужніші AI-моделі перетворюються на регульований ресурс. Для команд, що будують на frontier-моделях, диверсифікація провайдерів уже не просто оптимізація витрат — це архітектурна необхідність.