SemiAnalysis оприлюднила аналіз, за яким технологічний розрив між найкращими відкритими мовними моделями та провідними закритими аналогами скорочується вдвічі з кожним новим циклом розвитку індустрії — від ери масштабування (scaling) до нинішньої ери agentic AI. За даними Techmeme, це не разовий сплеск, а стійка динаміка, яку видно на кількох послідовних технологічних циклах.

Для команд, що будують продукти на базі великих мовних моделей, цей висновок означає одне: ставка на конкретного закритого провайдера як на довгострокову перевагу стає ризикованішою з кожним роком. Якщо раніше лідерство OpenAI, Google чи Anthropic над відкритими альтернативами трималося роками, то тепер вікно цієї переваги стискається вдвічі щоразу, коли індустрія переходить у новий етап — від чистого масштабування обчислень до навчання з підкріпленням і, зрештою, до агентних систем.

Це не означає, що відкриті моделі вже наздогнали закриті сьогодні. Йдеться про темп скорочення розриву між ерами, а не про поточний паритет якості.

У чому суть висновку SemiAnalysis?

Суть у тому, що кожен новий етап розвитку великих мовних моделей — scaling, reasoning, тепер agentic AI — відкриває для розробників відкритих моделей коротший шлях до повторення досягнень лідерів, ніж попередній етап. За аналізом SemiAnalysis, якщо в еру чистого масштабування розрив вимірювався роками, то в еру agentic AI команди, що працюють з відкритими вагами, закривають ту саму дистанцію приблизно вдвічі швидше.

Чому розрив взагалі скорочується з кожним циклом?

Головна причина — ефект наздоганяння: коли лідер публікує статтю, технічний звіт чи навіть просто демонструє, що певний підхід працює, конкуренти економлять роки на пошуку самого напрямку і одразу переходять до інженерної реалізації. Перший прохід технології завжди найдорожчий, бо включає невдалі експерименти; повторення вже відомого рішення обходиться дешевше і швидше.

Другий фактор — агентні можливості менше залежать від сирої потужності базової моделі й більше від того, як навколо неї побудовано інструменти, пам'ять і оркестрацію викликів. Це знижує поріг входу для команд, які не мають ресурсів на тренування моделі з нуля, але вміють будувати якісний прошарок навколо відкритої ваги. Показовий приклад такого підходу — те, як Ramp побудував власний AI-роутер замість підписки на одного провайдера, знижуючи залежність продукту від однієї закритої моделі.

Що це означає для вибору моделі в продукті?

Практичний висновок для AI-білдерів простий: архітектура продукту має витримувати заміну постачальника моделі, а не залежати від нього жорстко. Якщо вікно переваги закритого лідера скорочується з кожним циклом, то рішення «зашити» виклики конкретної закритої моделі глибоко в бізнес-логіку створює технічний борг, який доведеться розплутувати вже за один-два цикли.

Водночас це не привід ігнорувати закриті моделі: лідери типу GPT чи Claude часто першими відкривають нові класи можливостей, і саме на цих можливостях будуються наступні цикли для відкритих альтернатив. Прогрес у scaling, який раніше рухали переважно найбільші лабораторії, у наступному циклі часто стає базою для агентних архітектур — про це ми писали, коли Ґрег Брокман очолив продукт і scaling в OpenAI.

Висновок AiiN

За нашою оцінкою, головний практичний наслідок цього тренду — не в тому, яку модель обрати сьогодні, а в тому, наскільки гнучкою має бути архітектура продукту навколо цього вибору. Компанія, що будує продукт на одній закритій моделі без плану виходу, робить ставку на те, що поточне лідерство протримається довше, ніж показує історія останніх циклів. Натомість команди, які вже зараз будують інфраструктуру, не прив'язану до конкретного провайдера моделі, отримують опціональність: перехід на дешевшу відкриту модель, коли розрив закриється, коштуватиме їм днів інженерної роботи, а не місяців переписування продукту.

Чи означає це, що відкриті моделі скоро повністю зрівняються із закритими?

Ні, аналіз SemiAnalysis описує темп скорочення розриву між циклами, а не гарантію повного паритету в конкретний момент. Кожен новий цикл — scaling, reasoning, agentic AI — також підіймає планку для лідерів, тож розрив може скорочуватися вдвічі й водночас залишатися помітним для складних задач.

Як AI-білдеру підготуватися до цього тренду вже зараз?

Найпростіший крок — відокремити виклики моделі від бізнес-логіки продукту через єдиний інтерфейс або роутер, щоб заміна провайдера не вимагала переписування застосунку. Другий крок — регулярно бенчмаркати відкриті альтернативи на власних задачах, а не покладатися на загальні рейтинги, бо розрив по конкретному use case може закриватися швидше або повільніше за середній показник.