Groq залучив $350 млн у новому раунді фінансування, і ці гроші підуть не на новий чип, а на перетворення компанії на постачальника хмарних AI-обчислень — так званий neocloud. За даними TechCrunch, це офіційне підтвердження стратегічного повороту: Groq більше не хоче бути виробником заліза, який продає чипи іншим компаніям, а хоче сама здавати обчислювальну потужність в оренду — за моделлю, яку вже обкатали CoreWeave, Lambda та інші спеціалізовані хмарні провайдери.

Groq відома передусім архітектурою LPU (Language Processing Unit) — спеціалізованим чипом для інференсу мовних моделей, який компанія протиставляла GPU від Nvidia як швидший і енергоефективніший варіант для генерації тексту токен за токеном. Роками Groq продавала і чипи партнерам, і доступ до власної хмари GroqCloud, де розробники викликають LPU-кластери напряму через API. Новий раунд, судячи з формулювання TechCrunch, зміщує пріоритет саме на другий напрямок.

Для ринку AI-інфраструктури це не перший подібний розворот, але саме Groq довго позиціювала себе як «чипову» альтернативу Nvidia — тому пивот у бік оренди обчислень виглядає визнанням, що продавати залізо поштучно складніше, ніж продавати доступ до нього за підпискою чи за токен.

Що таке neocloud і чому саме туди йде Groq?

Neocloud — це категорія хмарних провайдерів, що спеціалізуються виключно на оренді AI-прискорювачів (GPU, TPU, LPU) без класичного набору сервісів гіпермасштабників на кшталт AWS чи Google Cloud. CoreWeave, Lambda і подібні компанії заробляють на тому, що здають обчислювальні кластери в оренду за годину чи за запит, а не продають фізичне обладнання. Перехід Groq у цю категорію означає, що компанія робить ставку на повторювану виручку від використання GroqCloud, а не на одноразові продажі партій чипів дата-центрам.

Ключова відмінність LPU-підходу Groq — детермінована низька затримка інференсу, що особливо цінно для застосунків реального часу: голосових асистентів, чат-ботів, агентних систем, де кожна мілісекунда відповіді помітна користувачу.

Чому виробники AI-чипів масово перетворюються на хмарних провайдерів?

За нашою оцінкою, головна причина — грошовий потік: продаж чипа це одноразова угода, тоді як оренда обчислень генерує виручку щомісяця і прив'язує клієнта до інфраструктури постачальника. Для інвесторів, які вкладають сотні мільйонів доларів, регулярний дохід від хмарних контрактів виглядає передбачуванішим, ніж цикл продажів заліза, залежний від капітальних бюджетів корпоративних клієнтів. Схожу логіку ринок уже бачив у сегменті оренди дата-центрів під тренування й інференс: Nvidia фінансує рекордну оренду дата-центру OpenAI в Огайо, де інфраструктурні гравці теж роблять ставку на довгострокові контракти оренди обчислень, а не на разові продажі заліза.

Що це означає для команд, які вже будують на GroqCloud?

Для розробників, які вже використовують GroqCloud для інференсу відкритих моделей, пивот сигналізує, що компанія вкладатиметься саме в хмарний продукт — доступність API, регіони, чергу запитів — а не лише в наступне покоління чипа LPU. Це конкурентний сигнал і для інших постачальників швидкого інференсу, включно з Together AI та Fireworks AI, яким доведеться змагатися за той самий пул клієнтів, що шукають дешевий і швидкий доступ до LLM без власної інфраструктури.

Свіжий раунд $350 млн, ймовірно, піде на розширення дата-центрових потужностей під GroqCloud — такий висновок логічно випливає з самого формулювання «pivot to neocloud» у заголовку TechCrunch, хоча деталі розподілу коштів компанія поки не розкрила.

Висновок AiiN

Пивот Groq — симптом ширшого процесу на ринку AI-інфраструктури: консолідація відбувається навколо оренди обчислень, а не володіння залізом, і навіть компанія, яка будувала бренд на власній архітектурі чипа LPU, визнає, що маржа й лояльність клієнтів живуть у хмарному шарі, а не в продажі плати. Для AI-білдерів це означає більше конкуруючих neocloud-постачальників інференсу найближчим часом і, ймовірно, подальший тиск на ціну за токен — тепер Groq конкурує не лише архітектурою LPU, а й прямою ціновою пропозицією GroqCloud проти CoreWeave, Lambda та класичних гіперскейлерів.

Що таке neocloud простими словами?

Neocloud — це хмарний провайдер, який здає в оренду спеціалізовані AI-прискорювачі (GPU, TPU, LPU) окремо від традиційного набору хмарних сервісів на кшталт баз даних чи сховищ, які пропонують AWS чи Azure.

Чим LPU Groq відрізняється від GPU Nvidia?

LPU — чип, спроєктований спеціально під інференс мовних моделей із детермінованою низькою затримкою, тоді як GPU Nvidia — універсальніша архітектура, що охоплює і тренування, і інференс широкого спектра моделей.