GPT-6 Astra від OpenAI буде коштувати $10 за мільйон вхідних токенів і $50 за мільйон вихідних — рівно стільки ж, скільки Anthropic просить за Claude Fable 5.1. За даними Techmeme, це перший відомий випадок, коли ціна флагманської моделі OpenAI дослівно, до долара, збігається з тарифом прямого конкурента.
Досі OpenAI й Anthropic встановлювали ціни на свої флагманські моделі окремо одна від одної, орієнтуючись на власну структуру витрат на обчислення. Те, що GPT-6 Astra вийшла з тарифом, ідентичним Claude Fable 5.1 в обох напрямках — і на вхід, і на вихід токенів, — виглядає не як збіг, а як свідоме рішення.
Для команд, які будують продукти на API великих мовних моделей, це означає одну конкретну річ: цінник більше не є критерієм вибору між двома флагманами. Розберемося, що саме змінилося і на що тепер варто дивитися замість ціни.
Що саме змінилося в тарифах OpenAI?
OpenAI встановила для GPT-6 Astra ціну $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів. Це точно ті самі цифри, які Anthropic оголосила для Claude Fable 5.1:
- GPT-6 Astra (OpenAI): $10 / $50 за мільйон токенів (вхід / вихід)
- Claude Fable 5.1 (Anthropic): $10 / $50 за мільйон токенів (вхід / вихід)
Йдеться саме про флагманські, найпотужніші моделі обох компаній — не про бюджетні чи полегшені версії, де ціни традиційно розходяться сильніше.
Чому OpenAI скопіювала тариф конкурента, а не порахувала власний?
Пряма відповідь джерела на це запитання відсутня, але логіка ціноутворення на флагманські моделі підказує напрямок. Собівартість інференсу в обох компаній залежить від подібного набору змінних — розміру моделі, апаратного забезпечення, обсягу контексту, — тож на певному рівні масштабу ціни природно сходяться. Ймовірно, OpenAI також усвідомлює: цінова війна між двома лідерами ринку зменшує маржу обом, не даючи жодній стороні стійкої переваги, тоді як ідентичний тариф знімає ціну як змінну взагалі.
Це не перший сигнал вирівнювання на ринку інференсу — тарифи великих провайдерів токенів давно рухаються в подібному діапазоні. Але випадок з GPT-6 Astra і Claude Fable 5.1 вирізняється тим, що збіг точний і стосується обох напрямків ціни одночасно.
На що тепер дивитися замість ціни при виборі моделі?
Якщо тариф на токени однаковий, вибір між GPT-6 Astra і Claude Fable 5.1 зводиться до параметрів, які раніше можна було ігнорувати заради економії. Для AI-білдерів, що проєктують продукт на API, варто перевіряти:
- швидкість відповіді (latency) та стабільність під навантаженням;
- якість виконання довгих інструкцій і надійність виклику інструментів (tool use);
- розмір контекстного вікна й поведінку моделі на його межах;
- ліміти запитів (rate limits) і доступність у конкретному регіоні чи хмарі;
- якість підтримки та стабільність API-контракту між релізами.
Раніше різниця в ціні часто виправдовувала компроміс за якістю — дешевша модель могла програвати в точності, але вигравати в бюджеті. Тепер, коли GPT-6 Astra і Claude Fable 5.1 коштують однаково, такий компроміс зникає: доведеться обирати за фактичною поведінкою моделі на власних задачах, а не за рахунком за API.
Висновок AiiN: ціна перестала бути аргументом у виборі моделі
Наша теза: коли два лідери ринку призначають ідентичний тариф на флагманські моделі, це означає, що ціна за токен перетворилася на ринкову підлогу, продиктовану економікою обчислень, а не на інструмент конкуренції. У такому світі маркетинговий аргумент «ми дешевші» втрачає силу, і боротьба переноситься туди, де її й варто вести, — в якість відповідей, швидкість і глибину інтеграції з реальними робочими процесами. Компаніям, які будують продукти на цих API, варто закладати в юніт-економіку не різницю в ціні токена, а різницю в кількості токенів, потрібних для розв'язання задачі: модель, що дає правильну відповідь з першого разу, обходиться дешевше навіть за однакового тарифу. До речі, схожий сюжет вирівнювання цін ми вже бачили в тому, як дохід OpenAI від бізнес-партнерств став важливішим за пряму цінову перевагу на рівні API.
Скільки токенів входить у мільйон і як порахувати вартість запиту?
Мільйон токенів — це приблизно 700–750 тисяч слів англійського тексту (для української мови токенізація зазвичай менш ефективна, тож слів виходить менше). Вартість конкретного запиту до GPT-6 Astra чи Claude Fable 5.1 рахується окремо для вхідних і вихідних токенів: наприклад, запит на 10 000 вхідних токенів і 2 000 вихідних коштуватиме $0,10 за вхід і $0,10 за вихід — разом $0,20 за один виклик API.
Чи означає однакова ціна однакову якість моделей?
Ні. Ціна за токен нічого не каже про точність, швидкість чи стабільність відповідей — це лише тариф на обчислення. Наш погляд: цінова конкуренція між OpenAI та Anthropic вирівнялася, тож вибір моделі тепер більше залежить від якості й швидкості виконання конкретних задач, а не від того, хто просить менше за мільйон токенів.