OpenAI повернула п'ятигодинне обмеження на використання Codex і ChatGPT у тарифі Plus, відкотивши зміну, яку сама ж запровадила раніше. За даними Mezha, рішення ухвалили після хвилі скарг користувачів на нестабільні й непередбачувані квоти — ліміт повертається і для індивідуального Plus, і для корпоративного ChatGPT Work.
П'ятигодинний ліміт — це «плаваюче вікно»: OpenAI рахує використання Codex не по добі чи місяцю, а по ковзному п'ятигодинному інтервалу. Коли ліміт вичерпано, доступ до Codex призупиняється до моменту, поки не «звільниться» найстаріший запит у вікні. Для розробників, які женуть агента через довгий рефакторинг або серію задач CI, це означає раптову паузу посеред роботи — часто без чіткого попередження, скільки часу лишилось.
Сама історія показова: OpenAI спершу послабила чи прибрала цей ліміт, отримала відгук ринку — і за лічені тижні повернула все назад. Для команд, які вже вбудували Codex у щоденний робочий процес, це нагадування, що квоти постачальника LLM — не константа в архітектурі, а змінна, яку варто моніторити окремо.
Що саме змінилося для користувачів Plus?
Ключова зміна — повернення жорсткого п'ятигодинного вікна для Codex і ChatGPT у тарифі Plus, включно з версією ChatGPT Work. Раніше цього тижня OpenAI тимчасово відходила від такої моделі лімітів, але після скарг користувачів на непрогнозовані квоти повернулася до попередньої схеми. Практично це означає:
- Використання Codex знову рахується ковзним вікном, а не м'якшим денним чи місячним лімітом;
- Вичерпання ліміту в межах п'яти годин блокує подальші запити до відновлення вікна;
- Обмеження стосується і персонального Plus, і командного ChatGPT Work — тобто торкається як соло-розробників, так і корпоративних користувачів.
Чому OpenAI знову вводить обмеження?
Пряма причина, названа в новині, — скарги користувачів на нестабільність квот. Схоже, спроба лібералізувати ліміти призвела до непрогнозованого навантаження на інфраструктуру Codex, і OpenAI обрала повернутися до перевіреної моделі, замість того щоб доопрацьовувати нову на льоту. Ймовірно, компанія балансує між утриманням собівартості інференсу для Plus-підписки і бажанням не втратити розробників, які вже звикли до Codex як до щоденного інструмента — але це наша оцінка, а не підтверджений факт з новини.
Кому це найбільше вдарить по робочому процесу?
Найбільше відчують зміну команди, що використовують Codex для тривалих агентних сесій — великих рефакторингів, серій тестів, багатокрокових задач, де агент працює годинами поспіль. П'ятигодинне вікно, що раптово закривається посеред задачі, ламає ритм роботи і змушує або чекати, або перемикатися на інший інструмент. Обмеження за ковзним вікном — поширена практика серед постачальників LLM-агентів: вона стримує пікове навантаження на GPU-кластери краще, ніж прості добові квоти, але для кінцевого користувача виглядає менш передбачувано, бо момент повного відновлення ліміту постійно зсувається. Для соло-розробників на Plus це менш критично, ніж для команд, де кілька людей паралельно тримають Codex-сесії — сукупне навантаження на спільний ліміт росте швидше, ніж здається.
Що робити командам, що будують на Codex, просто зараз?
За нашою оцінкою в AiiN, головний висновок з цієї історії — не сам факт повернення ліміту, а те, наскільки швидко OpenAI змінює правила гри для Plus-підписки: те, що працювало без обмежень тиждень тому, сьогодні знову лімітоване. Командам варто закладати п'ятигодинне вікно у планування задач так само, як закладають rate limits API — не як разову обставину, а як постійний параметр інфраструктури, який може змінитися знову без довгого попередження. Головний практичний висновок — Codex Plus не варто вважати необмеженим ресурсом навіть у щоденній роботі одного розробника, а тим більше в команді, що ділить один акаунт між кількома людьми.
- Розбивайте довгі агентні сесії на менші задачі, що вписуються у вікно ліміту;
- Для команд з кількома розробниками рахуйте сукупне навантаження на Codex, а не лише індивідуальне;
- Моніторте фактичний час до відновлення ліміту, а не покладайтеся на приблизні оцінки — це заощадить години простою в критичні дедлайни;
- Тримайте резервний план — доступ через API чи інший тариф — на випадок, коли ліміт Plus вичерпано в критичний момент.
Чи стосується ліміт лише Codex, чи й звичайного ChatGPT?
Обмеження повертається і для Codex, і для ChatGPT у тарифі Plus, включно з корпоративною версією ChatGPT Work — тобто зачіпає не лише розробників, а й будь-кого, хто активно використовує ChatGPT у щоденній роботі.
Чи можна обійти п'ятигодинний ліміт?
Новина не описує офіційного способу обійти ліміт у межах тарифу Plus; альтернативою для команд із високим навантаженням лишається перехід на використання Codex через API з оплатою за токени, де обмеження мають іншу природу.