Ліміти Codex: одне вікно на локаль і хмару — і як його розтягнути

24 хв. читання

Коротко (TL;DR)

Ліміт Codex — це не «стільки-то повідомлень на день», а два лічильники, що витрачаються одночасно: коротке 5-годинне вікно та тижнева стеля. Кожен запит зменшує обидва відразу. Ключова особливість саме Codex: локальна робота в терміналі та хмарні задачі витрачають одне й те саме вікно — хмара не дає окремого запасу.

Що важливо зрозуміти відразу (дані на 17 липня 2026, ліміти OpenAI змінює часто):

  • Codex входить в усі плани ChatGPT — Free, Go, Plus, Pro, Business, Enterprise. Окремої підписки на Codex немає, відрізняється лише розмір ліміту.
  • Скільки задач вміщується у вікно — залежить від моделі. Легка модель (GPT-5.4 mini) дає в рази більше повідомлень, ніж флагман (GPT-5.6 Sol). Наприклад, на Plus: 60-350 повідомлень mini проти 15-90 у Sol за 5 годин.
  • Витрата лічиться в кредитах за токенами, а не за кількістю повідомлень. Одне «повідомлення» може коштувати і 5, і 40 кредитів.
  • Хмарна задача дорожча за локальну приблизно у 5 разів — і з’їдає те саме вікно.
  • Розтягнути ліміт найпростіше трьома важелями: легша модель для рутини, менше зайвого контексту й точна постановка задачі, а для важких пакетів — вхід за API-ключем (оплата за токенами, без вікна).

Нижче — як це все влаштовано в деталях, повна таблиця лімітів за планами та що робити, коли вперлися у стелю.

Як влаштовані ліміти Codex

Codex — це агент OpenAI, що сам пише, запускає та править код. Він працює на кількох «пультах»: термінал (Codex CLI), розширення для VS Code, застосунок і хмарні задачі. Але ліміт у них спільний — прив’язаний до вашого плану ChatGPT, а не до конкретного пульта.

Витрата міряється двома вікнами відразу:

  • 5-годинне вікно — короткий цикл проти сплесків навантаження «тут і зараз».
  • тижневе вікно (7 днів) — стеля на довгу дистанцію.

Обидва вікна перевіряються одночасно, і один запит зменшує обидва. Тому нормальна ситуація, коли 5-годинний лічильник майже повний, а тижневий уже помітно просів: за тиждень накопичилася витрата, яку коротке вікно давно «забуло». Продовжувати роботу можна, лише поки в обох вікнах є залишок.

Другий важливий момент, на якому спотикаються новачки: локальні повідомлення та хмарні задачі Codex ділять одне 5-годинне вікно. Це прямо написано в офіційному прайсингу OpenAI. Запустили хмарну задачу паралельно з роботою в терміналі — вона відкусила від того самого ліміту, що й локальні запити. Розробники в трекері openai/codex не раз скаржилися саме на це об’єднання: хмара «з’їдає» вікно інтерактивної сесії непомітно.

Тут ліміти Codex влаштовані інакше, ніж, наприклад, у сусіднього агента Anthropic: як працюють ліміти Claude Code — окремий розбір, але загальний принцип «два рухомих вікна» у них схожий, а от прив’язка витрати до моделей і хмари в кожного своя.

І ще одна деталь, про яку легко забути: той самий ліміт Codex ділять із ним інші агентні функції OpenAI — режим ChatGPT Work і ChatGPT for Excel. Офіційне формулювання пряме: «Work mode usage inside ChatGPT uses the same pricing, credits, and usage limits as Codex». Якщо ви ганяєте довгі задачі у Work, вікно Codex тане теж.

5-годинне вікно: як воно скидається

5-годинне вікно рухоме, а не прив’язане до півночі чи початку доби. Воно відлічується від витрати, що його відкрила, і скидається рівно через 5 годин після неї.

На практиці це означає: важка серія задач о 09:00 «відкриє» вікно, і запас відновиться до 14:00. Якщо розмазати роботу по дню, у стелю можна взагалі не впертися. А якщо зранку запустити один великий рефакторинг перед скликом — ризикуєте лишитися без ліміту до обіду.

Висновок простий: ліміт — це не спільний бак на день, а ритм. Важкі задачі вигідніше розносити в часі, а не запускати пачкою.

Скільки задач дає кожен план: таблиця

Точного «стільки-то повідомлень» OpenAI не обіцяє: витрата залежить від моделі, обсягу контексту, глибини міркування та інструментів. Тому офіційні цифри — це діапазони локальних повідомлень за 5-годинне вікно. Нижче — зведена таблиця за планами й моделями (дані з офіційних сторінок Codex OpenAI на 17 липня 2026; хмарні задачі та рев’ю витрачають те саме вікно).

МодельPlusPro 5xPro 20xBusiness
GPT-5.6 Sol (флагман)15-9075-450300-180015-90
GPT-5.6 Terra (баланс)20-110100-550400-220020-110
GPT-5.6 Luna (швидкість)50-280250-14001000-560050-280
GPT-5.515-8075-400300-160015-80
GPT-5.420-100100-500400-200020-100
GPT-5.4 mini60-350300-17501200-700060-350
Вхід за API-ключемза токенами

Як це читати:

  • Plus і Business за лімітами однакові — базовий рівень. Enterprise та Edu без гнучкої тарифікації теж прирівняні до Plus за більшістю функцій.
  • Pro дає в 5 або 20 разів більше витрати, ніж Plus — це тарифи Pro 5x і Pro 20x. Відчутна різниця: на Pro 20x флагман Sol це вже 300-1800 повідомлень за вікно проти 15-90 у Plus.
  • Усередині одного плану модель вирішує все. На Plus легка GPT-5.4 mini дає 60-350 повідомлень — проти 15-90 у флагмана Sol. Тобто вибір моделі змінює ваш ефективний ліміт сильніше, ніж на перший погляд здається.
  • Для Enterprise та Edu з гнучкою тарифікацією фіксованих лімітів за розкладом немає — витрата просто масштабується кредитами.
  • Вхід за API-ключем ліміту за вікном не має взагалі — це окрема логіка, розберемо її нижче.

Числа в таблиці — середні орієнтири, а не гарантія. Важка задача на великому репозиторії «з’їсть» кілька повідомлень відразу, а коротка правка однієї функції — частку від норми.

Кредити й токени: чим насправді лічиться витрата

За «повідомленнями» ховається справжня одиниця обліку — кредити, і лічаться вони за токенами. Токен — це маленький шматочок тексту (приблизно 3-4 символи); у токенах міряється все, що Codex читає й пише: ваш промпт, файли, історія діалогу, вивід інструментів і відповідь моделі.

Витрата одного ходу складається з трьох частин: вхідні токени, кешовані вхідні токени та вихідні токени. Офіційна рейт-карта (кредитів за 1 млн токенів, на 17 липня 2026):

МодельВхідКеш-вхідВихід
GPT-5.6 Sol12512,5750
GPT-5.6 Terra62,56,25375
GPT-5.6 Luna252,5150
GPT-5.512512,5750
GPT-5.462,56,25375
GPT-5.4 mini18,751,875113

З цієї таблиці випливають три висновки, що прямо впливають на ваш ліміт:

  • Вихід дорожчий за вхід приблизно в 6 разів. Довгі відповіді, генерація гори коду, простирадла логів — найдорожче. Проси в Codex по суті, а не «покажи весь файл цілком».
  • Кешований вхід дешевший за свіжий приблизно на 90% (12,5 проти 125 кредитів у Sol). Кеш — це контекст, що вже «прогрітий» у поточній сесії: інструкції AGENTS.md, минулий вивід, історія. Звідси практичний прийом — продовжувати сесію, а не стартувати з нуля (про це нижче).
  • Різниця між флагманом і mini — величезна. За вихідними токенами GPT-5.6 Luna проти Sol дешевший у 5 разів, а GPT-5.4 mini проти 5.4 — майже в 3,5 раза. Ця різниця накопичується за весь робочий день.

У середньому один хід на моделях GPT-5.6 витрачає 5-40 кредитів — але саме «в середньому»: контекст, міркування та інструменти легко потроюють цифру. Розуміння того, що витрата лічиться за токенами, а не за кількістю повідомлень, — половина мистецтва економії. Якщо хочете глибше розібратися, чому довгий контекст = більше токенів = більше витрати, є окремий розбір про контекстне вікно LLM.

Локально чи в хмарі: чому хмара дорожча

У Codex два середовища виконання, і вони по-різному витрачають ліміт.

Локальна задача іде на вашій машині: агент читає робочу теку, править файли, запускає команди в пісочниці. Ви бачите вивід у реальному часі й схвалюєте дії.

Хмарна задача іде в ізольований контейнер в інфраструктурі OpenAI: там робиться checkout вашого GitHub-репозиторія, проганяються setup-скрипти, агент автономно працює 1-30 хвилин (інтернет за замовчуванням вимкнено), а результат віддається як готовий diff.

Різниця в ціні суттєва. За офіційним прайсингом на 17 липня 2026 та сама задача на GPT-5.4 коштує близько 7 кредитів локально й близько 34 кредитів у хмарі — приблизно 5-кратна надбавка. Логіка зрозуміла: хмара піднімає контейнер, тягне репозиторій, ставить залежності — це реальна робота платформи ще до того, як агент почав думати.

Практичний висновок: хмара — не «безкоштовний другий канал», а найпрожерливіший режим, що витрачає те саме вікно. Тримайте хмарні задачі для того, що реально потребує ізольованого середовища й довгої автономної роботи (міграції, великі пакетні правки, нічні прогони), а рутинні правки ганяйте локально.

Вхід за API-ключем: обхід вікна за поштучну оплату

Окрема розвилка — як ви взагалі заходите в Codex. Варіантів два: за планом ChatGPT (ліміт-вікна вище) або за API-ключем (usage-based).

За входу за API-ключем лімітів за розкладом немає взагалі — ви платите лише за реально використані токени за цінами API. Натомість втрачаєте хмарні функції (рев’ю в GitHub, інтеграцію зі Slack), а набір моделей дорівнює тим, що доступні вашому ключу.

Порядок доларових цін API (стандартний тариф, за 1 млн токенів вхід/вихід, на 17 липня 2026): gpt-5.6-sol — $5 / $30; gpt-5.6-terra — $2,5 / $15; gpt-5.6-luna — $1 / $6; gpt-5.4-mini — $0,75 / $4,5. Кешований вхід, як і в кредитах, дешевший приблизно на 90%.

Коли API-ключ вигідніший за підписку:

СценарійЩо брати
Інтерактивна розробка протягом дняПлан Plus / Pro
CI/CD, менше ~50 прогонів на деньPlus + codex exec
Важкі пакети, більше ~100 задач на деньAPI-ключ (за токенами)
Нічні автономні циклиAPI-ключ (немає вікна)

Логіка проста: підписка — це «безліміт у межах вікна» і добра для живої роботи руками; API-ключ — «плати скільки витратив» і добрий для великих автоматичних обсягів, яким тісно у вікні. Важливе застереження чесності: без вікна рахунок за API зростає без стелі плану — за витратою треба стежити.

Вперлися в ліміт — що робити просто зараз

Спершу гарна новина: якщо ліміт скінчився під час активного ходу, Codex доробить цей хід до кінця (у межах fair-use) — вас не обірвуть на півслові. Проблема починається з наступного запиту. Варіанти за зростанням зусиль:

  1. Перемкнутися на меншу модель. Найшвидший важіль: GPT-5.4 або 5.4 mini під рутину розтягують залишок вікна в рази. Докладніше — у наступному розділі.
  2. Активувати банкований скид (якщо є в запасі) — миттєво обнуляє поточне 5-годинне вікно. Про банкування — нижче.
  3. Придбати кредити. Plus і Pro можуть придбати додаткові кредити й продовжити без апгрейду плану; Business/Edu/Enterprise з гнучкою тарифікацією докуповують workspace-кредити.
  4. Запустити роботу за API-ключем. Будь-який користувач може ганяти додаткові локальні задачі за API-ключем — витрата лічиться за цінами API, оминаючи вікно плану.
  5. Зачекати скиду. 5-годинне вікно відкриється через 5 годин після витрати, що його закрила; тижневе — за своїм розкладом.

Чого скид 5-годинного вікна не робить — не відновлює тижневий ліміт. Якщо вигоріла тижнева стеля, короткий скид не допоможе: тут лише кредити, API-ключ або очікування тижневого скиду.

Як розтягнути ліміт: робочі важелі

Офіційна порада OpenAI й практика сходяться в одному: витрата — це питання налаштування, а не «мало ліміту». Та сама задача може коштувати і 5, і 40 кредитів залежно від моделі, контексту та глибини міркування. Ось важелі від найпростішого до просунутого.

1. Легша модель під рутину

Найсильніший важіль без апгрейду плану. Не кожна задача потребує флагмана: тести, бойлерплейт, форматування, правки в одному файлі, документація чудово йдуть на GPT-5.4 mini. За офіційними діапазонами перехід із 5.4 на 5.4 mini розтягує ліміт локальних повідомлень приблизно в 2,5-3,3 раза.

Робоча схема — «планувальник і робітник»: складне планування, архітектуру й тонкий дебаг лишаєте флагману, а виконання делегуєте mini. Якщо 70% ходів ідуть на mini, з вікна на 300 повідомлень можна витягти 900+. Чим моделі GPT-5.6 відрізняються і яку брати під задачу — розібрано в огляді моделей GPT-5.6 Sol, Terra і Luna.

2. Менше контексту й точна постановка

Кожен зайвий файл, довгий лог і роздутий AGENTS.md — це вхідні токени на кожному ході. Офіційні поради OpenAI:

  • Скорочуйте промпт: точна інструкція, але без зайвого контексту.
  • Давайте лише релевантні файли; указуйте шляхи, щоб Codex не сканував увесь репозиторій.
  • Задавайте формат і довжину виводу; відокремлюйте обов’язкове від «покращень за бажанням».
  • Зменшуйте AGENTS.md — на великих проєктах вкладайте окремі файли по підтеках, а не тримайте один величезний.
  • Обмежуйте кількість MCP-серверів: кожен під’єднаний сервер додає описи інструментів у кожен запит. Вимикайте ті, що не потрібні просто зараз.

3. Налаштування config.toml (просунуте)

Цей розділ — для тих, хто працює через Codex CLI; новачок може пропустити. Термінальний Codex дає тонкі ручки витрати у файлі ~/.codex/config.toml:

  • model — модель за замовчуванням (поставте mini як базову, флагман вмикайте на конкретну задачу).
  • model_reasoning_effort — глибина міркування (minimal/low/medium/high/xhigh). Глобальний medium покриває більшість роботи без переплати за глибоке міркування на рутині.
  • tool_output_token_limit — обрізка виводу інструментів. Один із найкорисніших ключів: без нього об’ємний git diff чи простирадло тестів заливають контекст тисячами токенів і роздувають кожен наступний хід.
  • service_tier = "flex" — дешевше в обмін на можливу чергу; зручно для пакетних codex exec і CI, де швидкість відповіді не критична.
  • Профілі (--profile fast / --profile deep) перемикають цілі набори налаштувань однією командою — «дешевий» набір для рутини й «дорогий» для складного.

4. Продовжуйте сесію, а не стартуйте з нуля

Пам’ятаєте про 90%-знижку на кешований вхід? Кожен свіжий старт заново проганяє AGENTS.md, контекст проєкту й системний промпт як нові вхідні токени. Продовження сесії (codex resume) потрапляє в кешований тариф — тобто приблизно в 10 разів дешевше за входом. Для пов’язаних задач продовжувати вигідніше, ніж починати заново.

5. Банкування скидів і реферали

З 11 червня 2026 (застосунок Codex 26.609) для Plus і Pro з’явилося банкування скидів: невикористані скиди 5-годинного вікна можна накопичувати й активувати вручну, коли справді потрібно, а не втрачати за таймером. Банкований скид діє 30 днів і за запуску миттєво обнуляє поточне вікно. Платного докуповування скидів немає — це безкоштовна функція плану.

Отримати скид можна й за реферальною механікою: коли запрошений відправляє своє перше повідомлення Codex, банкований скид отримують обидва. У промо-вікно 11-24 червня 2026 Plus/Pro могли запросити до трьох людей. Застереження: скиди спливають через 30 днів, а промо було обмежене датами — як постійний запас на них розраховувати не можна.

Типові помилки, що палять ліміт

  • Ганяти все на флагмані. Навіть форматування й тести на Sol/5.4 випалюють вікно втричі швидше, ніж на mini.
  • Запускати хмарні задачі «за компанію». Хмара витрачає те саме вікно й дорожча приблизно в 5 разів — це не окремий запас.
  • Генерація картинок і Fast-режим. Генерація зображень зараховується в загальний ліміт і витрачає його в середньому у 3-5 разів швидше за звичайний хід (за офіційними даними на 17 липня 2026). Fast-режим теж палить кредити швидше за стандартний. Вмикайте їх свідомо.
  • Роздутий AGENTS.md і зайві MCP. Усе це — вхідні токени на кожному запиті; кеш частково рятує, але не повністю.
  • Сліпо вірити «повідомленням». Плагін в IDE може витрачати квоту інакше, ніж CLI; десять «повідомлень» — це не десять однакових списань. Орієнтуйтеся на кредити, а не на лічильник повідомлень.
  • Змішувати рев’ю. Рев’ю PR через GitHub (@Codex) зараховується окремим рядком ліміту, а рев’ю поза GitHub іде в загальний ліміт — це змінює арифметику, якщо рев’ю у вас багато.

Слабкі місця й ризики лімітів Codex

Навіть за акуратної роботи в системи лімітів є незручні кути — тримайте їх у голові (актуально на 17 липня 2026):

  • Числа нестабільні. OpenAI змінює й моделі, й діапазони майже щомісяця (за пів року 2026-го: 5.4 → 5.5 → лінійка GPT-5.6). Будь-які конкретні цифри — включно з цими — швидко застарівають; спирайтеся на механіку й на свій /status, а не на чужі числа.
  • Хмара непомітно з’їдає вікно. Локаль і хмара ділять один 5-годинний ліміт, а хмарна задача дорожча приблизно в 5 разів. Одна важка хмарна задача може вибити вас з інтерактивної сесії.
  • У API-ключа немає стелі. Обхід вікна зручний, але рахунок за токенами зростає без обмеження плану — за неакуратної роботи це прямий ризик переплати.
  • Банковані скиди спливають. Скид живе 30 днів, а промо-реферал було обмежене вікном 11-24 червня 2026 — як постійний запас розраховувати на них не можна.
  • Тижневий ліміт непрозорий. Він «пам’ятає» всю витрату за 7 днів і може вигоріти, коли 5-годинний ще повний; короткий скид його не відновлює.

Де дивитися свою витрату

Гадати за чужими числами марно — у вас завжди є свої. Просто в активній сесії Codex CLI залишок ліміту показує команда /status. Повну картину дає сторінка Codex usage (дашборд використання) — OpenAI радить заглядати туди раз на тиждень-два, щоб розуміти свій темп і залишок.

Якщо пишете свій скрипт моніторингу, не довіряйте готовим міткам на кшталт «five_hour%» — читайте сирі поля (limit_window_seconds, percent_left, reset_at): 18000 секунд — це 5-годинне вікно, 604800 — тижневе. Переплутані мітки — часта причина «неправильного» відображення квоти.

Чому числа лімітів весь час змінюються

Останнє, але важливе. Числа в цій статті — знімок на 17 липня 2026. За першу половину 2026 року OpenAI встигла змінити й моделі, й ліміти не раз: навесні актуальними були GPT-5.4 і 5.3-Codex, улітку флагманом стала лінійка GPT-5.6 (Sol, Terra, Luna), а самі діапазони повідомлень коригувалися разом із ними. Окремо живе дослідницький GPT-5.3-Codex-Spark — швидка модель лише для Pro, з власним лімітом.

Тому висновок для читача один: конкретні числа швидко застарівають, а механіка — ні. Два вікна, спільний ліміт на локаль і хмару, витрата за токенами, модель як головний важіль — це стійка рамка. А точний залишок завжди дивіться на своєму /status і в дашборді, а не в чужих статтях (включно з цією).

FAQ

Чи є в Codex безкоштовний ліміт? Так, Codex входить в усі плани ChatGPT, включно з Free і Go, — окремої підписки не потрібно. Але на безкоштовних планах ліміт найменший, а частина функцій (наприклад, генерація зображень) недоступна. Для реальної роботи потрібен платний план.

Локальні та хмарні задачі лічаться окремо? Ні. Локальні повідомлення та хмарні задачі Codex ділять одне 5-годинне вікно й спільний тижневий ліміт. Ба більше, хмарна задача коштує приблизно в 5 разів дорожче за локальну в кредитах, тож хмара випалює вікно швидше.

5-годинне вікно скидається опівночі? Ні, вікно рухоме: воно скидається через 5 годин після витрати, що його відкрила, а не о фіксованій порі доби. Якщо розмазати навантаження по дню, у стелю можна не впертися взагалі.

Як найшвидше розтягнути ліміт без апгрейду плану? Перемкнути рутину на легку модель (GPT-5.4 mini) — це розтягує ліміт локальних повідомлень приблизно в 2,5-3,3 раза. Плюс прибрати зайвий контекст, точно вказувати файли та продовжувати сесію замість старту з нуля (кеш дешевший за вхід на ~90%).

У чому різниця між входом за планом ChatGPT і за API-ключем? За планом ChatGPT ви працюєте в межах ліміт-вікон, але отримуєте хмарні функції (рев’ю в GitHub, Slack). За API-ключем вікон немає — платите лише за токени за цінами API, але хмарні функції недоступні, а моделі обмежені доступом вашого ключа. API-ключ вигідний для великих автоматичних обсягів, план — для живої роботи руками.

Чому тижневий ліміт падає швидше за 5-годинний? Тому що обидва вікна витрачаються одночасно, а тижневе «пам’ятає» всю витрату за 7 днів. Пришвидшують його хмарні задачі, важкі моделі, Fast-режим, великий контекст і довгі відповіді. Короткий скид тижневу стелю не відновлює.

Курс «OpenAI Codex: агентний кодинг» · модуль «Старт і доступ». Повна програма і два маршрути навчання — на сторінці курсу.

Попередній урок: Перший запуск: перша задача за 15 хвилин

Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.