Коротко (TL;DR)
Ліміт Codex — це не «стільки-то повідомлень на день», а два лічильники, що витрачаються одночасно: коротке 5-годинне вікно та тижнева стеля. Кожен запит зменшує обидва відразу. Ключова особливість саме Codex: локальна робота в терміналі та хмарні задачі витрачають одне й те саме вікно — хмара не дає окремого запасу.
- Коротко (TL;DR)
- Як влаштовані ліміти Codex
- 5-годинне вікно: як воно скидається
- Скільки задач дає кожен план: таблиця
- Кредити й токени: чим насправді лічиться витрата
- Локально чи в хмарі: чому хмара дорожча
- Вхід за API-ключем: обхід вікна за поштучну оплату
- Вперлися в ліміт — що робити просто зараз
- Як розтягнути ліміт: робочі важелі
- Типові помилки, що палять ліміт
- Слабкі місця й ризики лімітів Codex
- Де дивитися свою витрату
- Чому числа лімітів весь час змінюються
- FAQ
Що важливо зрозуміти відразу (дані на 17 липня 2026, ліміти OpenAI змінює часто):
- Codex входить в усі плани ChatGPT — Free, Go, Plus, Pro, Business, Enterprise. Окремої підписки на Codex немає, відрізняється лише розмір ліміту.
- Скільки задач вміщується у вікно — залежить від моделі. Легка модель (GPT-5.4 mini) дає в рази більше повідомлень, ніж флагман (GPT-5.6 Sol). Наприклад, на Plus: 60-350 повідомлень mini проти 15-90 у Sol за 5 годин.
- Витрата лічиться в кредитах за токенами, а не за кількістю повідомлень. Одне «повідомлення» може коштувати і 5, і 40 кредитів.
- Хмарна задача дорожча за локальну приблизно у 5 разів — і з’їдає те саме вікно.
- Розтягнути ліміт найпростіше трьома важелями: легша модель для рутини, менше зайвого контексту й точна постановка задачі, а для важких пакетів — вхід за API-ключем (оплата за токенами, без вікна).
Нижче — як це все влаштовано в деталях, повна таблиця лімітів за планами та що робити, коли вперлися у стелю.
Як влаштовані ліміти Codex
Codex — це агент OpenAI, що сам пише, запускає та править код. Він працює на кількох «пультах»: термінал (Codex CLI), розширення для VS Code, застосунок і хмарні задачі. Але ліміт у них спільний — прив’язаний до вашого плану ChatGPT, а не до конкретного пульта.
Витрата міряється двома вікнами відразу:
- 5-годинне вікно — короткий цикл проти сплесків навантаження «тут і зараз».
- тижневе вікно (7 днів) — стеля на довгу дистанцію.
Обидва вікна перевіряються одночасно, і один запит зменшує обидва. Тому нормальна ситуація, коли 5-годинний лічильник майже повний, а тижневий уже помітно просів: за тиждень накопичилася витрата, яку коротке вікно давно «забуло». Продовжувати роботу можна, лише поки в обох вікнах є залишок.
Другий важливий момент, на якому спотикаються новачки: локальні повідомлення та хмарні задачі Codex ділять одне 5-годинне вікно. Це прямо написано в офіційному прайсингу OpenAI. Запустили хмарну задачу паралельно з роботою в терміналі — вона відкусила від того самого ліміту, що й локальні запити. Розробники в трекері openai/codex не раз скаржилися саме на це об’єднання: хмара «з’їдає» вікно інтерактивної сесії непомітно.
Тут ліміти Codex влаштовані інакше, ніж, наприклад, у сусіднього агента Anthropic: як працюють ліміти Claude Code — окремий розбір, але загальний принцип «два рухомих вікна» у них схожий, а от прив’язка витрати до моделей і хмари в кожного своя.
І ще одна деталь, про яку легко забути: той самий ліміт Codex ділять із ним інші агентні функції OpenAI — режим ChatGPT Work і ChatGPT for Excel. Офіційне формулювання пряме: «Work mode usage inside ChatGPT uses the same pricing, credits, and usage limits as Codex». Якщо ви ганяєте довгі задачі у Work, вікно Codex тане теж.
5-годинне вікно: як воно скидається
5-годинне вікно рухоме, а не прив’язане до півночі чи початку доби. Воно відлічується від витрати, що його відкрила, і скидається рівно через 5 годин після неї.
На практиці це означає: важка серія задач о 09:00 «відкриє» вікно, і запас відновиться до 14:00. Якщо розмазати роботу по дню, у стелю можна взагалі не впертися. А якщо зранку запустити один великий рефакторинг перед скликом — ризикуєте лишитися без ліміту до обіду.
Висновок простий: ліміт — це не спільний бак на день, а ритм. Важкі задачі вигідніше розносити в часі, а не запускати пачкою.
Скільки задач дає кожен план: таблиця
Точного «стільки-то повідомлень» OpenAI не обіцяє: витрата залежить від моделі, обсягу контексту, глибини міркування та інструментів. Тому офіційні цифри — це діапазони локальних повідомлень за 5-годинне вікно. Нижче — зведена таблиця за планами й моделями (дані з офіційних сторінок Codex OpenAI на 17 липня 2026; хмарні задачі та рев’ю витрачають те саме вікно).Модель Plus Pro 5x Pro 20x Business GPT-5.6 Sol (флагман) 15-90 75-450 300-1800 15-90 GPT-5.6 Terra (баланс) 20-110 100-550 400-2200 20-110 GPT-5.6 Luna (швидкість) 50-280 250-1400 1000-5600 50-280 GPT-5.5 15-80 75-400 300-1600 15-80 GPT-5.4 20-100 100-500 400-2000 20-100 GPT-5.4 mini 60-350 300-1750 1200-7000 60-350 Вхід за API-ключем за токенами — — —
Як це читати:
- Plus і Business за лімітами однакові — базовий рівень. Enterprise та Edu без гнучкої тарифікації теж прирівняні до Plus за більшістю функцій.
- Pro дає в 5 або 20 разів більше витрати, ніж Plus — це тарифи Pro 5x і Pro 20x. Відчутна різниця: на Pro 20x флагман Sol це вже 300-1800 повідомлень за вікно проти 15-90 у Plus.
- Усередині одного плану модель вирішує все. На Plus легка GPT-5.4 mini дає 60-350 повідомлень — проти 15-90 у флагмана Sol. Тобто вибір моделі змінює ваш ефективний ліміт сильніше, ніж на перший погляд здається.
- Для Enterprise та Edu з гнучкою тарифікацією фіксованих лімітів за розкладом немає — витрата просто масштабується кредитами.
- Вхід за API-ключем ліміту за вікном не має взагалі — це окрема логіка, розберемо її нижче.
Числа в таблиці — середні орієнтири, а не гарантія. Важка задача на великому репозиторії «з’їсть» кілька повідомлень відразу, а коротка правка однієї функції — частку від норми.
Кредити й токени: чим насправді лічиться витрата
За «повідомленнями» ховається справжня одиниця обліку — кредити, і лічаться вони за токенами. Токен — це маленький шматочок тексту (приблизно 3-4 символи); у токенах міряється все, що Codex читає й пише: ваш промпт, файли, історія діалогу, вивід інструментів і відповідь моделі.
Витрата одного ходу складається з трьох частин: вхідні токени, кешовані вхідні токени та вихідні токени. Офіційна рейт-карта (кредитів за 1 млн токенів, на 17 липня 2026):Модель Вхід Кеш-вхід Вихід GPT-5.6 Sol 125 12,5 750 GPT-5.6 Terra 62,5 6,25 375 GPT-5.6 Luna 25 2,5 150 GPT-5.5 125 12,5 750 GPT-5.4 62,5 6,25 375 GPT-5.4 mini 18,75 1,875 113
З цієї таблиці випливають три висновки, що прямо впливають на ваш ліміт:
- Вихід дорожчий за вхід приблизно в 6 разів. Довгі відповіді, генерація гори коду, простирадла логів — найдорожче. Проси в Codex по суті, а не «покажи весь файл цілком».
- Кешований вхід дешевший за свіжий приблизно на 90% (12,5 проти 125 кредитів у Sol). Кеш — це контекст, що вже «прогрітий» у поточній сесії: інструкції AGENTS.md, минулий вивід, історія. Звідси практичний прийом — продовжувати сесію, а не стартувати з нуля (про це нижче).
- Різниця між флагманом і mini — величезна. За вихідними токенами GPT-5.6 Luna проти Sol дешевший у 5 разів, а GPT-5.4 mini проти 5.4 — майже в 3,5 раза. Ця різниця накопичується за весь робочий день.
У середньому один хід на моделях GPT-5.6 витрачає 5-40 кредитів — але саме «в середньому»: контекст, міркування та інструменти легко потроюють цифру. Розуміння того, що витрата лічиться за токенами, а не за кількістю повідомлень, — половина мистецтва економії. Якщо хочете глибше розібратися, чому довгий контекст = більше токенів = більше витрати, є окремий розбір про контекстне вікно LLM.
Локально чи в хмарі: чому хмара дорожча
У Codex два середовища виконання, і вони по-різному витрачають ліміт.
Локальна задача іде на вашій машині: агент читає робочу теку, править файли, запускає команди в пісочниці. Ви бачите вивід у реальному часі й схвалюєте дії.
Хмарна задача іде в ізольований контейнер в інфраструктурі OpenAI: там робиться checkout вашого GitHub-репозиторія, проганяються setup-скрипти, агент автономно працює 1-30 хвилин (інтернет за замовчуванням вимкнено), а результат віддається як готовий diff.
Різниця в ціні суттєва. За офіційним прайсингом на 17 липня 2026 та сама задача на GPT-5.4 коштує близько 7 кредитів локально й близько 34 кредитів у хмарі — приблизно 5-кратна надбавка. Логіка зрозуміла: хмара піднімає контейнер, тягне репозиторій, ставить залежності — це реальна робота платформи ще до того, як агент почав думати.
Практичний висновок: хмара — не «безкоштовний другий канал», а найпрожерливіший режим, що витрачає те саме вікно. Тримайте хмарні задачі для того, що реально потребує ізольованого середовища й довгої автономної роботи (міграції, великі пакетні правки, нічні прогони), а рутинні правки ганяйте локально.
Вхід за API-ключем: обхід вікна за поштучну оплату
Окрема розвилка — як ви взагалі заходите в Codex. Варіантів два: за планом ChatGPT (ліміт-вікна вище) або за API-ключем (usage-based).
За входу за API-ключем лімітів за розкладом немає взагалі — ви платите лише за реально використані токени за цінами API. Натомість втрачаєте хмарні функції (рев’ю в GitHub, інтеграцію зі Slack), а набір моделей дорівнює тим, що доступні вашому ключу.
Порядок доларових цін API (стандартний тариф, за 1 млн токенів вхід/вихід, на 17 липня 2026): gpt-5.6-sol — $5 / $30; gpt-5.6-terra — $2,5 / $15; gpt-5.6-luna — $1 / $6; gpt-5.4-mini — $0,75 / $4,5. Кешований вхід, як і в кредитах, дешевший приблизно на 90%.
Коли API-ключ вигідніший за підписку:Сценарій Що брати Інтерактивна розробка протягом дня План Plus / Pro CI/CD, менше ~50 прогонів на день Plus + codex execВажкі пакети, більше ~100 задач на день API-ключ (за токенами) Нічні автономні цикли API-ключ (немає вікна)
Логіка проста: підписка — це «безліміт у межах вікна» і добра для живої роботи руками; API-ключ — «плати скільки витратив» і добрий для великих автоматичних обсягів, яким тісно у вікні. Важливе застереження чесності: без вікна рахунок за API зростає без стелі плану — за витратою треба стежити.
Вперлися в ліміт — що робити просто зараз
Спершу гарна новина: якщо ліміт скінчився під час активного ходу, Codex доробить цей хід до кінця (у межах fair-use) — вас не обірвуть на півслові. Проблема починається з наступного запиту. Варіанти за зростанням зусиль:
- Перемкнутися на меншу модель. Найшвидший важіль: GPT-5.4 або 5.4 mini під рутину розтягують залишок вікна в рази. Докладніше — у наступному розділі.
- Активувати банкований скид (якщо є в запасі) — миттєво обнуляє поточне 5-годинне вікно. Про банкування — нижче.
- Придбати кредити. Plus і Pro можуть придбати додаткові кредити й продовжити без апгрейду плану; Business/Edu/Enterprise з гнучкою тарифікацією докуповують workspace-кредити.
- Запустити роботу за API-ключем. Будь-який користувач може ганяти додаткові локальні задачі за API-ключем — витрата лічиться за цінами API, оминаючи вікно плану.
- Зачекати скиду. 5-годинне вікно відкриється через 5 годин після витрати, що його закрила; тижневе — за своїм розкладом.
Чого скид 5-годинного вікна не робить — не відновлює тижневий ліміт. Якщо вигоріла тижнева стеля, короткий скид не допоможе: тут лише кредити, API-ключ або очікування тижневого скиду.
Як розтягнути ліміт: робочі важелі
Офіційна порада OpenAI й практика сходяться в одному: витрата — це питання налаштування, а не «мало ліміту». Та сама задача може коштувати і 5, і 40 кредитів залежно від моделі, контексту та глибини міркування. Ось важелі від найпростішого до просунутого.
1. Легша модель під рутину
Найсильніший важіль без апгрейду плану. Не кожна задача потребує флагмана: тести, бойлерплейт, форматування, правки в одному файлі, документація чудово йдуть на GPT-5.4 mini. За офіційними діапазонами перехід із 5.4 на 5.4 mini розтягує ліміт локальних повідомлень приблизно в 2,5-3,3 раза.
Робоча схема — «планувальник і робітник»: складне планування, архітектуру й тонкий дебаг лишаєте флагману, а виконання делегуєте mini. Якщо 70% ходів ідуть на mini, з вікна на 300 повідомлень можна витягти 900+. Чим моделі GPT-5.6 відрізняються і яку брати під задачу — розібрано в огляді моделей GPT-5.6 Sol, Terra і Luna.
2. Менше контексту й точна постановка
Кожен зайвий файл, довгий лог і роздутий AGENTS.md — це вхідні токени на кожному ході. Офіційні поради OpenAI:
- Скорочуйте промпт: точна інструкція, але без зайвого контексту.
- Давайте лише релевантні файли; указуйте шляхи, щоб Codex не сканував увесь репозиторій.
- Задавайте формат і довжину виводу; відокремлюйте обов’язкове від «покращень за бажанням».
- Зменшуйте AGENTS.md — на великих проєктах вкладайте окремі файли по підтеках, а не тримайте один величезний.
- Обмежуйте кількість MCP-серверів: кожен під’єднаний сервер додає описи інструментів у кожен запит. Вимикайте ті, що не потрібні просто зараз.
3. Налаштування config.toml (просунуте)
Цей розділ — для тих, хто працює через Codex CLI; новачок може пропустити. Термінальний Codex дає тонкі ручки витрати у файлі ~/.codex/config.toml:
model— модель за замовчуванням (поставте mini як базову, флагман вмикайте на конкретну задачу).model_reasoning_effort— глибина міркування (minimal/low/medium/high/xhigh). Глобальнийmediumпокриває більшість роботи без переплати за глибоке міркування на рутині.tool_output_token_limit— обрізка виводу інструментів. Один із найкорисніших ключів: без нього об’ємнийgit diffчи простирадло тестів заливають контекст тисячами токенів і роздувають кожен наступний хід.service_tier = "flex"— дешевше в обмін на можливу чергу; зручно для пакетнихcodex execі CI, де швидкість відповіді не критична.- Профілі (
--profile fast/--profile deep) перемикають цілі набори налаштувань однією командою — «дешевий» набір для рутини й «дорогий» для складного.
4. Продовжуйте сесію, а не стартуйте з нуля
Пам’ятаєте про 90%-знижку на кешований вхід? Кожен свіжий старт заново проганяє AGENTS.md, контекст проєкту й системний промпт як нові вхідні токени. Продовження сесії (codex resume) потрапляє в кешований тариф — тобто приблизно в 10 разів дешевше за входом. Для пов’язаних задач продовжувати вигідніше, ніж починати заново.
5. Банкування скидів і реферали
З 11 червня 2026 (застосунок Codex 26.609) для Plus і Pro з’явилося банкування скидів: невикористані скиди 5-годинного вікна можна накопичувати й активувати вручну, коли справді потрібно, а не втрачати за таймером. Банкований скид діє 30 днів і за запуску миттєво обнуляє поточне вікно. Платного докуповування скидів немає — це безкоштовна функція плану.
Отримати скид можна й за реферальною механікою: коли запрошений відправляє своє перше повідомлення Codex, банкований скид отримують обидва. У промо-вікно 11-24 червня 2026 Plus/Pro могли запросити до трьох людей. Застереження: скиди спливають через 30 днів, а промо було обмежене датами — як постійний запас на них розраховувати не можна.
Типові помилки, що палять ліміт
- Ганяти все на флагмані. Навіть форматування й тести на Sol/5.4 випалюють вікно втричі швидше, ніж на mini.
- Запускати хмарні задачі «за компанію». Хмара витрачає те саме вікно й дорожча приблизно в 5 разів — це не окремий запас.
- Генерація картинок і Fast-режим. Генерація зображень зараховується в загальний ліміт і витрачає його в середньому у 3-5 разів швидше за звичайний хід (за офіційними даними на 17 липня 2026). Fast-режим теж палить кредити швидше за стандартний. Вмикайте їх свідомо.
- Роздутий AGENTS.md і зайві MCP. Усе це — вхідні токени на кожному запиті; кеш частково рятує, але не повністю.
- Сліпо вірити «повідомленням». Плагін в IDE може витрачати квоту інакше, ніж CLI; десять «повідомлень» — це не десять однакових списань. Орієнтуйтеся на кредити, а не на лічильник повідомлень.
- Змішувати рев’ю. Рев’ю PR через GitHub (
@Codex) зараховується окремим рядком ліміту, а рев’ю поза GitHub іде в загальний ліміт — це змінює арифметику, якщо рев’ю у вас багато.
Слабкі місця й ризики лімітів Codex
Навіть за акуратної роботи в системи лімітів є незручні кути — тримайте їх у голові (актуально на 17 липня 2026):
- Числа нестабільні. OpenAI змінює й моделі, й діапазони майже щомісяця (за пів року 2026-го: 5.4 → 5.5 → лінійка GPT-5.6). Будь-які конкретні цифри — включно з цими — швидко застарівають; спирайтеся на механіку й на свій
/status, а не на чужі числа. - Хмара непомітно з’їдає вікно. Локаль і хмара ділять один 5-годинний ліміт, а хмарна задача дорожча приблизно в 5 разів. Одна важка хмарна задача може вибити вас з інтерактивної сесії.
- У API-ключа немає стелі. Обхід вікна зручний, але рахунок за токенами зростає без обмеження плану — за неакуратної роботи це прямий ризик переплати.
- Банковані скиди спливають. Скид живе 30 днів, а промо-реферал було обмежене вікном 11-24 червня 2026 — як постійний запас розраховувати на них не можна.
- Тижневий ліміт непрозорий. Він «пам’ятає» всю витрату за 7 днів і може вигоріти, коли 5-годинний ще повний; короткий скид його не відновлює.
Де дивитися свою витрату
Гадати за чужими числами марно — у вас завжди є свої. Просто в активній сесії Codex CLI залишок ліміту показує команда /status. Повну картину дає сторінка Codex usage (дашборд використання) — OpenAI радить заглядати туди раз на тиждень-два, щоб розуміти свій темп і залишок.
Якщо пишете свій скрипт моніторингу, не довіряйте готовим міткам на кшталт «five_hour%» — читайте сирі поля (limit_window_seconds, percent_left, reset_at): 18000 секунд — це 5-годинне вікно, 604800 — тижневе. Переплутані мітки — часта причина «неправильного» відображення квоти.
Чому числа лімітів весь час змінюються
Останнє, але важливе. Числа в цій статті — знімок на 17 липня 2026. За першу половину 2026 року OpenAI встигла змінити й моделі, й ліміти не раз: навесні актуальними були GPT-5.4 і 5.3-Codex, улітку флагманом стала лінійка GPT-5.6 (Sol, Terra, Luna), а самі діапазони повідомлень коригувалися разом із ними. Окремо живе дослідницький GPT-5.3-Codex-Spark — швидка модель лише для Pro, з власним лімітом.
Тому висновок для читача один: конкретні числа швидко застарівають, а механіка — ні. Два вікна, спільний ліміт на локаль і хмару, витрата за токенами, модель як головний важіль — це стійка рамка. А точний залишок завжди дивіться на своєму /status і в дашборді, а не в чужих статтях (включно з цією).
FAQ
Чи є в Codex безкоштовний ліміт? Так, Codex входить в усі плани ChatGPT, включно з Free і Go, — окремої підписки не потрібно. Але на безкоштовних планах ліміт найменший, а частина функцій (наприклад, генерація зображень) недоступна. Для реальної роботи потрібен платний план.
Локальні та хмарні задачі лічаться окремо? Ні. Локальні повідомлення та хмарні задачі Codex ділять одне 5-годинне вікно й спільний тижневий ліміт. Ба більше, хмарна задача коштує приблизно в 5 разів дорожче за локальну в кредитах, тож хмара випалює вікно швидше.
5-годинне вікно скидається опівночі? Ні, вікно рухоме: воно скидається через 5 годин після витрати, що його відкрила, а не о фіксованій порі доби. Якщо розмазати навантаження по дню, у стелю можна не впертися взагалі.
Як найшвидше розтягнути ліміт без апгрейду плану? Перемкнути рутину на легку модель (GPT-5.4 mini) — це розтягує ліміт локальних повідомлень приблизно в 2,5-3,3 раза. Плюс прибрати зайвий контекст, точно вказувати файли та продовжувати сесію замість старту з нуля (кеш дешевший за вхід на ~90%).
У чому різниця між входом за планом ChatGPT і за API-ключем? За планом ChatGPT ви працюєте в межах ліміт-вікон, але отримуєте хмарні функції (рев’ю в GitHub, Slack). За API-ключем вікон немає — платите лише за токени за цінами API, але хмарні функції недоступні, а моделі обмежені доступом вашого ключа. API-ключ вигідний для великих автоматичних обсягів, план — для живої роботи руками.
Чому тижневий ліміт падає швидше за 5-годинний? Тому що обидва вікна витрачаються одночасно, а тижневе «пам’ятає» всю витрату за 7 днів. Пришвидшують його хмарні задачі, важкі моделі, Fast-режим, великий контекст і довгі відповіді. Короткий скид тижневу стелю не відновлює.
Курс «OpenAI Codex: агентний кодинг» · модуль «Старт і доступ». Повна програма і два маршрути навчання — на сторінці курсу.
Попередній урок: Перший запуск: перша задача за 15 хвилин
