Что понадобится
- Установленный Codex CLI. Версия проверяется командой
codex --version- у меня отвечаетcodex-cli 0.152.1. - Вход в аккаунт. Проверяется командой
codex login status- ответ видаLogged in using ChatGPT. - Браузер - для страницы расхода в аккаунте ChatGPT.
Про сам инструмент - в словаре. Сравнение с соседом по цеху - Codex или Claude Code.
Главное: лимит - это не одно число
Люди ищут «сколько запросов даёт Codex» и ждут цифру. Цифры нет, и это не отговорка - так устроено внутри.
Расход в Codex описан окном из трёх величин: сколько процентов окна уже израсходовано, какой длины окно и когда оно обнулится. Эти три поля лежат в самом CLI, а значения к ним приезжают с сервера под конкретный аккаунт. То есть в программе зашита форма ответа, а не сам ответ.
Окно не одно. В настройках строки состояния Codex перечисляет их списком: основное окно, оно же пятичасовое, и второе - а рядом дневное, недельное, месячное и годовое. Какие включены именно у тебя, зависит от плана; те, по которым данных нет, Codex просто не показывает.
Официальная страница тарифов OpenAI (смотрел 03.09.2026) говорит то же самое другими словами: на планах ChatGPT локальные сообщения и облачные задачи делят одно пятичасовое окно, а поверх него могут действовать недельные ограничения. И там, где ждёшь таблицу с числом сообщений, стоят вилки - нижняя и верхняя граница отличаются в разы. Причина в следующем разделе.
Из чего складывается расход
Считаются не «запросы», а токены - куски текста, которые модель прочитала и написала. В счёт идёт всё:
- твой промпт;
- файлы и куски кода, которые агент открыл, чтобы разобраться;
- вся история разговора - она едет заново в каждый следующий ход;
- результаты команд и ответы подключённых MCP-серверов;
- ответ модели, включая её внутренние рассуждения.
Отсюда два неочевидных следствия. Первое: длинная сессия дорожает сама по себе, даже если ты пишешь всё те же три строчки - вместе с ними каждый раз уезжает разбухшая история. Второе: два внешне одинаковых вопроса могут стоить по-разному в разы, если на один агент прочитал два файла, а на другой обошёл полрепозитория.
Второй множитель - модель и уровень рассуждений. В меню выбора модели Codex сам вешает предупреждение на верхние уровни: они расходуют лимит быстрее. Формулировка в интерфейсе прямая - «Consumes usage limits faster».
Три места, где видно именно твоё значение
Шаг 1. /status - остаток прямо в сессии
Внутри запущенного Codex набери:
/status
Команда печатает карточку сессии: модель и провайдер, аккаунт, имя ветки разговора, расход токенов, заполнение контекста - и отдельным блоком Limits. Остаток в нём выглядит так:
Limits
<процент> left (resets <когда>)
Строка на каждое активное окно. Именно здесь видно, сколько осталось и когда обнулится. Внизу карточки Codex сам даёт ссылку на страницу расхода со словами, что там - актуальные данные по лимитам и кредитам.
Бывает, что вместо процентов Codex пишет, что данные могли устареть и стоит выполнить /status ещё раз чуть позже. Это нормально: остаток подтягивается с сервера, а не считается локально.
Шаг 2. /usage - расход по аккаунту и накопленные сбросы
/usage
Команда показывает недавний расход токенов по аккаунту и отдельно - доступные сбросы лимита. Принимает уточнение:
/usage daily
/usage weekly
/usage cumulative
Если ты вошёл по API-ключу, а не через ChatGPT, команда честно скажет, что для неё нужен вход в ChatGPT: на API-ключе никакого «остатка по плану» нет в принципе, там оплата по факту.
Шаг 3. Страница расхода в аккаунте
Третье место - страница расхода Codex в аккаунте ChatGPT. Она и есть источник правды: /status на неё ссылается прямым текстом, а докупить объём и посмотреть кредиты можно там же. Официальная рекомендация - заглядывать туда раз в неделю-две, чтобы понимать свой темп, а не узнавать о конце окна в момент упора.
Держать остаток перед глазами
Чтобы не дёргать /status каждые полчаса, вынеси остаток в строку состояния:
/statusline
Откроется список того, что можно туда положить. Про лимиты там есть отдельные пункты: usage-limit и secondary-usage-limit - основное и второе окно, а также daily-limit, weekly-limit, monthly-limit и annual-limit. Рядом живут пункты по контексту - сколько процентов окна разговора занято и сколько осталось. Выбираешь нужные, и остаток висит на экране постоянно.
Не дожидаясь этого, Codex предупредит сам. Когда окно почти выбрано, он печатает строку в духе «осталось меньше стольки-то процентов лимита, выполни /status для разбивки». Это ещё не стоп - это повод дописать текущее и не начинать тяжёлое.
Что видишь и что это значит
| Что видишь | Что это значит |
|---|---|
Heads up, you have less than N% of your ... limit left |
окно почти выбрано, но работа ещё идёт |
You've hit your usage limit. |
окно кончилось, нужен один из выходов ниже |
You've hit your usage limit for <модель> + предложение сменить модель |
кончилось по конкретной модели, другая ещё доступна |
limits may be stale - run /status again shortly |
остаток не успел подтянуться, повтори через минуту |
Sign in with ChatGPT to use /usage |
ты вошёл по API-ключу, у тебя оплата по факту |
API key configured в карточке /status |
то же самое: лимитов плана нет, есть счёт за токены |
сообщение про доступный сброс и предложение выполнить /usage |
у аккаунта накоплен сброс, его можно потратить |
Context N% left |
это не лимит тарифа, а окно разговора |
Последняя строка - главная путаница по теме. Разберём отдельно.
Контекст и лимит - разные вещи
Контекст - сколько текста помещается в один разговор. Кончается внутри сессии, лечится сжатием разговора или новым чатом. К тарифу отношения не имеет.
Лимит - сколько работы аккаунту доступно за окно времени. Новый чат его не возвращает: расход уже записан на аккаунт.
Признак простой: если Codex зовёт сжать разговор - это контекст. Если пишет про usage limit и время сброса - это тариф.
Что делать, когда упёрся
Шесть выходов, от бесплатного к платному:
- Дождаться сброса. Точное время печатает
/statusв блоке Limits - не «где-то завтра», а конкретный час. Короткое окно закрывается раньше длинного, так что смотреть надо на ближайшее. - Потратить накопленный сброс. Если Codex сообщал, что сброс доступен, выполни
/usageи используй его. Нет доступных - команда так и ответит. - Переключиться на модель полегче. Codex сам предлагает это в момент упора: часть моделей расходует лимит заметно медленнее. Меню - команда
/model. - Докупить объём. На личных планах ChatGPT это делается на странице расхода, не выходя на другой тариф.
- Перейти на API-ключ. Вход по ключу переводит Codex на оплату по факту - лимитов плана там нет, есть счёт за токены. Годится, чтобы дожать срочное.
- Попросить увеличение. На рабочем пространстве кнопка запроса встроена в само сообщение об упоре: Codex предлагает уведомить владельца.
И общее правило: если лимит кончился посреди хода, начатую работу Codex по возможности доводит до конца - в документации это описано прямо. Обрывать турн руками ради экономии смысла мало.
Шесть приёмов, от которых лимита хватает дольше
- Держи промпт коротким по делу. Не «расскажи всё про проект», а что именно поменять и в каком файле.
- Ограничивай материал. Дай агенту нужные файлы, а не «посмотри сам». Обход репозитория оплачивается токенами.
- Задавай формат ответа. Объём и вид результата - в задании. Иначе модель напишет вдвое больше, чем тебе нужно.
- Подрежь файл с правилами проекта. Он уезжает в каждый ход. Большой файл правил - это постоянный налог на каждое сообщение.
- Выключи лишние MCP-серверы. Каждый подключённый источник добавляет описания инструментов в каждое сообщение. Не нужен сейчас - отключи.
- Не гоняй всё на верхнем уровне рассуждений. Он для трудных задач; на рутине разница в результате мала, а расход выше - Codex об этом и предупреждает в меню.
Четыре ошибки, на которых спотыкаются
- Искать команду
/limits. Её нет. Остаток показывают/statusи/usage. - Ждать цифр от
codex doctor. Эта команда про установку, конфиг и здоровье окружения - расхода в её отчёте нет. - Путать контекст с тарифом. Сжатие разговора экономит токены, но не возвращает израсходованное окно.
- Верить чужой цифре из статьи. Лимиты меняются и зависят от плана. Единственная надёжная цифра - та, что печатает твой собственный
/status.
Что дальше
- Что такое Codex - если знакомство только начинается.
- Codex или Claude Code - чем инструменты отличаются на практике.
- Как оплатить доступ из России - разбор способов оплаты.
- Что такое MCP - те самые серверы, которые едят контекст в каждом ходе.
Всё, что я собрал по работе с агентами, лежит в ClaudeBase: база подключается к твоему агенту, и он берёт оттуда нужное сам - без пересказа статей руками.