Инструменты8 минобновлено Максим Самусь

Codex лимиты: где посмотреть свои

Вся система, из которой эти статьи, лежит в ClaudeBase - 990 ₽ в месяц. Файлы устанавливаются в проект по инструкции.

Что понадобится

  • Установленный Codex CLI. Версия проверяется командой codex --version - у меня отвечает codex-cli 0.152.1.
  • Вход в аккаунт. Проверяется командой codex login status - ответ вида Logged in using ChatGPT.
  • Браузер - для страницы расхода в аккаунте ChatGPT.

Про сам инструмент - в словаре. Сравнение с соседом по цеху - Codex или Claude Code.

Главное: лимит - это не одно число

Люди ищут «сколько запросов даёт Codex» и ждут цифру. Цифры нет, и это не отговорка - так устроено внутри.

Расход в Codex описан окном из трёх величин: сколько процентов окна уже израсходовано, какой длины окно и когда оно обнулится. Эти три поля лежат в самом CLI, а значения к ним приезжают с сервера под конкретный аккаунт. То есть в программе зашита форма ответа, а не сам ответ.

Окно не одно. В настройках строки состояния Codex перечисляет их списком: основное окно, оно же пятичасовое, и второе - а рядом дневное, недельное, месячное и годовое. Какие включены именно у тебя, зависит от плана; те, по которым данных нет, Codex просто не показывает.

Официальная страница тарифов OpenAI (смотрел 03.09.2026) говорит то же самое другими словами: на планах ChatGPT локальные сообщения и облачные задачи делят одно пятичасовое окно, а поверх него могут действовать недельные ограничения. И там, где ждёшь таблицу с числом сообщений, стоят вилки - нижняя и верхняя граница отличаются в разы. Причина в следующем разделе.

Из чего складывается расход

Считаются не «запросы», а токены - куски текста, которые модель прочитала и написала. В счёт идёт всё:

  • твой промпт;
  • файлы и куски кода, которые агент открыл, чтобы разобраться;
  • вся история разговора - она едет заново в каждый следующий ход;
  • результаты команд и ответы подключённых MCP-серверов;
  • ответ модели, включая её внутренние рассуждения.

Отсюда два неочевидных следствия. Первое: длинная сессия дорожает сама по себе, даже если ты пишешь всё те же три строчки - вместе с ними каждый раз уезжает разбухшая история. Второе: два внешне одинаковых вопроса могут стоить по-разному в разы, если на один агент прочитал два файла, а на другой обошёл полрепозитория.

Второй множитель - модель и уровень рассуждений. В меню выбора модели Codex сам вешает предупреждение на верхние уровни: они расходуют лимит быстрее. Формулировка в интерфейсе прямая - «Consumes usage limits faster».

Три места, где видно именно твоё значение

Шаг 1. /status - остаток прямо в сессии

Внутри запущенного Codex набери:

/status

Команда печатает карточку сессии: модель и провайдер, аккаунт, имя ветки разговора, расход токенов, заполнение контекста - и отдельным блоком Limits. Остаток в нём выглядит так:

Limits
  <процент> left (resets <когда>)

Строка на каждое активное окно. Именно здесь видно, сколько осталось и когда обнулится. Внизу карточки Codex сам даёт ссылку на страницу расхода со словами, что там - актуальные данные по лимитам и кредитам.

Бывает, что вместо процентов Codex пишет, что данные могли устареть и стоит выполнить /status ещё раз чуть позже. Это нормально: остаток подтягивается с сервера, а не считается локально.

Шаг 2. /usage - расход по аккаунту и накопленные сбросы

/usage

Команда показывает недавний расход токенов по аккаунту и отдельно - доступные сбросы лимита. Принимает уточнение:

/usage daily
/usage weekly
/usage cumulative

Если ты вошёл по API-ключу, а не через ChatGPT, команда честно скажет, что для неё нужен вход в ChatGPT: на API-ключе никакого «остатка по плану» нет в принципе, там оплата по факту.

Шаг 3. Страница расхода в аккаунте

Третье место - страница расхода Codex в аккаунте ChatGPT. Она и есть источник правды: /status на неё ссылается прямым текстом, а докупить объём и посмотреть кредиты можно там же. Официальная рекомендация - заглядывать туда раз в неделю-две, чтобы понимать свой темп, а не узнавать о конце окна в момент упора.

Держать остаток перед глазами

Чтобы не дёргать /status каждые полчаса, вынеси остаток в строку состояния:

/statusline

Откроется список того, что можно туда положить. Про лимиты там есть отдельные пункты: usage-limit и secondary-usage-limit - основное и второе окно, а также daily-limit, weekly-limit, monthly-limit и annual-limit. Рядом живут пункты по контексту - сколько процентов окна разговора занято и сколько осталось. Выбираешь нужные, и остаток висит на экране постоянно.

Не дожидаясь этого, Codex предупредит сам. Когда окно почти выбрано, он печатает строку в духе «осталось меньше стольки-то процентов лимита, выполни /status для разбивки». Это ещё не стоп - это повод дописать текущее и не начинать тяжёлое.

Что видишь и что это значит

Что видишь Что это значит
Heads up, you have less than N% of your ... limit left окно почти выбрано, но работа ещё идёт
You've hit your usage limit. окно кончилось, нужен один из выходов ниже
You've hit your usage limit for <модель> + предложение сменить модель кончилось по конкретной модели, другая ещё доступна
limits may be stale - run /status again shortly остаток не успел подтянуться, повтори через минуту
Sign in with ChatGPT to use /usage ты вошёл по API-ключу, у тебя оплата по факту
API key configured в карточке /status то же самое: лимитов плана нет, есть счёт за токены
сообщение про доступный сброс и предложение выполнить /usage у аккаунта накоплен сброс, его можно потратить
Context N% left это не лимит тарифа, а окно разговора

Последняя строка - главная путаница по теме. Разберём отдельно.

Контекст и лимит - разные вещи

Контекст - сколько текста помещается в один разговор. Кончается внутри сессии, лечится сжатием разговора или новым чатом. К тарифу отношения не имеет.

Лимит - сколько работы аккаунту доступно за окно времени. Новый чат его не возвращает: расход уже записан на аккаунт.

Признак простой: если Codex зовёт сжать разговор - это контекст. Если пишет про usage limit и время сброса - это тариф.

Что делать, когда упёрся

Шесть выходов, от бесплатного к платному:

  1. Дождаться сброса. Точное время печатает /status в блоке Limits - не «где-то завтра», а конкретный час. Короткое окно закрывается раньше длинного, так что смотреть надо на ближайшее.
  2. Потратить накопленный сброс. Если Codex сообщал, что сброс доступен, выполни /usage и используй его. Нет доступных - команда так и ответит.
  3. Переключиться на модель полегче. Codex сам предлагает это в момент упора: часть моделей расходует лимит заметно медленнее. Меню - команда /model.
  4. Докупить объём. На личных планах ChatGPT это делается на странице расхода, не выходя на другой тариф.
  5. Перейти на API-ключ. Вход по ключу переводит Codex на оплату по факту - лимитов плана там нет, есть счёт за токены. Годится, чтобы дожать срочное.
  6. Попросить увеличение. На рабочем пространстве кнопка запроса встроена в само сообщение об упоре: Codex предлагает уведомить владельца.

И общее правило: если лимит кончился посреди хода, начатую работу Codex по возможности доводит до конца - в документации это описано прямо. Обрывать турн руками ради экономии смысла мало.

Шесть приёмов, от которых лимита хватает дольше

  1. Держи промпт коротким по делу. Не «расскажи всё про проект», а что именно поменять и в каком файле.
  2. Ограничивай материал. Дай агенту нужные файлы, а не «посмотри сам». Обход репозитория оплачивается токенами.
  3. Задавай формат ответа. Объём и вид результата - в задании. Иначе модель напишет вдвое больше, чем тебе нужно.
  4. Подрежь файл с правилами проекта. Он уезжает в каждый ход. Большой файл правил - это постоянный налог на каждое сообщение.
  5. Выключи лишние MCP-серверы. Каждый подключённый источник добавляет описания инструментов в каждое сообщение. Не нужен сейчас - отключи.
  6. Не гоняй всё на верхнем уровне рассуждений. Он для трудных задач; на рутине разница в результате мала, а расход выше - Codex об этом и предупреждает в меню.

Четыре ошибки, на которых спотыкаются

  1. Искать команду /limits. Её нет. Остаток показывают /status и /usage.
  2. Ждать цифр от codex doctor. Эта команда про установку, конфиг и здоровье окружения - расхода в её отчёте нет.
  3. Путать контекст с тарифом. Сжатие разговора экономит токены, но не возвращает израсходованное окно.
  4. Верить чужой цифре из статьи. Лимиты меняются и зависят от плана. Единственная надёжная цифра - та, что печатает твой собственный /status.

Что дальше

Всё, что я собрал по работе с агентами, лежит в ClaudeBase: база подключается к твоему агенту, и он берёт оттуда нужное сам - без пересказа статей руками.

Спрашивают

Пять вопросов по теме

Почему в Codex нет одной цифры лимита?

Потому что лимит - это не число запросов, а окно с процентом расхода и временем сброса, и стоимость хода зависит от модели, длины истории, уровня рассуждений и подключённых инструментов. Даже в официальной таблице стоят вилки, а не числа.

Команда /limits не работает, в чём дело?

Такой команды в Codex нет. Остаток показывают две другие - /status печатает блок Limits с процентом и временем сброса, /usage показывает расход по аккаунту и накопленные сбросы.

Чем окно контекста отличается от лимита тарифа?

Это разные вещи, которые легко перепутать. Контекст - сколько влезает в один разговор, он кончается внутри сессии и лечится сжатием или новым чатом. Лимит тарифа - сколько работы доступно за окно времени, и новый чат его не возвращает.

Что такое сброс лимита и откуда он берётся?

Это одноразовое обнуление расхода, которое иногда начисляется аккаунту. Codex сам сообщает, что сброс доступен, и предлагает выполнить /usage, чтобы его потратить. Если сбросов нет, команда честно отвечает, что доступных нет.

Помогает ли начать новый чат вместо продолжения старого?

Помогает, но не как обнуление лимита, а как экономия. В каждый следующий ход едет вся история разговора, поэтому длинная сессия дорожает сама по себе. Новая задача с чистого чата обходится дешевле продолжения старого.

Источники

Максим Самусь · проверено на своих проектах