Сообщения за период, фоновые задачи параллельно, размер репозитория и время выполнения — вот из чего складываются Codex лимиты; конкретные значения OpenAI пересматривает, и актуальные цифры команда берёт из документации. Для группы разработчиков лимит становится общим ресурсом: несколько активных коллег способны выбрать квоту раньше срока и оставить остальных в очереди. Поэтому порядок распределения квоты внутри команды решает больше, чем сам тариф.

Какие лимиты встречаются

TL;DR

Лимиты Codex ложатся на четыре вещи: сообщения в диалоге, фоновые задачи параллельно, размер репозитория и время выполнения задачи — конкретные значения OpenAI пересматривает, их смотрят в документации вендора.

Первое ограничение — сообщения: за период агент принимает ограниченное число обращений, и длинная итеративная правка съедает квоту быстрее, чем одна хорошо поставленная задача. Второе — фоновые задачи: параллельно агент ведёт ограниченное их количество, остальные встают в очередь.

Третье ограничение — размер репозитория и контекста: агент работает с копией проекта, и на монорепозитории с сотнями тысяч файлов задача упирается в рамки раньше, чем на компактном сервисе. Четвёртое — время выполнения: задача, которая тянется слишком долго, прерывается, и работу приходится ставить заново меньшими кусками.

Важно понимать и период сброса: лимиты считаются за окно, и дата обновления квоты становится точкой планирования. Тяжёлые задачи разумно ставить в начале окна, когда запас полный, а к концу периода переходить на задачи поменьше. Конкретная длина окна и потолки зависят от тарифа — их смотрят в кабинете и документации OpenAI, потому что вендор пересматривает условия.

  • Сообщения за период — расход растёт от итеративных уточнений.
  • Фоновые задачи параллельно — очередь для лишних.
  • Размер репозитория и контекст — рамки для монорепозиториев.
  • Время выполнения — граница для тяжёлых задач.

Квота на команду

Общая механика планирования нагрузки под ограничения разобрана в статье про лимиты Qwen — здесь разберём то, чего там нет: как делить квоту между людьми. На практике работают четыре приёма, и их комбинируют под ритм команды.

ПриёмКак работаетКому подходит
Календарь тяжёлых задачБольшие задачи агенту ставят по расписанию, мелкие — в любое времяКоманды с предсказуемым ритмом релизов
Роли по типу работРевью и тесты уходят агенту, архитектурные решения — людямКоманды с явным техлидом
Окна по людямУ каждого разработчика своё время интенсивной работы с агентомРаспределённые команды по часовым поясам
Локальные инструменты для мелочейФорматирование и мелкие правки идут мимо агентаВсе команды без исключения

Приём с локальными инструментами недооценивают чаще всего: форматтер, линтер и шаблонные сниппеты закрывают треть мелких обращений к агенту, по нашему опыту внедрений в командах разработки. Квота, которая уходила на косметику, остаётся на задачи, где агент действительно нужен.

Представьте отдел из пяти разработчиков с общей квотой: двое гоняют агента по мелочам целый день, трое к вечеру видят очередь. Стоит ввести окна — утро у тех, кто режет релиз, вторая половина дня у остальных, — и конфликт исчезает без докупки тарифа. Механика здесь социальная, а само число в тарифе остаётся тем же.

Задачи под квоту

Разбивка экономит квоту лучше любого расписания. Задача «перепиши модуль» съедает сообщения на уточнения, а та же работа кусками — «добавь обработку ошибок в слой доступа к данным и покрой тестами» — укладывается в один заход. Устройство агента и формат постановки задач мы разобрали в статье про Codex в ChatGPT для команды разработки.

Очередь задач тоже планируют. Сначала агенту уходят задачи с понятным критерием приёмки — тесты, миграции схем, обновление зависимостей, — а исследовательские задачи, где число итераций заранее неизвестно, ставят в конец периода, когда остаток квоты ясен. Так конец месяца перестаёт превращаться в лотерею.

Помогает и заготовка контекста заранее. Когда в задаче сразу указаны каталоги, файлы-примеры и команда для запуска тестов, агент тратит ходы на работу, а на разведку уходит минимум. Шаблон постановки хранится прямо в трекере: исполнитель заполняет три поля, и вероятность уложиться в один заход заметно растёт.

Сюда же относится привычка держать под рукой библиотеку удачных постановок. Задача, которая однажды уложилась в один заход, сохраняется как образец: следующая похожая постановка собирается по ней за минуту, и команда тратит сообщения на работу, а на формулировку уходит минимум.

Когда квота кончилась

  1. Зафиксируйте, что именно съело квоту: итерации уточнений, параллельные фоновые задачи или одна тяжёлая задача на большом репозитории.
  2. Перенесите срочное вручную: правка, которую ждут сегодня, делается руками быстрее, чем ожидание сброса периода.
  3. Разбейте незавершённую задачу на куски и поставьте их заново после сброса — контекст прежней сессии сохраните в описании.
  4. Пересмотрите приоритеты очереди: задачи без чёткого критерия приёмки уходят в ручную разработку.

Терминальный вариант агента — Codex CLI — работает по своим правилам и тоже упирается в ограничения аккаунта, поэтому запасным баком его считать нельзя. Если упор в лимит повторяется каждый период, это сигнал пересмотреть тариф или саму постановку задач.

● Discovery · 1 час · бесплатно

Как ваша команда делит квоту Codex сегодня?

Прийти на Discovery →

Правила для команды

Порядок, который снимает большинство конфликтов за квоту, умещается в пять строк: кто ставит тяжёлые задачи, когда именно, как выглядит готовая постановка, что уходит агенту в последнюю очередь и кто следит за расходом за период. Назначьте владельца квоты — обычно техлида, — который раз в неделю смотрит расход и перетасовывает очередь.

Граница ответственности при этом остаётся прежней: агент пишет код, человек принимает решение. Код от агента проходит то же ревью, что и код джуниор-разработчика, а задачи с доступом к секретам и продуктивным данным поручают только с заранее записанными правилами.

Полезно держать под рукой и метрику здоровья процесса: доля задач, уложившихся в один заход, и число перенесённых вручную правок в конце периода. Первая растёт по мере того, как команда учится ставить задачи, вторая падает — и это верный знак, что распределение работает.

Если хочется выстроить такой порядок с нуля — постановку задач, очередь, ревью и метрики расхода, — это типовой запрос на консалтинг по внедрению ИИ: разбираем процесс команды и собираем правила под него.

// с чего начать

Начните с журнала: неделю записывайте, какие задачи ушли агенту и во сколько сообщений каждая обошлась. Через неделю видно, кто выбирает квоту и на чём, и правила пишутся под факты, без догадок.

Частые вопросы

Какие лимиты есть у Codex?
Четыре группы: сообщения за период, фоновые задачи параллельно, размер репозитория и контекста, время выполнения задачи. Конкретные значения зависят от тарифа и пересматриваются OpenAI — актуальные цифры смотрите в документации вендора и на странице тарифа.
Как распределить лимиты Codex между разработчиками?
Назначьте владельца квоты, введите календарь тяжёлых задач и окна интенсивной работы, мелкие правки переведите на локальные инструменты. Раз в неделю смотрите расход по людям и перетасовывайте очередь: исследовательские задачи — в конец периода.
Что делать, если Codex упёрся в лимит?
Срочные правки делайте руками, незавершённую задачу разбейте на куски и поставьте заново после сброса периода, контекст сохраните в описании. Повторяющийся упор в лимит — повод пересмотреть тариф или постановку задач.
Лимиты Codex и Codex CLI одинаковые?
Правила различаются: терминальный агент работает через свой канал доступа, но ограничения аккаунта и тарифа действуют и там. Точные рамки для вашего тарифа смотрите в документации OpenAI — переносить лимиты одной формы на другую нельзя.
Влияет ли размер репозитория на работу Codex?
Да: агент работает с копией проекта, и на монорепозитории задача упирается в рамки контекста и времени раньше, чем на компактном сервисе. Помогает разбивка задач по модулям и явное указание каталогов, с которыми работать.