Codex

Как расходуется лимит Codex: модели, рассуждения и инструменты

Почему короткий запрос расходует много лимита Codex? Разберитесь в роли модели, рассуждений, кеша и субагентов, отличая квоту подписки от кредитов и контекста.

Одно сообщение Codex может запускать несколько обращений к модели и инструментам. Оценивайте всю работу до завершения задачи, а не число введённых сообщений. Если следующую задачу уже нельзя начать, сначала откройте инструкцию при исчерпании лимита.

Какой показатель вы сравниваете

  • Квота подписки: остаток в пятичасовом или недельном окне аккаунта. ChatGPT Work и Codex используют общую квоту.
  • Кредиты: единица оплаты дополнительного использования для подходящих тарифов. Одних кредитных ставок недостаточно, чтобы вычислить процент списания включённой квоты.
  • Контекст: информация, которую модель обрабатывает в разговоре. Его заполнение не показывает остаток подписки.
  • Оплата API: отдельная оплата по использованию при входе с API-ключом.

Основания: официальные цены, способы входа и команда статуса. Оценки по тарифам и ставки собраны на странице Codex.

Что влияет на расход

Модель и глубина рассуждений

Для небольшой правки может подойти компактная модель, а для сложной ошибки с неизвестной причиной — более глубокие рассуждения. Документация по субагентам связывает повышение глубины рассуждений с ростом расхода токенов, но не задаёт фиксированный процент квоты на сообщение. Перед сравнением проверьте выбранную модель и настройки.

Файлы, результаты инструментов и поиск

Файлы и результаты команд тоже становятся информацией для модели. Короткий запрос, запускающий поиск по репозиторию, чтение логов и повторные проверки, может потребовать больше работы, чем длинный вопрос со всеми исходными данными. Проверьте границы поиска и объём полезного вывода. В документации тарифов нет универсального фиксированного списания за одну команду или один веб-поиск.

Кешированный ввод

Кредитные ставки различают обычный и кешированный ввод. Кеш не означает бесплатность; повторное чтение файла не доказывает попадание в кеш. В кредитной оплате Codex нет отдельной платы за запись кеша, а API-ключ подчиняется ценам API. Скидку API нельзя превращать в гарантированный процент экономии квоты подписки.

Субагенты

Каждый субагент выполняет собственные обращения к модели и инструментам. Параллельность может сократить ожидание, увеличив общий расход токенов. Сравнивайте задачу целиком, включая координацию основным агентом. Три агента не означают ни строго тройной расход квоты, ни гарантированную экономию.

Режим Fast

На поддерживаемых моделях Fast повышает скорость за счёт большего расхода кредитов. В CLI проверьте /fast status; если достаточно Standard, используйте /fast off. Описание скорости отделяет множители кредитов ChatGPT от цен API.

Два примера, а не измеренная экономия

Для опечатки в известном файле можно запросить только исправление и проверку diff. Исследование всего репозитория или параллельное ревью могут добавить ненужную работу.

Для ошибки на стыке авторизации, хранения и интерфейса независимое исследование может быть полезно. Задайте границы агентам, объедините результаты и проверьте исправление. Выигрыш во времени может оправдывать больший расход, но не доказывает его снижение.

Как исследовать неожиданный расход

До и после одной ограниченной задачи запишите аккаунт, рабочую область, модель, скорость и показания лимитов. Проверьте параллельную работу в Codex и ChatGPT Work, повторное чтение, повторные попытки и субагентов. Меняйте один фактор за раз. Это способ диагностики, а не контролируемый эксперимент или формула будущего расхода.

Если лимит исчерпан, всё равно нужно дождаться времени сброса аккаунта либо использовать доступный платный вариант. Сокращение будущей работы не возвращает уже потраченную квоту.

Codex · История сбросов и личный таймер