메시지 수는 토큰 소비의 정확한 비교 기준이 되기 어렵습니다. “이 오류를 고쳐 줘”라는 요청이 한 줄 수정으로 끝날 수도 있고, 광범위한 저장소 탐색, 여러 차례의 디버깅, 대량 출력으로 이어질 수도 있습니다. OpenAI 요금 및 사용량 안내는 모델, 컨텍스트 크기, 추론 토큰, 도구 호출, 코드 검색, 캐시가 모두 소비에 영향을 준다고 설명합니다. 입력한 프롬프트는 시작점일 뿐입니다.
작업 기록에서 피할 수 있는 작업 찾기
최근 Codex 한도에 도달했던 작업을 돌아보세요. 같은 대용량 파일을 반복해서 읽었나요? 셸 명령이 로그 전체를 프롬프트로 출력했나요? 작업 도중 범위가 늘어났나요? 이런 패턴을 살피면 불필요한 작업을 찾을 수 있습니다.
“로그인 오류를 고치고 코드베이스를 현대화해 줘” 같은 지시는 경계가 명확하지 않습니다. 대신 구체적인 목표를 지정하세요.
- 빈 로그인 양식 제출 시 충돌을 재현하고 조건을 분리한다.
- 해당 핸들러를 수정하고 단위 테스트를 실행한다.
- 발견한 다른 문제는 보고하되 요청하지 않은 수정은 하지 않는다.
명확한 목표와 종료 기준은 무관한 작업을 줄이는 데 도움이 되지만 일정한 사용량 절감을 보장하지 않습니다.
추론 강도, 병렬 하위 에이전트, Fast 모드
하위 에이전트 문서는 독립적인 모델 및 도구 호출을 설명합니다. 추론 강도를 높여도 토큰 사용량이 늘어납니다. 병렬 작업은 대기 시간을 줄일 수 있지만 에이전트 수로 고정 한도 배수나 절감률을 계산할 수는 없습니다.
작은 문서 수정 같은 일상 작업에는 보통 최대 추론이나 여러 하위 에이전트가 필요하지 않습니다. 어려운 근본 원인 진단에 높은 추론을 쓰고, 하위 에이전트에는 구분된 디렉터리 범위를 지정하세요.
Fast 모드도 확인하세요. OpenAI 속도 문서에 따르면 Fast 모드는 지연을 줄이는 대신 더 많은 크레딧을 사용합니다. CLI에서는 /fast status로 확인할 수 있습니다. 촉박한 마감에는 활용하되 일반 속도로 충분하면 끄세요.
한도 도달 후: 초기화를 기다리거나 크레딧 추가
소소한 마무리만 남았다면 변경 사항을 저장하고 미완료 작업을 기록한 뒤 예정된 Codex 초기화를 기다리세요. 마감이 촉박하면 꼭 필요한 최소한의 다음 단계를 정한 뒤 대시보드에서 추가 크레딧을 검토하세요. 공식 요금 안내는 기본 한도를 넘어 사용 가능한 크레딧을 설명합니다.
API 키로 바꾸는 것은 다른 결제 경로를 쓰는 것이지 구독 한도의 초기화 버튼이 아닙니다. 인증 문서는 API 사용량이 종량제로 청구된다고 설명합니다. 새 스레드를 시작하거나 모델 체크포인트를 변경해도 소진한 Codex 한도는 초기화되지 않습니다.