Codex 메시지 하나가 여러 모델 호출과 도구 작업으로 이어질 수 있습니다. 입력한 메시지 수보다 작업을 끝내는 데 필요한 전체 과정을 보세요. 다음 작업을 시작할 수 없다면 한도 도달 시 해결 방법을 먼저 확인하세요.
어떤 사용량인지 먼저 구분하기
- 구독 한도: 계정에 표시된 5시간 또는 주간 잔여량입니다. ChatGPT Work와 Codex는 사용량을 공유합니다.
- 크레딧: 조건에 맞는 추가 유료 사용의 결제 단위입니다. 공개 크레딧 요금만으로 구독 한도의 차감률을 계산할 수 없습니다.
- 컨텍스트: 대화에서 모델이 처리할 수 있는 정보입니다. 컨텍스트 표시가 구독 잔여량은 아닙니다.
- API 과금: API 키로 로그인할 때 적용되는 별도의 종량제입니다.
근거는 공식 가격 설명, 인증 방식, 상태 명령입니다. 현재 요금제별 추정치와 요율은 Codex 페이지에 정리했습니다.
어떤 선택이 사용량을 바꾸나요?
모델과 추론
범위가 명확한 작은 수정에는 작은 모델을, 원인이 모호한 복잡한 오류에는 더 깊은 추론을 고려할 수 있습니다. 공식 하위 에이전트 설명은 추론 강도가 높으면 토큰 사용량이 늘어난다고 설명합니다. 그렇다고 메시지당 고정 차감률을 알 수 있는 것은 아닙니다. 비교 전에 실제 모델과 추론 설정을 확인하세요.
파일, 도구 결과와 검색
파일과 도구 결과도 모델이 처리하는 정보입니다. 짧은 요청이 저장소 검색, 로그 읽기, 반복 테스트로 이어지면 필요한 정보가 갖춰진 긴 질문보다 많은 작업이 발생할 수 있습니다. 검색 범위와 출력에서 관련 내용만 다루는지 확인하세요. 구독 문서에는 명령 한 번이나 웹 검색 한 번에 적용되는 공통 고정 차감 공식이 없습니다.
캐시 입력
크레딧 요율은 일반 입력과 캐시 입력을 구분합니다. 캐시가 무료라는 뜻은 아니며, 같은 파일을 다시 읽었다고 캐시 적중을 확인할 수도 없습니다. Codex 크레딧 과금에는 별도의 캐시 쓰기 요금이 없지만 API 키는 API 가격을 따릅니다. API 캐시 할인을 구독 한도의 보장된 절약률로 바꾸면 안 됩니다.
하위 에이전트
각 하위 에이전트는 자체 모델 호출과 도구 작업을 수행합니다. 병렬 실행은 대기 시간을 줄이면서 전체 토큰 사용량을 늘릴 수 있습니다. 주 에이전트의 조정 작업까지 포함해 완료된 작업 전체를 비교하세요. 에이전트가 셋이라고 반드시 한도가 세 배로 차감되거나 더 절약되는 것은 아닙니다.
Fast 모드
지원 모델에서 Fast는 더 많은 크레딧을 사용해 속도를 높입니다. CLI에서 /fast status를 확인하고 Standard로 충분하면 /fast off를 사용하세요. 속도 설명은 ChatGPT 크레딧 배율과 API 요금을 구분합니다.
두 가지 예시: 절약량을 측정한 결과는 아닙니다
위치를 아는 파일의 오타는 해당 부분 수정과 변경 내용 확인만 요청할 수 있습니다. 저장소 전체 조사나 병렬 검토는 이 작업에 불필요한 일을 늘릴 수 있습니다.
인증, 저장, UI에 걸친 오류는 역할을 나눈 조사가 유용할 수 있습니다. 담당 범위를 정하고 결과를 모아 수정 사항을 검증하세요. 더 빨리 끝내기 위해 추가 사용량을 감수할 수 있지만, 그것이 총사용량 감소를 증명하지는 않습니다.
예상보다 한도가 많이 줄었다면
범위가 명확한 작업 전후에 계정, 워크스페이스, 모델, 속도, 표시 한도를 기록하세요. 동시에 진행된 Codex와 ChatGPT Work 작업을 확인하고 반복 읽기, 재시도, 하위 에이전트 작업을 살펴봅니다. 한 번에 한 요소만 바꾸세요. 이는 문제 조사 방법이며 통제된 실험이나 향후 차감 공식이 아닙니다.
이미 소진된 한도는 계정의 초기화 시각을 기다리거나 가능한 추가 이용 방법을 사용해야 합니다. 이후 작업을 줄여도 이미 쓴 한도가 반환되지는 않습니다.