Codex への一つのメッセージから、複数回のモデル処理やツール操作が始まることがあります。入力したメッセージ数ではなく、タスク完了までの作業を見てください。次の作業を開始できない場合は、上限到達時の対処を先に確認してください。
何の使用量を見ているか
- 契約に含まれる枠:アカウントに表示される 5 時間枠や週次枠の残量。ChatGPT Work と Codex は使用量を共有します。
- クレジット:対象となる追加利用の支払い単位。公開クレジット単価だけで、契約枠の消費率は算出できません。
- コンテキスト:会話中にモデルが扱う情報。使用状況の表示は契約枠の残量ではありません。
- API 課金:API キーでログインする場合の別の従量課金です。
公式料金説明、認証方式、ステータスコマンドが根拠です。プラン別の目安と単価は Codex ページにまとめています。
消費に影響する選択
モデルと推論
範囲の狭い修正には小さいモデル、原因不明の複雑な不具合には強い推論が適する場合があります。公式のサブエージェント説明では、推論強度を上げるとトークン使用量が増えるとしています。ただし、1 メッセージ当たりの固定消費率は導けません。比較前に実際のモデルと推論設定を確認してください。
ファイル・ツール結果・検索
ファイルやツール結果もモデルの処理対象です。短い指示でリポジトリ検索、ログ読み取り、修正の再テストを繰り返せば、必要な情報が揃った長い質問より作業が増える場合があります。検索範囲と出力を確認しましょう。契約枠の説明には、コマンド 1 回や Web 検索 1 回に対する共通の固定消費式はありません。
キャッシュ入力
クレジット単価は通常入力とキャッシュ入力を区別します。キャッシュは無料ではなく、同じファイルの再読だけでヒットしたとも判断できません。Codex のクレジット課金には独立したキャッシュ書き込み料金はありませんが、API キーは API 料金に従います。API の割引率を契約枠の節約率に置き換えないでください。
サブエージェント
各エージェントは独自のモデル処理とツール作業を行います。並列化は待ち時間を短くしつつ、総トークン使用量を増やすことがあります。主エージェントの調整も含むタスク全体で比較してください。3 エージェントだから枠の消費が必ず 3 倍、または必ず節約になるわけではありません。
Fast モード
対象モデルの Fast は、クレジット消費を増やして速度を上げます。CLI の /fast status で確認し、Standard で十分なら /fast off を使います。速度の説明は ChatGPT のクレジット倍率と API 料金を区別しています。
二つの例:節約量の実測ではありません
既知のファイルの誤字修正なら、その箇所の編集と差分確認を依頼できます。全体調査や並列レビューは不要な作業を増やす可能性があります。
認証、保存処理、UI にまたがる不具合なら、役割を分けた調査が役立つ場合があります。担当範囲を決め、結果を統合して修正を検証します。早く終わる価値が追加消費を上回る場合でも、総使用量が少ない証拠にはなりません。
予想外の減少を調べる手順
範囲を絞ったタスクの前後で、アカウント、ワークスペース、モデル、速度、残量を記録します。同時進行の Codex や ChatGPT Work、繰り返し読み取り、再試行、サブエージェントも確認し、一度に一要素だけ変えます。これは原因を探す手順であり、厳密な比較実験や将来の消費式ではありません。
枠を使い切った場合は、アカウントのリセット時刻か対象の継続手段が必要です。次の作業を減らしても、既に使った枠は戻りません。