Codex

Codex 用量怎麼算:模型、推理、工具與子 Agent

為什麼幾句提示就消耗大量 Codex 額度?分清方案額度、點數與上下文,理解模型、推理、工具輸出、快取和子 Agent 的影響。

一則 Codex 訊息可能啟動多輪模型推理與工具操作。應看完成整項任務所需的工作,而不只看自己發了幾句話。本文解釋用量機制;如果已經無法開始下一項任務,先看額度耗盡後的處理步驟

先分清正在看哪種用量

  • 方案額度:帳戶顯示的五小時或每週窗口剩餘額度。ChatGPT Work 與 Codex 共用用量。
  • 點數:符合條件的額外付費用量單位。公開點數費率不能單獨換算成方案額度扣除百分比。
  • 上下文:模型在對話中可處理的資訊。上下文占用不是訂閱餘額。
  • API 計費:使用 API Key 登入時,走獨立的按量付費管道。

依據見官方定價說明驗證方式狀態指令。目前方案估計值與費率集中在 Codex 平台頁

哪些選擇影響消耗?

模型與推理強度

範圍明確的小修改可以考慮較小模型,原因不明的複雜故障可能需要更強推理。官方子 Agent 與推理說明確認,更高推理強度會增加 Token 使用,但不能據此得出每則訊息固定扣多少百分比。比較任務前先確認實際模型和推理等級。

檔案、工具輸出與搜尋

檔案與工具結果會成為模型需要處理的資訊。一句提示若觸發全專案搜尋、日誌讀取和反覆測試,實際工作量可能超過一段資訊完整的長問題。檢查搜尋範圍和輸出是否只保留相關內容。方案文件沒有提供通用的「執行一次指令」或「搜尋一次網頁」固定扣額公式。

快取輸入

點數費率表區分一般輸入與快取輸入。快取不等於免費,再次讀取同一檔案也不能證明快取命中。Codex 點數計費沒有獨立的快取寫入費用;API Key 則遵循 API 定價。不能把 API 快取折扣當作訂閱額度必然節省的比例。

子 Agent

每個子 Agent 都會進行自己的模型與工具工作。並行可以縮短等待,同時增加總 Token 消耗。比較時應計入主 Agent 的協調和完整任務結果;三個 Agent 不代表必定扣三倍額度,也不保證更省。

Fast 模式

Fast 在支援的模型上以更高點數消耗換取速度。CLI 可用 /fast status 查看,標準速度足夠時用 /fast off 關閉。官方速度說明區分 ChatGPT 點數倍率與 API 定價,不能相互套用。

兩個任務例子,不是節省實測

已知檔案裡的一處錯字,可以明確要求只修改該處並檢查差異。全專案調查或並行審查會增加這項任務未必需要的工作。

跨驗證、儲存和介面的故障,則可能適合分頭調查。給各 Agent 明確邊界,彙整結果後驗證修復。更快完成任務可能值得額外消耗,但不證明總用量更低。

額度突然下降時怎麼查

在一項範圍明確的任務前後,記錄帳戶、工作區、模型、速度及面板額度。檢查是否同時執行其他 Codex 或 ChatGPT Work 任務,再查看重複讀取、重試與子 Agent 工作。每次只調整一個因素。這是排查方法,不是嚴格對照實驗,也不是未來扣額公式。

已經耗盡的額度仍需等待帳戶顯示的重置時間,或採用符合條件的繼續方式;減少後續工作不會退還已用額度。

Codex · 重置歷史與個人倒數計時