一条 Codex 消息可能启动多轮模型推理与工具操作。应看完成整个任务所需的工作,而不只看自己发了几句话。本文解释用量机制;如果已经无法开始下一项任务,先看额度耗尽后的处理步骤。
先分清正在看哪种用量
- 套餐额度:账户显示的五小时或周窗口剩余额度。ChatGPT Work 与 Codex 共享用量。
- 积分:符合条件的额外付费用量单位。公开积分费率不能单独换算成套餐额度扣除百分比。
- 上下文:模型在会话中可处理的信息。上下文占用不是订阅余额。
- API 计费:使用 API Key 登录时,走独立的按量付费渠道。
依据见官方定价说明、认证方式与状态命令。当前套餐估计值与费率集中在 Codex 平台页。
哪些选择影响消耗?
模型与推理强度
范围明确的小修改可以考虑较小模型,原因不明的复杂故障可能需要更强推理。官方子 Agent 与推理说明确认,更高推理强度会增加 Token 使用,但不能据此得出每条消息固定扣多少百分比。比较任务前先确认实际模型和推理档位。
文件、工具输出与搜索
文件与工具结果会成为模型需要处理的信息。一句提示若触发全库搜索、日志读取和反复测试,实际工作量可能超过一段完整自包含的长问题。检查搜索范围和输出是否只保留相关内容。套餐文档没有给出通用的“执行一次命令”或“搜索一次网页”固定扣额公式。
缓存输入
积分费率表区分普通输入与缓存输入。缓存不等于免费,再次读取同一文件也不能证明缓存命中。Codex 积分计费没有独立的缓存写入费用;API Key 则遵循 API 定价。不能把 API 缓存折扣当作订阅额度必然节省的比例。
子 Agent
每个子 Agent 都会进行自己的模型与工具工作。并行可以缩短等待,同时增加总 Token 消耗。比较时应计入主 Agent 的协调和完整任务结果;三个 Agent 不代表必定扣三倍额度,也不保证更省。
Fast 模式
Fast 在支持的模型上以更高积分消耗换取速度。CLI 可用 /fast status 查看,标准速度足够时用 /fast off 关闭。官方速度说明区分 ChatGPT 积分倍率与 API 定价,不能相互套用。
两个任务例子,不是节省实测
已知文件里的一处错字,可以明确要求只修改该处并检查差异。全库调查或并行审查会增加这项任务未必需要的工作。
跨认证、存储和界面的故障,则可能适合分头调查。给各 Agent 明确边界,汇总结果后验证修复。更快完成任务可能值得额外消耗,但不证明总用量更低。
额度突然下降时怎么查
在一项范围明确的任务前后,记录账户、工作区、模型、速度及面板额度。检查是否同时运行其他 Codex 或 ChatGPT Work 任务,再查看重复读取、重试与子 Agent 工作。每次只调整一个因素。这是排查方法,不是严格对照实验,也不是未来扣额公式。
已经耗尽的额度仍需等待账户显示的重置时间,或采用符合条件的继续方式;减少后续工作不会退还已用额度。