MacTalk

有没有发现,Codex 的额度越来越不经用了

先说我自己的情况,我现在订的是 GPT 100 刀/月的 Pro 档,平时跑点自动化任务,顺手加一两个小功能,一天下来就用掉周额度的 15%,这样差不多能撑一周。如果用 Astra(高)认真做一天开发任务,周额度能直接消耗到 90%。放在一个月前的 Sol 这简直是不可想象的。开始以为是错觉,翻了翻 OpenAI 的社区,发现同感的人不少,墨问的 Vibe 群里感觉也大差不差。

最近 OpenAI 官方论坛里类似的抱怨就没断过。一位 Codex 20x 用户发帖说,自己只用最基础的桌面端、没挂任何额外工具,五个小时就烧完了周额度。
Image
这是翻译截图,原文连接:
https://community.openai.com/t/codex-limits-spark-frustration-among-subscribers/1390408
还有人对比新旧两个同档账号:新账号周额度折算成 API 价格约 200 美元,老账号是 2000 多美元。另外,有开发者写了叫 NerfTrack(https://github.com/NerfTrack/NerfTrack)的小工具,把官方只显示百分比的进度条换算成具体金额。
这个工具传播开后,有用户(Alex Getman)用它估算出 Plus 的周限额从约 160 美元降到了 80 美元——这个说法后来被 Kingy AI 的调查评为“有支撑但未经证实”,因为百分比进度条上“额度变小”和“消耗变快”看起来一模一样,单靠工具读数无法区分。
事实上,第三方工具的流行,本身就说明这个口径有多模糊。

Codex 的产品负责人 Tibo 这几个月回应过好几次。我记得六月底他就承认 Codex 的后台任务出了 bug,自动审查工具和子代理有时会重复执行,白白烧掉额度,修复后给所有人重置了限额。
七月底 Tibo 解释,新模型 GPT-5.6 Sol 工具调用更多、运行更久,官方调整后让正常使用“续航”延长约 18%,同时否认削减过额度。
到了八月,面对新一轮质疑,Tibo 把矛头指向第三方 sub2api 工具——把订阅包装成按量 API 转售的那类服务,封了一堆账号。
等 Astra 发布之后,我自己的体感是,100 刀的额度如果你当工作 Agent 用,是完全不够用的。
也就是说,订阅额度的数字可能没变,额度能买到的工作时长变了。现在这个模型的计量单位和以前所有的订阅都不一样,能用多少,用户完全无法确定。
手机套餐,我们知道自己消耗了多少 G 流量;软件工具,订阅了一年,那就爱咋用咋用呗;微信读书按月付费订阅,用户爱看多少本书,随你的便。
但是,你订阅了一款模型的 Coding Plan,怎么用,用多少,咱说了不算啊。
模型每升级一次,单次任务的推理链和工具调用就更长,同样一周额度能做完的事自然变少。Fast Mode 更直接:速度快 1.5 倍,消耗是 2.5 倍。你想又快又好,不好意思,得加钱。
关键是,现在 Codex 加钱都买不到了 😂
那么,厂商会不会根据算力、市场策略甚至拉新节奏,随时调整实际额度?答案是会,而且一直在做。四月 Business 套餐从 30 美元降到 25 美元,有用户核对官方文档后发现,Codex 额度同步缩水约六成。八月二十五日,OpenAI 恢复 Plus 用户的五小时滚动限额,距离七月十三日高调取消只过了六周。九月初新旗舰模型发布,计费标准直接是上一代的 2.5 倍;九月十一日,200 美元档的 Pro 20X 暂停新订阅,理由是需求太高、算力不够。
SemiAnalysis (一家美国的半导体与 AI 基础设施研究机构)算过一笔账:把各档订阅跑到周限额耗尽,再按标准 API 价格折算,Plus 和 Pro 5x 的利用率超过 11.4% 时 OpenAI 就开始亏钱,Pro 20X 的临界点只有 5.7%。也就是说,这套定价从设计之初就假设“大多数人用不满”。当模型强到让人真想用满它,假设就塌了,限额、限购和临时公告便会接踵而至。
现在各大厂商已经把订阅制、五小时额度、周额度和月额度做成了默认的价格策略,把波动的算力成本包装成固定价格,其实一点不固定。
另外,各个厂商的计算策略也不一样,比如 Codex 的 Pro 用户只计算周额度,Plus 用户则有 5 小时限制,Kimi Code 会算五小时额度、周和月额度:
Image
阿里的 Qoder 走的是 Credits:
Image
模型订阅本身是门好生意。只是套餐页面上写的“额度”,更像浮动汇率,看得见,算不出来,想变就变,用户也是无可奈何,谁叫你现在离开 Agent 根本不会写代码了呢?只能自己多挑几家模型的 Token Plan 了。
我这不就配置了好多家吗?啥场景用啥,能做完工作就行,毕竟比人工费便宜多了啊。