
本文来自微信公众号: MacTalk ,作者:池建强
先说我自己的情况,我现在订的是GPT 100刀/月的Pro档,平时跑点自动化任务,顺手加一两个小功能,一天下来就用掉周额度的15%,这样差不多能撑一周。如果用Astra(高)认真做一天开发任务,周额度能直接消耗到90%。放在一个月前的Sol这简直是不可想象的。开始以为是错觉,翻了翻OpenAI的社区,发现同感的人不少,墨问的Vibe群里感觉也大差不差。
最近OpenAI官方论坛里类似的抱怨就没断过。一位Codex 20x用户发帖说,自己只用最基础的桌面端、没挂任何额外工具,五个小时就烧完了周额度。

这是翻译截图,原文连接:
https://community.openai.com/t/codex-limits-spark-frustration-among-subscribers/1390408
还有人对比新旧两个同档账号:新账号周额度折算成API价格约200美元,老账号是2000多美元。另外,有开发者写了叫NerfTrack(https://github.com/NerfTrack/NerfTrack)的小工具,把官方只显示百分比的进度条换算成具体金额。
这个工具传播开后,有用户(Alex Getman)用它估算出Plus的周限额从约160美元降到了80美元——这个说法后来被Kingy AI的调查评为“有支撑但未经证实”,因为百分比进度条上“额度变小”和“消耗变快”看起来一模一样,单靠工具读数无法区分。
事实上,第三方工具的流行,本身就说明这个口径有多模糊。
Codex的产品负责人Tibo这几个月回应过好几次。我记得六月底他就承认Codex的后台任务出了bug,自动审查工具和子代理有时会重复执行,白白烧掉额度,修复后给所有人重置了限额。
七月底Tibo解释,新模型GPT-5.6 Sol工具调用更多、运行更久,官方调整后让正常使用“续航”延长约18%,同时否认削减过额度。
到了八月,面对新一轮质疑,Tibo把矛头指向第三方sub2api工具——把订阅包装成按量API转售的那类服务,封了一堆账号。
等Astra发布之后,我自己的体感是,100刀的额度如果你当工作Agent用,是完全不够用的。
也就是说,订阅额度的数字可能没变,额度能买到的工作时长变了。现在这个模型的计量单位和以前所有的订阅都不一样,能用多少,用户完全无法确定。
手机套餐,我们知道自己消耗了多少G流量;软件工具,订阅了一年,那就爱咋用咋用呗;微信读书按月付费订阅,用户爱看多少本书,随你的便。
但是,你订阅了一款模型的Coding Plan,怎么用,用多少,咱说了不算啊。
模型每升级一次,单次任务的推理链和工具调用就更长,同样一周额度能做完的事自然变少。Fast Mode更直接:速度快1.5倍,消耗是2.5倍。你想又快又好,不好意思,得加钱。
关键是,现在Codex加钱都买不到了😂
那么,厂商会不会根据算力、市场策略甚至拉新节奏,随时调整实际额度?答案是会,而且一直在做。四月Business套餐从30美元降到25美元,有用户核对官方文档后发现,Codex额度同步缩水约六成。八月二十五日,OpenAI恢复Plus用户的五小时滚动限额,距离七月十三日高调取消只过了六周。九月初新旗舰模型发布,计费标准直接是上一代的2.5倍;九月十一日,200美元档的Pro 20X暂停新订阅,理由是需求太高、算力不够。
SemiAnalysis(一家美国的半导体与AI基础设施研究机构)算过一笔账:把各档订阅跑到周限额耗尽,再按标准API价格折算,Plus和Pro 5x的利用率超过11.4%时OpenAI就开始亏钱,Pro 20X的临界点只有5.7%。也就是说,这套定价从设计之初就假设“大多数人用不满”。当模型强到让人真想用满它,假设就塌了,限额、限购和临时公告便会接踵而至。
现在各大厂商已经把订阅制、五小时额度、周额度和月额度做成了默认的价格策略,把波动的算力成本包装成固定价格,其实一点不固定。
另外,各个厂商的计算策略也不一样,比如Codex的Pro用户只计算周额度,Plus用户则有5小时限制,Kimi Code会算五小时额度、周和月额度:

阿里的Qoder走的是Credits:

模型订阅本身是门好生意。只是套餐页面上写的“额度”,更像浮动汇率,看得见,算不出来,想变就变,用户也是无可奈何,谁叫你现在离开Agent根本不会写代码了呢?只能自己多挑几家模型的Token Plan了。
我这不就配置了好多家吗?啥场景用啥,能做完工作就行,毕竟比人工费便宜多了啊。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。