我先把判断放这儿:ChatGPT 那个 200 美元、20 倍用量的套餐被下架,和「算力不够」只沾了一点边。真正把它停掉的,是一个从第一天起就写在财务模型里、过去一年从来没人复核过的假设。
先说那个被读了一百遍的解释
9 月 10 号,OpenAI 暂停了 200 美元档 ChatGPT Pro(内部叫 Pro 20X)的新订阅和升级。官方给的理由是:新模型 Astra 的需求「前所未见」,算力不够用了。
这个说法没毛病,但它是最外面那一层的说法。往里看一层,你会看到另一件事。
第三方机构 SemiAnalysis 做过一个测算:把 OpenAI 各档订阅的周限额跑到耗尽,再按标准 API 价格折算——在 Pro 5x 上,使用率超过 11.4% 就开始亏钱;在 Pro 20X 上,使用率只要到 5.7%,就进入负毛利。
翻译一下:这个产品从设计的第一天起,就靠一个假设活着——多数人买了,不会用满。
卖得越好,这个假设越假。Astra 上线后,单位额度消耗大约是上一代模型的 2.5 倍,重度用户整夜开着跑长任务、一天派上百个任务。于是出现了那句我觉得是整件事里最值钱的评论:Pro 20X 的「售罄」,说明原本的定价预想是「多数人不会完全用满」,而实际使用行为击穿了它。
所以停售公告里写的是算力,账本上塌掉的是假设。
价签和开关,不在同一层
我把这件事概括成一句话:你能读到的限制,和真正决定结果的开关,通常不在同一层。
价签是给人看的。它愿意写 20 倍、写够用、写「随你怎么跑」,因为它是营销的那一层。「多数人不会用满」是给系统跑的那一层——它不写在任何地方,它是定价模型里一行默认参数。
关键在于,这两层平时长得一模一样。只要用量没逼近极限,价签说的和假设算的永远对得上,你甚至会觉得价签就是真相。只有当行为突然撞到极值——一夜之间所有人都开始把额度用满——两层才会裂开。而裂缝里掉出来的不是「产品变差了」,是「票卖完了」。
价签没错。错的是价签下面那层,从来没人去核对。

我们自己踩的同一个坑,长了三个头
我之所以一眼认出这个形状,是因为前几天我们给一个小工具上线收款功能的时候,在三个不同的层上各踩了一脚。
这几层里,没有一层是「代码写错了」。全都是「我以为我在调 A,真正决定结果的是 B」。
第一层:后台有个「支付通道」的设置项,选项列表是空的。不是没配,是这个下拉框压根没渲染出来。也就是说——这个配置在文档里存在、在页面上不存在。你想设,也找不到地方落手。它在「你看到的」和「你能改的」之间,裂开了一条缝。
第二层更像段子。服务器有个请求体大小上限,原本是 30m。某天线上传大图失败,第一反应是「限制太紧了」,于是把它放宽到 100m。放完才想起来去查应用自己的上限——应用的上限比 30m 还小。 我们一直在拧的那道闸门,从来就不是真正卡住水的那一道。外面那层放宽三倍,里面那层纹丝没动。
第三层最阴。支付成功后要跳回我们的页面,代码里写的是个相对路径。本地测,跳转正常;上了线,跳到了 localhost。因为「本地」和「线上」是两个环境层,而跳转这件事,最终由请求实际落在哪个域名决定——这一点,在本地永远测不出来。
三层,三个失效位置,同一个形状:你调的那一层,不是决定结果的那一层。

为什么总是这样?因为假设层不写给人看
这两个故事——ChatGPT 的停售、我们的三层坑——背后是同一个机制。
任何一个系统里,「限制」其实分两种:
一种是被人读的:价签、规格表、配置页、文档、SLA。它有人维护,因为读它的人会投诉。
另一种是被系统跑的:默认参数、隐含前提、环境假设,以及你默认「大家都这样」的那条基线。它没有人维护——因为没有任何一个角色会去读它。你不读,它就不存在;它不存在,就永远不会被标错。
于是所有系统里都会出现一个固定的错觉:你把能看见的那一层调到极致,就以为问题解决了。
其实你只是在一个不吃这个开关的盒子外面,拧了一整天。
一个能立刻用起来的定位法
那怎么知道瓶颈在哪一层?不用分析,用实验。
把你能调的那一层,直接拉到极端,然后看结果有没有动。
- 怀疑限制在网关,就把网关上限调到离谱,重启,重试一遍。如果水位纹丝不动,你就已经证明了瓶颈不在这一层——这条结论比任何分析都硬。
- 怀疑限制在环境,就把它放到第三个环境里跑(除了本地和线上,随便再找一个)。跑出来一样,环境层排除。
- 怀疑限制在「人」,就把流程里那个审批环节直接拿掉,看它会不会变得更慢。
这套方法的妙处在于:它不要求你先找到对答案,它只要求你排除。 而排除有一个分析给不了的好处——它是可复现的。你拉满一次,谁都可以再拉一次,结果一样。
反过来,如果拉满之后结果确实变了,那恭喜:你不只找到了瓶颈,你还找到了一个真的有效、而且成本极低的杠杆。

最后
那个套餐后来在 9 月 19 号悄悄放了一小批回来,只给最近用过、又恰好取消或降级的老用户,一人一次机会。这个补丁很精巧,但它修的仍然是描述层——买不到的问题缓和了,那个「多数人不会用满」的假设,还停在原地。
限制写在价签上,原因藏在假设里。你永远看不见假设层,直到它塌。
所以能做的只有两件事:第一,把假设写出来,让它变成一份有人读的文档——写出来的会被核对,没写出来的不会。第二,在极值处测它——因为极值,是唯一能让假设层现形的地方。