找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖
Claude、GPT 海外模型 API 接入云原生前端项目实战教程50G互联网架构师面试指南
大模型全栈开发课程企业级DevOps全栈实践零基础产品经理就业课程

5979

积分

0

好友

730

主题
发表于 5 天前 | 查看: 0| 回复: 0

如何定义“爆款”模型?从发布到“售罄”只用 8 天。

9 月 11 日早间,OpenAI 首席产品官 Tibo 在 X 上发文确认,为了保证现有用户体验以及 GPT-6 Astra 的稳定访问,将暂停接受 200 美元档 Pro 20X 订阅服务的新增订阅。

Tibo 宣布暂停 ChatGPT Pro 20X 订阅的推文截图

从技术狂欢到容量报警

其实在 9 月 9 日,Tibo 已经预警过:“人们对 Astra 的需求前所未有,我们正在拉所有能拉的杠杆……如果继续这样,我们可能得暂停新的 Pro 订阅。”Sam Altman 当时也回应称,这种情况“会很糟糕”,但 OpenAI 会优先保障现有付费用户的服务质量。

而现在距离 9 月 3 日 OpenAI 发布 GPT-6 Astra,也只过了八天。官方直接以“AGI 时代”为这款产品定调,强调它在长链条自主推理、复杂代码编写和自动化任务推进上的表现明显提升。

随后,开发者社区迅速震动,大规模工程测试甚至在短时间内虹吸了大量原属于 Anthropic 的核心用户。

ChatGPT Free、Go、Plus、Pro 订阅计划对比

截至发稿,订阅页面里的 Pro 选项只剩每月 100 美元的 5X 档位。Tibo 解释,Pro 订阅给系统带来的压力最大,暂停新增是“影响最小的办法”。OpenAI 没有给出恢复时间,只表示正在尽可能快速地补充容量。

龙虾创始人 Peter Steinberger 等开发者已经在社区提醒“最好赶紧订阅”,但也有不少人对顶级 AI 公司在核心产品上限流表达了不满。

最先售罄的是最贵档位

在 OpenAI 现有付费体系中,Pro 20X 虽然总价最高、用户数最少,却是单位算力折扣最大、使用率最高的一档:从 Pro 5X 升到 20X,用户多付一倍的钱可以换来四倍额度,还包含无限桌面语音等权益。Pro 5X 的 Astra 周额度是 50 条,Pro 20X 则是 200 条。

SemiAnalysis 的测算进一步揭示了这一档的财务压力:把各档订阅都跑到周限额耗尽,再按标准 API 价格折算,OpenAI 在 Plus 和 Pro 5X 上的使用率超过 11.4% 就会亏钱,而 Pro 20X 只要 5.7% 的使用率就进入负毛利。作为对比,Anthropic 对应的数字约为 10%。

换句话说,“Coding Plan”的定价隐含着一个假设——多数人不会用满额度。但 Pro 20X 用户恰恰是会把它用完的人:整夜运行 Codex、跑长链路 Agent、一天派发上百个任务的重度开发者。其中自然也包括通过路由器和中间站分流的用户。

Astra 的按量计费标准大约是上一代 GPT-5.6 Sol 的 2.5 倍,这进一步放大了单位推理成本。重度用户的真实使用行为,已经击穿了原有商业模型的假设。

当然,也有开发者抱怨 Astra 本身就存在“过度”消耗 Token 的嫌疑。有 Plus 用户称,Astra 跑半小时左右就能耗掉整周额度;也有人报告单个任务就撞上 5 小时限制。Tibo 前一天刚把重度场景的订阅额度消耗最多压低到原来的约 1/3 至 1/4,现在又直接补了一次全局重置。

Tibo 宣布付费订阅用量全局重置的推文截图

就在昨天,OpenAI 已经给所有付费订阅统一重置了一次使用额度。核心产品负责人 Tibo Sottiaux 称,目的是让已经把额度用光的用户继续跑 GPT-6 Astra。

OpenAI 的算力从何而来

暂停订阅的直接原因,是 GPT-6 Astra 上线后推理需求指数级增长,撞上了相对刚性的算力供给。《纽约时报》曾报道,OpenAI 预计到 2030 年累计云计算和 算力 相关支出将达约 7500 亿美元,较此前约 6000 亿美元的预测上调约 25%。而且 OpenAI 也明确承认,目前仍“非常缺乏”计算能力。

OpenAI 的算力供给是典型的多供应商结构,Oracle 是当前最大的单一供给方。2025 年 9 月,OpenAI 与 Oracle 确认签署了一份为期约五年、价值约 3000 亿美元的云计算合同。Oracle 将建设 4.5 吉瓦的数据中心容量供 OpenAI 按年采购,这相当于两个胡佛大坝的发电量、约 400 万美国家庭的用电量。

旗舰站点是位于得克萨斯州阿比林的 Stargate,双方共同部署的 OCI Zettascale10 集群可支持多达 80 万颗 NVIDIA GPU。

此外,OpenAI 与 AWS 签有约 1380 亿美元的长期合作协议,微软 Azure 则是其历史悠久的算力底座。

Tibo 在 X 上回应算力问题的推文截图

但合同签得再多,落地节奏是另一回事。Stargate 的 4.5 吉瓦容量需要逐年交付,山茶花项目(Project Camellia)在佐治亚州规划的 3.2 吉瓦电力,要到 2028 至 2032 年才会分阶段到位。

为了摆脱对英伟达 GPU 的依赖、降低单位推理成本,OpenAI 已经与博通达成了 10 吉瓦定制加速器合作;自研芯片 Jalapeño(墨西哥辣椒)计划从今年年底开始部署,但距离规模化供应仍有窗口期。

换句话说,远期 OpenAI 虽然握着天文数字的合同保底,但近期算力吃紧也是真实现状。

随着顶尖模型能力持续提升,不管是订阅价格还是限流措施,进一步收紧恐怕都难以避免。

声明:本文为 InfoQ 报道,不代表平台观点,也不构成投资建议,未经许可禁止转载。




上一篇:Vorssaint 开源 Mac 菜单栏工具走红:一个图标整合窗口分屏、剪贴板、卸载清理等常用小工具
下一篇:PageSpeed 移动端 58 分:一行 @import 拖垮首屏的排查与修复
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-9-21 02:00 , Processed in 2.078434 second(s), 46 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表