今天凌晨,前沿模型赛道又迎来一次 Anthropic 与 OpenAI 的正面交锋。先聊 Opus 5.5。
Anthropic 正式发布了 Claude Opus 5.5。从 Opus 4.5 到 Opus 5 用了整整 8 个月,而这次从 Opus 5 到 5.5,只隔了两个月。迭代节奏明显在提速。
作为 5.5 系列的首个版本,Opus 5.5 在大部分任务上已经达到 Fable 5.1 的水平。价格也降了下来:每百万 token 输入 4 美元、输出 20 美元,缓存读取只要 0.2 美元,典型负载下比 Opus 5 便宜了约 40%。代码基准 Terminal-Bench 4.0 拿到了 66.4%,相比之下 Opus 5 只有 52.3%。所以从今天起,Opus 5.5 顺理成章地成了我日常干活的新主力模型。
OpenAI 这边也没闲着,同时甩出了 GPT-6 Sol 和 Luna,定位在旗舰 Astra 之下,主打性价比。Sol 直接从上一代的 4/20 美元砍到 2/10 美元,Luna 更是降到 0.1/0.5 美元。巧了,Claude Opus 5.5 的定价恰好就是上一代 Sol 的价位。DeepSWE 上 Sol 拿到 68.8%,只比 Fable 5 低了 1.1 个百分点,单任务成本却少了约 80%。
上周 Dario 刚发文呼吁放缓前沿节奏(pacing the frontier),结果这个月 Claude 和 GPT 的模型发布就没停过。从 9 月初的 Fable 5.1、GPT-6 Astra,到这周的 Opus 5.5、GPT-6 Sol 和 Luna,前沿模型依旧是紧锣密鼓的神仙打架。
Anthropic 在今天 5.5 的发布公告里写道:AI 的进展应当有节奏地推进,以确保安全实践始终领先于模型能力。节奏把控既能保障 AI 安全,又能保持与中国竞争的实力。
发模型就发模型,非要扯什么安全,还要拉上中国。这事儿说白了,就是拿安全和中国当挡箭牌,然后自己拼命迭代。前沿模型训练这件事,谁先按下暂停键谁就出局。所以别听他们嘴上说什么,得看他们实际做了什么。嘴上喊着 AI 研发要放缓,实际却两周甩出一个新模型,这不就是扯淡么。
另外还有一件事。Claude 今天居然破天荒地发了一张重置卡。说实话,在我印象里,他们家从来没玩过这种重置卡的玩法,日常额度重置都很罕见。很明显是感受到了 OpenAI 和 Codex 的压力。Tibo 的重置打法,不得不承认,确实管用。Claude 重置卡可以到 Claude 网页版的 Settings - Usage 页面下查看和使用。
所以,哪有什么迫在眉睫的安全威胁。归根到底,还是友商们追得太紧了。这种行业竞争节奏,放在整个 大模型 赛道里看,短期内估计只会越来越卷。
|