找回密码
立即注册
搜索
发回帖 发新帖

6162

积分

0

好友

780

主题
发表于 18 小时前 | 查看: 8| 回复: 0

昨天 Reflection AI 发布了第一款模型 Beam。

501B 总参数,MoE,每次只激活 23B,100 万 Token 上下文,预训练吃了 23.8T Token。

更值得展开的是后训练环节。

Reflection 先用 6144 张 GB300 跑预训练,后面又上了 10500 张 GB300,连续四周做高强度 RL,最后干了超过 1 亿次 rollout(算力管够)。

看到这里我第一个感觉就是:这已经不是以前那种几个研究员蹲实验室里炼丹了。

现在的 Frontier Model,越来越像真正的重工业。

几万张 GPU、几千万次甚至上亿次试错、Sandbox、奖励模型、Agent 环境,全都变成流水线的一部分。

AI 这东西,已经开始有点像当年的半导体产业了。钱、算力、工程、人才,缺一块都很难往最前面挤。

Beam 这次瞄准的对象也很明确,就是 GLM、Qwen、DeepSeek 这些中国开放模型。

官方数据里,它在 Coding、Agent、推理这些任务上已经能和 GLM-5.2 打得有来有回,部分终端编程测试还略高一点。

当然,我对这种「自家模型打自家榜单」一向比较谨慎。🤡

模型到底行不行,还是得等权重放出来,扔进 OpenRouter、各种 Coding Agent、真实项目里狠狠干几天再说。

但我觉得 Beam 最值得看的地方,其实根本不是榜单,而是它终于补上了美国 AI 产业里一个挺奇怪的缺口。

过去两年,最热闹的开放模型基本都来自中国:DeepSeek、Qwen、GLM、Kimi、MiniMax……

反倒是美国,最顶级的能力几乎都锁在 API 后面。

OpenAI、Anthropic、Google 的模型当然很强,但你能用,不代表你真的拥有它。

而 Beam 这次明确说了,10 月内 Apache 2.0 开放权重。可以商用,可以部署,可以微调,可以魔改。

这个意义其实挺大。

我一直觉得,未来 AI 世界很可能会慢慢分成两层:上面是少数几个闭源旗舰模型,负责最难的推理、规划和前沿能力;下面则是大量开放权重模型,真正跑进企业、服务器、设备和各种 Agent 系统里,成为基础设施。

谁能占住下面这一层,谁的生态可能反而更稳。

所以 Beam 现在是不是美国版 DeepSeek,我觉得还得再看。

但有一点已经很明显了:美国终于发现,开放权重这张牌不能一直让中国厂商打。牌桌另一边,开始真正有人坐下来了。

接下来这场开放模型战争,应该会越来越好看。




上一篇:RTX 5090亚马逊购卡遭掉包:攒钱一年开箱变大米旧显卡
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-10-8 22:23 , Processed in 0.065880 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表