找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

6130

积分

1

好友

769

主题
发表于 昨天 18:39 | 查看: 14| 回复: 0

昨天 OpenAI 发布了 GPT-6 Astra,不过目前只有部分内测用户能抢先体验,绝大多数订阅用户还只能干瞪眼。消息一出,Claude、GPT、Grok 三大服务全线崩溃,连带着我昨晚上床时间都比平时早了不少。

OpenAI 总裁在媒体沟通会上说,他个人认为 OpenAI 已经做到了 AGI,未来回头看,可能就是这个模型。

看到这个说法的时候,我直接躺下刷手机了——AGI 都来了,不躺平还能干啥?

结果从昨晚刷到现在,所有内测 GPT-6 Astra 的案例无一例外全在搞 3D 模型。原来这就是所谓的 AGI 时刻吗?

于是我又坐起来了!合着 AGI 的第一站,就是来抢 3D 设计师的饭碗啊。

刷屏的 3D 案例

我最近也在折腾用 AI 在 Blender 里生成 3D 模型,Claude Fable 5 也试过。说实话,想做出一个精良的模型,难度不是一般的大——很多时候烧掉大量时间和 token,成品顶多也就五六十分的水平。之前我试了各种方法,最后才勉强做出一个机甲模型。

所以看到 Astra 这批刷屏案例,我的第一反应是:如果都是真的、没有夸大,那确实是相当大的进步。

先看这个 3D 键盘。作者说,他只用了一张参考图加一句提示词:"在 Blender 里把这个做出来"。

GPT-6 Astra 通过单张参考图在 Blender 中生成的 Codex Micro 3D 键盘

非常巧,我前几天刚刚让 GLM、Claude 试过做键盘,效果非常差,甚至用了两个顶尖 3D 生成模型,效果也不太行。等到 GPT-6 Astra 全员开放了,我一定要把手头那个键盘的例子再跑一遍,看看到底是不是吹牛。

建筑

还有 Higgsfield AI 团队让 Astra 在 Blender 里做 3D 版的美国总统白宫椭圆形办公室(Oval Office)。

整个流程完全由提示词驱动:先描述场景设计细节,Astra 负责在后台直接生成整个场景的构建代码,随后调用 Blender 建立实景模型,最后通过 Cycles 引擎完成高精度物理渲染。

模拟 3D 游戏

有一位开发者给 Astra 提了一个需求,想在自己家乡格鲁吉亚第比利斯上空开飞机。据说,只在 Astra Ultra 模式下一次请求,就完成了整款飞行模拟器 95% 的代码与场景构建。

在生成过程中,它还能自己调用 Computer Use,从各个视角旋转三维镜头,检查那些历史建筑和纪念碑在不同视角的拓扑面有没有穿模,然后自己动手把穿模给修了。

它到底是怎么捏出 3D 的

仔细拆解社区里的这批案例,Astra 搞 3D 并不是单一技术路径,而是两条腿走路。

第一条路是「代码直出 3D」(Vibe Coding 3D 版)。

熟悉 Blender 的朋友都知道,Blender 底层有一套非常完善的 Python API(bpy)。只要 Python 代码写得足够精细,你完全不需要碰鼠标,光靠脚本就能在三维坐标系里建点、连线、生成多边形、赋予材质着色器节点。

过去的大模型也能写 bpy 代码,但写出来的往往只有立方体、球体拼接的儿童玩具水平。稍微遇到复杂的贝塞尔曲线或者倒角布线,代码一跑就报错。

而 Astra 的代码生成能力显然经历过海量三维几何代码的专门训练。它能精准计算顶点坐标的数学拓扑,甚至能理解 Cycles 渲染器的着色器节点树,一瞬间敲出几百行严密的脚本,在画布上直接拔出复杂的建筑群。

第二条路则是「Computer Use 物理操控」。

这才是真正拉开代差的地方。代码写得再好,一旦遇到不可预测的几何碰撞、法线翻转或者渲染黑块,纯代码模型就彻底瞎了,因为它看不见运行结果。

但 Astra 有眼睛,也有手。它可以直接接管桌面,像一个熟练的 3D 动画师一样,在屏幕上点选工具栏、切换顶视图侧视图、框选异常的顶点、按下快捷键做平滑细分。

更重要的是,这两条路在 Astra 身上是结合起来的:先用代码超高速把骨架和主场景生成出来,再切换到视觉和鼠标控制,多角度转动模型,肉眼质检,手动修正瑕疵。

这两者的结合,实际上打通了「生成」与「验证」的闭环。

看看评分

OpenAI 官方为什么把 Astra 定义为「世界上最聪明、对齐最好的模型」?

很大程度上来自 ARC-AGI-3 的跑分——从 GPT-5.6 Sol 一下跳到了 98.6%,感觉像是换了一个模型。

GPT-6 Astra 与 GPT-5.6 Sol、Claude Fable 5 等主流模型在 ARC-AGI-3 等基准上的性能对比

到底什么是 ARC-AGI-3 呢?

简单来说,就是把 AI 扔进一个从没见过的游戏里,不给它说明书,也不告诉它规则,总之就是什么都不说,然后就看它能不能自己摸索着通关,而且还要尽量少走弯路。

看起来更像一个有自主意识的人,对不对?

还有就是在模拟真实人类操作电脑的 OSWorld 2.0 评测里,Astra 完成一个复杂任务耗时大约 40 分钟,得分 72.6%。相比之前 GPT-5.6 Sol 的 75 分钟和 65.7%,无论是速度还是成功率都有质的飞跃。

也就是说,GPT-6 Astra 是一个会操作电脑、非常聪明、能自主探索的天才。让它摆弄摆弄 Blender、CAD,再玩玩游戏,好像确实不在话下了。

最后

AGI 可能在不远的将来真的到来,那我们到底算不算幸运呢?

你觉得一个能自主操作电脑、捏 3D、做游戏的大模型,离你心目中的 AGI 还有多远呢?




上一篇:Node.js被武器化投递恶意软件:ClickFix与EtherHiding攻击链解析
下一篇:支付状态机怎么设计:扣款超时、重复回调与可恢复、可审计
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-9-10 16:02 , Processed in 1.393753 second(s), 40 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表