找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

4698

积分

0

好友

610

主题
发表于 1 小时前 | 查看: 5| 回复: 0

Superpowers 6.0 的 Agent 工程化方法论宣传图

如果你已经在用 Superpowers,我建议这次直接更新到最新的 6.0.x。

这一轮不是“又多了几个 skill”。6.0 改的是长任务工作流:子 Agent 怎么接任务、review 怎么跑、计划怎么写、临时文件放哪里,以及 Codex 这类非 Claude 工具如何更自然地接进来。

看完这次更新,我的判断很直接:Superpowers 正在从“AI 编程技能包”变成一套更像工程流程的东西。它提醒 Agent 要 TDD、要 review、要先问清需求,也在尽量减少一种常见失败:

你让 Agent 跑一个复杂任务,它一开始计划写得不错,中途 diff 越堆越大,review 看起来也跑了,最后它说“完成了”,但你根本不知道哪些判断真正经过验证。

6.0 就是在修这个问题。

截至 2026 年 6 月 22 日,上游 obra/superpowers 最新 release 是 v6.0.3。6.0.0 是大版本更新;v6.0.2 修了安装包里的 evals submodule 问题;v6.0.3 又把 SDD 的 scratch 文件从 .git/ 挪到了 .superpowers/sdd/。所以现在要更新,我会直接看最新的 6.0.x,而不是只盯 v6.0.0。

先看差异:6.0 到底改了哪里

环节 老版本更像什么 6.0 改成什么 对使用者的影响
SDD review 两类 reviewer 分开跑,diff 和任务说明容易在上下文里来回传 一个 task-reviewer-prompt.md 同时看规格和质量,任务材料更多走文件交接 review 成本更低,也更不容易被 controller 的解释带偏
计划结构 计划像提纲,约束散在聊天记录里 增加 Global ConstraintsInterfaces 子 Agent 拿到任务时更清楚边界,少靠猜
模型选择 子任务和 reviewer 容易继承当前会话模型 dispatch 时要求明确模型 减少无意中全程用贵模型跑机械任务
可视化 brainstorm 本地 companion server 缺少足够鉴权 每个 session 有 key,文件访问和响应头更收紧 远程机器、共享网络里更安全
Codex 接入 更像 Claude Code 工作流的延伸 Codex 有自己的 SessionStart hook、安装说明和工具映射 Codex 用户不用把它当“凑合可用”的移植版
临时文件 SDD scratch 曾放在 .git/ 附近 v6.0.3 挪到 .superpowers/sdd/ 避免和 Claude Code 等工具的保护路径冲突

Superpowers 不是 prompt 包,它管的是“什么时候不能直接写代码”

很多人第一次看到 Superpowers,会把它理解成“Claude Code 的一堆提示词”。这个理解太轻了。

上游 README 对它的定位是:一套给 coding agent 用的软件开发方法论。它把 brainstorming、writing-plans、subagent-driven-development、code review、verification 这些流程拆成可触发的 skill,让 Agent 在合适的时间进入对应流程。

这和普通 prompt 集合差别很大。

普通 prompt 多半解决“这一轮怎么回答”。Superpowers 更像是在解决“这一轮是不是应该回答”。需求没问清,先 brainstorm;设计确认了,再写 plan;计划通过了,再执行;执行完,还要 review 和验证。

这个思路很适合当前的 AI 编程。模型已经很会写代码,但越会写,越容易在边界没说清时抢跑。Superpowers 的价值,就是在 Agent 想直接冲出去之前,先给它上几道闸。

6.0 这次最该看的,就是这些闸门怎么变严了。

核心更新一:SDD review 变便宜,也更难被糊弄

这次 6.0 的主角是 subagent-driven-development,也就是 SDD

官方 release notes 里说,在他们的 eval 中,Claude Code 和 Codex 在结果质量接近的情况下,大约快一倍,token 消耗接近少一半。我不会把这个数字照搬成所有人的固定收益,因为项目复杂度、工具环境、模型选择都会影响结果。但这里暴露的问题很准:以前很多 token 都耗在 review 流程上,真正的代码编写反而不是最大头。

旧流程里,每个任务可能得跑两个 reviewer:一个看规格符合性,一个看代码质量。任务文本和 diff 也经常通过对话大段传来传去。结果就是上下文越来越贵,reviewer 还容易被 controller 的解释带偏。

6.0 把这套流程改得更硬。

现在每个任务只用一个 task-reviewer-prompt.md,一次读取 diff,同时给出两个判断:规格有没有满足,代码质量有没有问题。任务说明和 review diff 改成文件交接,减少把大块 diff 塞进上下文。每次 dispatch 还必须写清楚模型,避免 reviewer 默认继承当前会话里最贵的模型。

我最在意的是另一点:controller 不能提前告诉 reviewer 忽略什么,也不能提前压低严重性。

这很像真实团队的 code review:实现者可以解释为什么这么写,但不能替 reviewer 下结论。Superpowers 这次明确要求 reviewer 只读不改、对实现者的理由保持怀疑、用文件和行号支撑 finding。这个改动不花哨,但对长任务很有用。

很多 AI 长任务并不缺 review 步骤,缺的是不被 controller 话术带偏的 review。6.0 明显在堵这个洞。

核心更新二:计划开始承载真实约束,而不是写给人看的提纲

以前看 AI 写计划,最烦的是它看起来很完整,但一执行就散。

比如一句:

实现权限校验,补充测试,保持兼容。

这句话放在计划里很顺,放到执行里就很虚。什么叫兼容?哪些接口不能变?错误码有没有固定值?测试覆盖哪些边界?如果这些没写清,子 Agent 只拿到自己的任务时,还是会猜。

6.0 的 writing-plans 开始补这个问题。

计划里新增了 Global Constraints,用来放所有任务都必须遵守的规则,比如版本限制、依赖限制、命名、精确文案、不能碰的目录。每个任务也会有 Interfaces,写清楚它消耗什么、产出什么,避免子 Agent 只看到局部任务后乱猜相邻模块的合同。

这对 Codex 用户尤其有用。Codex 跑长任务时,经常会在多个文件、多个工具调用之间来回切。你一开始说过的约束,如果没有沉淀到计划和任务里,后面就可能丢。

6.0 的计划更像工作单。它要让后续执行、review、恢复上下文都能拿到同一组约束,而不是只给人看一个漂亮提纲。

核心更新三:brainstorm 可视化伴侣补了安全模型

6.0 还有一个不太适合做标题、但很值得更新的点:brainstorming visual companion 的安全模型。

这个 visual companion 本质上是一个本地小 web server。Agent 在头脑风暴时,可以打开浏览器展示 mockup、流程图、对比图和交互草稿。对 UI、架构图、产品方案来说,它比纯文字讨论更直观。

但旧版本的问题也很直接:没有鉴权。

如果只是本机临时跑,很多人不会在意。可一旦你在远程机器、共享环境、公司网络或者可路由主机上跑,别人只要碰到端口,就可能读到你的 brainstorm 内容,甚至注入事件,让 Agent 误以为那是你的输入。

6.0 改成每个 session 有一次性 key,请求和 WebSocket 都要带 key。文件 server 也收紧了:拒绝 symlink、dotfile 和路径逃逸,加上 no-store、deny-framing 这类响应头。服务还支持重启后沿用同一个端口和 key,空闲时间从 30 分钟拉到 4 小时。

这个改动不酷,但很工程。

AI 工具越往工作流里嵌,越不能只看“能不能跑”。它在本地开了什么服务,谁能访问,断线后怎么恢复,关停时会不会杀错进程,这些才决定它能不能放进真实项目里。

核心更新四:它开始认真照顾 Codex 这类非 Claude 工具

Superpowers 最初给人的感觉很像 Claude Code 工作流。6.0 开始明显往多工具方向走。

这次新增了 Kimi Code、Pi、Antigravity 支持,也重写了很多 skill 里的工具表达。以前文档更容易出现 Claude Code 口吻,比如“用 Task 工具”“写到 CLAUDE.md”。6.0 开始改成更通用的表达:dispatch a subagent、your instructions file,再由不同 harness 的 reference 去映射具体工具。

对 Codex 用户来说,这点很实际。

Release notes 里还专门提到,Codex 现在通过自己的 SessionStart hook 启动,不再只是共用 Claude 风格的 wiring。Codex App 也补了安装章节和更完整的工具文档,包括 web search、AGENTS.md、personal skills 这类内容。

我理解这次更新想做的是:方法论保持一套,工具接入各走各的正确方式。

这比单纯“支持更多平台”更有意义。因为很多人现在不是只用一个 Agent。你可能日常用 Codex App,重构时用 Claude Code,前端页面又丢给 Cursor。如果每个工具都要一套完全不同的工作方法,最后一定乱。

Codex 用户怎么装 Superpowers

如果你用 Codex,我建议走官方插件入口,不要手动复制 skill 文件。Superpowers 不是只靠一堆 Markdown 生效,它还依赖 session start bootstrap、工具映射和平台自己的插件入口。用 Codex 官方插件市场装,才更接近它设计里的使用方式。

Codex App

在 Codex App 左侧点 Plugins,在 Coding 区域找到 Superpowers

点旁边的 +,按提示安装。

Codex CLI

在终端里打开插件搜索:

/plugins

然后搜索:

superpowers

选择 Install Plugin

装完后,我会先新开一个会话,确认 Superpowers bootstrap 有没有被注入。上游 Issues 里已经有人在 Windows Codex App + v6.0.3 下报过 hook exited with code 1,这更像安装后的兼容性检查点,不影响 6.0 的核心更新本身,但别装完就默认它已经生效。

其他工具也有自己的安装入口,但这篇我最建议 Codex 用户试。因为 6.0 里 SDD 的性能和成本优化,官方 eval 里就明确把 Codex 放进了结果描述;Codex 又已经有自己的 bootstrap 和安装说明,不再只是“能凑合用”。

谁最该更新

如果你只是偶尔让 Agent 改个小脚本、解释段代码,6.0 不会让你立刻有很强烈的感知。

最该更新的是把 Agent 当长任务执行器的人。比如你会让 Codex 或 Claude Code 连续跑几个小时,修一组测试、拆一个模块、做一条复杂业务链路,或者按设计文档拆成多个子任务执行。

这类任务里,6.0 的几个变化都能派上用场:

  • review 从两个 prompt 收成一个 task-reviewer-prompt.md
  • task brief、review diff、implementer report 改成文件交接
  • dispatch 必须写模型,减少无意中全程用贵模型
  • controller 不能提前压掉 reviewer finding
  • plan 里有 Global ConstraintsInterfaces
  • visual companion 不再裸奔
  • SDD scratch 文件不再写进 .git/
  • Codex 有自己的安装和 bootstrap 路径

这些点单独看都不刺激,但放在一个长任务里,就很值钱。

AI 编程现在的问题,不是 Agent 不会写代码,而是它写得太快、审得太轻、计划说得太虚,最后你不知道到底该不该信。

Superpowers 6.0 的价值就在这里:少一点天才表演,多一点工程规矩。

如果你已经装了 Superpowers,这次该更新了。

如果你也在折腾这些 AI 编程工具,可以来云栈社区聊聊你的工程化实践。




上一篇:浏览器到服务器全链路拆解:DNS、TCP、TLS、HTTP/3 与 Go 网络编程
下一篇:00后搞钱新路径:从ChatGPT到跨境支付,AI原住民的互联网启蒙
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-9-11 23:30 , Processed in 0.320941 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表