
如果你已经在用 Superpowers,我建议这次直接更新到最新的 6.0.x。
这一轮不是“又多了几个 skill”。6.0 改的是长任务工作流:子 Agent 怎么接任务、review 怎么跑、计划怎么写、临时文件放哪里,以及 Codex 这类非 Claude 工具如何更自然地接进来。
看完这次更新,我的判断很直接:Superpowers 正在从“AI 编程技能包”变成一套更像工程流程的东西。它提醒 Agent 要 TDD、要 review、要先问清需求,也在尽量减少一种常见失败:
你让 Agent 跑一个复杂任务,它一开始计划写得不错,中途 diff 越堆越大,review 看起来也跑了,最后它说“完成了”,但你根本不知道哪些判断真正经过验证。
6.0 就是在修这个问题。
截至 2026 年 6 月 22 日,上游 obra/superpowers 最新 release 是 v6.0.3。6.0.0 是大版本更新;v6.0.2 修了安装包里的 evals submodule 问题;v6.0.3 又把 SDD 的 scratch 文件从 .git/ 挪到了 .superpowers/sdd/。所以现在要更新,我会直接看最新的 6.0.x,而不是只盯 v6.0.0。
先看差异:6.0 到底改了哪里
| 环节 |
老版本更像什么 |
6.0 改成什么 |
对使用者的影响 |
| SDD review |
两类 reviewer 分开跑,diff 和任务说明容易在上下文里来回传 |
一个 task-reviewer-prompt.md 同时看规格和质量,任务材料更多走文件交接 |
review 成本更低,也更不容易被 controller 的解释带偏 |
| 计划结构 |
计划像提纲,约束散在聊天记录里 |
增加 Global Constraints 和 Interfaces |
子 Agent 拿到任务时更清楚边界,少靠猜 |
| 模型选择 |
子任务和 reviewer 容易继承当前会话模型 |
dispatch 时要求明确模型 |
减少无意中全程用贵模型跑机械任务 |
| 可视化 brainstorm |
本地 companion server 缺少足够鉴权 |
每个 session 有 key,文件访问和响应头更收紧 |
远程机器、共享网络里更安全 |
| Codex 接入 |
更像 Claude Code 工作流的延伸 |
Codex 有自己的 SessionStart hook、安装说明和工具映射 |
Codex 用户不用把它当“凑合可用”的移植版 |
| 临时文件 |
SDD scratch 曾放在 .git/ 附近 |
v6.0.3 挪到 .superpowers/sdd/ |
避免和 Claude Code 等工具的保护路径冲突 |
Superpowers 不是 prompt 包,它管的是“什么时候不能直接写代码”
很多人第一次看到 Superpowers,会把它理解成“Claude Code 的一堆提示词”。这个理解太轻了。
上游 README 对它的定位是:一套给 coding agent 用的软件开发方法论。它把 brainstorming、writing-plans、subagent-driven-development、code review、verification 这些流程拆成可触发的 skill,让 Agent 在合适的时间进入对应流程。
这和普通 prompt 集合差别很大。
普通 prompt 多半解决“这一轮怎么回答”。Superpowers 更像是在解决“这一轮是不是应该回答”。需求没问清,先 brainstorm;设计确认了,再写 plan;计划通过了,再执行;执行完,还要 review 和验证。
这个思路很适合当前的 AI 编程。模型已经很会写代码,但越会写,越容易在边界没说清时抢跑。Superpowers 的价值,就是在 Agent 想直接冲出去之前,先给它上几道闸。
6.0 这次最该看的,就是这些闸门怎么变严了。
核心更新一:SDD review 变便宜,也更难被糊弄
这次 6.0 的主角是 subagent-driven-development,也就是 SDD。
官方 release notes 里说,在他们的 eval 中,Claude Code 和 Codex 在结果质量接近的情况下,大约快一倍,token 消耗接近少一半。我不会把这个数字照搬成所有人的固定收益,因为项目复杂度、工具环境、模型选择都会影响结果。但这里暴露的问题很准:以前很多 token 都耗在 review 流程上,真正的代码编写反而不是最大头。
旧流程里,每个任务可能得跑两个 reviewer:一个看规格符合性,一个看代码质量。任务文本和 diff 也经常通过对话大段传来传去。结果就是上下文越来越贵,reviewer 还容易被 controller 的解释带偏。
6.0 把这套流程改得更硬。
现在每个任务只用一个 task-reviewer-prompt.md,一次读取 diff,同时给出两个判断:规格有没有满足,代码质量有没有问题。任务说明和 review diff 改成文件交接,减少把大块 diff 塞进上下文。每次 dispatch 还必须写清楚模型,避免 reviewer 默认继承当前会话里最贵的模型。
我最在意的是另一点:controller 不能提前告诉 reviewer 忽略什么,也不能提前压低严重性。
这很像真实团队的 code review:实现者可以解释为什么这么写,但不能替 reviewer 下结论。Superpowers 这次明确要求 reviewer 只读不改、对实现者的理由保持怀疑、用文件和行号支撑 finding。这个改动不花哨,但对长任务很有用。
很多 AI 长任务并不缺 review 步骤,缺的是不被 controller 话术带偏的 review。6.0 明显在堵这个洞。
核心更新二:计划开始承载真实约束,而不是写给人看的提纲
以前看 AI 写计划,最烦的是它看起来很完整,但一执行就散。
比如一句:
实现权限校验,补充测试,保持兼容。
这句话放在计划里很顺,放到执行里就很虚。什么叫兼容?哪些接口不能变?错误码有没有固定值?测试覆盖哪些边界?如果这些没写清,子 Agent 只拿到自己的任务时,还是会猜。
6.0 的 writing-plans 开始补这个问题。
计划里新增了 Global Constraints,用来放所有任务都必须遵守的规则,比如版本限制、依赖限制、命名、精确文案、不能碰的目录。每个任务也会有 Interfaces,写清楚它消耗什么、产出什么,避免子 Agent 只看到局部任务后乱猜相邻模块的合同。
这对 Codex 用户尤其有用。Codex 跑长任务时,经常会在多个文件、多个工具调用之间来回切。你一开始说过的约束,如果没有沉淀到计划和任务里,后面就可能丢。
6.0 的计划更像工作单。它要让后续执行、review、恢复上下文都能拿到同一组约束,而不是只给人看一个漂亮提纲。
核心更新三:brainstorm 可视化伴侣补了安全模型
6.0 还有一个不太适合做标题、但很值得更新的点:brainstorming visual companion 的安全模型。
这个 visual companion 本质上是一个本地小 web server。Agent 在头脑风暴时,可以打开浏览器展示 mockup、流程图、对比图和交互草稿。对 UI、架构图、产品方案来说,它比纯文字讨论更直观。
但旧版本的问题也很直接:没有鉴权。
如果只是本机临时跑,很多人不会在意。可一旦你在远程机器、共享环境、公司网络或者可路由主机上跑,别人只要碰到端口,就可能读到你的 brainstorm 内容,甚至注入事件,让 Agent 误以为那是你的输入。
6.0 改成每个 session 有一次性 key,请求和 WebSocket 都要带 key。文件 server 也收紧了:拒绝 symlink、dotfile 和路径逃逸,加上 no-store、deny-framing 这类响应头。服务还支持重启后沿用同一个端口和 key,空闲时间从 30 分钟拉到 4 小时。
这个改动不酷,但很工程。
AI 工具越往工作流里嵌,越不能只看“能不能跑”。它在本地开了什么服务,谁能访问,断线后怎么恢复,关停时会不会杀错进程,这些才决定它能不能放进真实项目里。
核心更新四:它开始认真照顾 Codex 这类非 Claude 工具
Superpowers 最初给人的感觉很像 Claude Code 工作流。6.0 开始明显往多工具方向走。
这次新增了 Kimi Code、Pi、Antigravity 支持,也重写了很多 skill 里的工具表达。以前文档更容易出现 Claude Code 口吻,比如“用 Task 工具”“写到 CLAUDE.md”。6.0 开始改成更通用的表达:dispatch a subagent、your instructions file,再由不同 harness 的 reference 去映射具体工具。
对 Codex 用户来说,这点很实际。
Release notes 里还专门提到,Codex 现在通过自己的 SessionStart hook 启动,不再只是共用 Claude 风格的 wiring。Codex App 也补了安装章节和更完整的工具文档,包括 web search、AGENTS.md、personal skills 这类内容。
我理解这次更新想做的是:方法论保持一套,工具接入各走各的正确方式。
这比单纯“支持更多平台”更有意义。因为很多人现在不是只用一个 Agent。你可能日常用 Codex App,重构时用 Claude Code,前端页面又丢给 Cursor。如果每个工具都要一套完全不同的工作方法,最后一定乱。
Codex 用户怎么装 Superpowers
如果你用 Codex,我建议走官方插件入口,不要手动复制 skill 文件。Superpowers 不是只靠一堆 Markdown 生效,它还依赖 session start bootstrap、工具映射和平台自己的插件入口。用 Codex 官方插件市场装,才更接近它设计里的使用方式。
Codex App
在 Codex App 左侧点 Plugins,在 Coding 区域找到 Superpowers。
点旁边的 +,按提示安装。
Codex CLI
在终端里打开插件搜索:
/plugins
然后搜索:
superpowers
选择 Install Plugin。
装完后,我会先新开一个会话,确认 Superpowers bootstrap 有没有被注入。上游 Issues 里已经有人在 Windows Codex App + v6.0.3 下报过 hook exited with code 1,这更像安装后的兼容性检查点,不影响 6.0 的核心更新本身,但别装完就默认它已经生效。
其他工具也有自己的安装入口,但这篇我最建议 Codex 用户试。因为 6.0 里 SDD 的性能和成本优化,官方 eval 里就明确把 Codex 放进了结果描述;Codex 又已经有自己的 bootstrap 和安装说明,不再只是“能凑合用”。
谁最该更新
如果你只是偶尔让 Agent 改个小脚本、解释段代码,6.0 不会让你立刻有很强烈的感知。
最该更新的是把 Agent 当长任务执行器的人。比如你会让 Codex 或 Claude Code 连续跑几个小时,修一组测试、拆一个模块、做一条复杂业务链路,或者按设计文档拆成多个子任务执行。
这类任务里,6.0 的几个变化都能派上用场:
- review 从两个 prompt 收成一个
task-reviewer-prompt.md
- task brief、review diff、implementer report 改成文件交接
- dispatch 必须写模型,减少无意中全程用贵模型
- controller 不能提前压掉 reviewer finding
- plan 里有
Global Constraints 和 Interfaces
- visual companion 不再裸奔
- SDD scratch 文件不再写进
.git/
- Codex 有自己的安装和 bootstrap 路径
这些点单独看都不刺激,但放在一个长任务里,就很值钱。
AI 编程现在的问题,不是 Agent 不会写代码,而是它写得太快、审得太轻、计划说得太虚,最后你不知道到底该不该信。
Superpowers 6.0 的价值就在这里:少一点天才表演,多一点工程规矩。
如果你已经装了 Superpowers,这次该更新了。
如果你也在折腾这些 AI 编程工具,可以来云栈社区聊聊你的工程化实践。