不ber?Kimi 你是考古派的啊。。。
都6202年了,怎么还在玩浏览器插件???
前脚刚出了个 Kimi Code Desktop,把浏览器加塞进了本地窗口,转头又给 Chrome 安排上了「新」插件。

说新吧,倒也没多新鲜。
老瓶装新酒,就是4个月前发布的 Kimi WebBridge,改头换面成了 Kimi 浏览器扩展。
顺便功能也升了级——
打开网页、读取内容、点击按钮……这些老一套的东西倒都还在,主要新增功能有两处:
一是现在浏览器侧边栏直接可用,二是在网页上做过的事能帮忙录成 Skill,方便下次复用。
好好好,这下用 Kimi 更方便了 (doge)
新版加点料
老实说,旧版 WebBridge 的名字还挺直白的。
“网页桥梁”一头接本地 Agent,一头连 Chrome 或 Edge 扩展。Agent 发来指令,它就能在用户的真实浏览器中跳转页面并完成任务,再把操作结果送回去。
简而言之,它是让 Agent 用上你的浏览器。

至于新版呢,先是把入口给改了。
现在点击工具栏里的 Kimi 图标,登录 Kimi 账号,就能在侧边栏直接对话,让 Kimi 操作当前网页;原先由本地 Agent 调用扩展的方式则继续保留。

功能上延续 WebBridge,可以完成网页浏览操作与信息抓取。
不过,之前 Agent 通过 WebBridge 操作浏览器时,每次都需要迭代调教一段时间,才能高效完成任务。
现在这个问题在新版得到了解决。
新版支持录制用户在网页上的动作,再整理成 Skill。
举个栗子,比如我每天都会打开同一个网站,查找当天新闻再导出数据,Kimi 浏览器扩展现在就能把这一套网页操作保存成 Skill,下次直接调用。
如果某次任务做得很顺利,Kimi 也能将此次会话以 Skill 形式保存下来。
正因如此,新版更适合重复工作。用户随手可用,流程也可以反复调用。

当然,官方也提醒,遇到网页改版、页面动态加载等情况,仍然可能让操作中途卡住。所以遇到复杂页面失败时,可以先截图确认页面状态,再调整指令。
浏览器插件仍能打
AI 插件走到这儿,其实也绕了挺长一段路。
Manus 团队早年的产品 Monica,就把 AI 放在任意网页边上,帮用户提问、写邮件;豆包插件也一直在强调视频内容筛选、外语网页翻译和论文阅读。
那一代的 AI 插件主要解决的是「看网页」。
到了「用网页」时期,Manus 后来又推出了 Browser Operator,让 Agent 经授权后操作用户的本地浏览器。

Kimi WebBridge 做的也是差不多的事情,都是真实浏览器控制。今天的 Kimi 浏览器扩展则再往前推了一步,能够让做过的网页流程有机会沉淀下来。
所以6202年了,浏览器插件还真得继续做,用户在这儿,痛点也在这儿。
不过,Kimi 浏览器扩展紧跟着 Kimi Code Desktop 前后脚发布,这件事本身就蛮有意思的。

Kimi Code Desktop 是专门给 Agent 做项目的工作台,尤其是内置浏览器,会一路跟着项目走,非常适合改完网页立即看效果。
哪里不对,用户可以直接点选页面元素、附上截图和评论,让 Agent 打回重做。
同样指向浏览器,一个是项目内部,一个是用户外部应用,将 Kimi Code Desktop 和浏览器插件结合来看,产品思路就清楚多了:
Agent 在桌面端拿到项目文件、终端和改动记录;需要检查自己做出的网页时,打开会话里的内置浏览器;需要进入用户日常使用的网站时,再通过扩展操作已有的 Chrome 或 Edge。
Agent 的手越伸越长,也越做越稳。
参考链接:
[1] https://x.com/Kimi_Moonshot/status/2102372557190230244
[2] https://www.kimi.ai/products/kimi-browser-extension
[3] https://mp.weixin.qq.com/s/0x-tXOxlutrxE9YNODng0A
|