平时在使用 Claude Code、Codex 的时候,经常需要联网搜索查资料。比如查看某工具最新文档、获取某产品官网信息、查找某开源库的版本等等。想让 Agent 搜得又快又准,目前常见的解决方案是接入 Tavily、Exa、Firecrawl 这些搜索服务,但按量计费——如果经常需要用到搜索,一个月下来出账单后,看着都肉疼。
无独有偶,最近我在 GitHub 上发现了一个项目 wigolo,提供了一个开源免费的解决方案。

它的思路很直接:直接把搜索、抓取、爬虫这一整套联网能力搬到本地来跑。不需要注册、也不用 API Key,每次查询零成本,Agent 想查多少次就查多少次。通过 MCP 可以安装到 Claude Code、Codex、Cursor 等主流 Agent 工具中使用。
那它是怎么做到零成本联网搜索查询的?答案是它内置了 18 个免费搜索引擎,并将它们的搜索结果做了排序和融合,模型跑在本地。那些按量计费的服务,贵就贵在服务端的模型推理和搜索引擎的调用。而现在,wigolo 把这些活全搬到自己电脑上干,自然就没有了账单。
隐私这块顺便说下,缓存、模型、配置都存在本地 ~/.wigolo/ 目录里,不会上传第三方。只有配置了外部大模型做总结时,内容才会发给模型,不配的话就纯本地跑。

而且,wigolo 提供的功能也非常全,给 Agent 提供了十个工具,满足各种需求:search 搜索、fetch 抓单页、crawl 爬整站、extract 做结构化提取、cache 查本地缓存、find_similar 找相似页面、research 深度研究、agent 自主收集信息,还有 diff 和 watch 盯着页面变化。

有个细节处理我觉得做得挺好的,每条搜索结果都会带有一段原文摘录,还附带评分,质量差的结果自动标记为垃圾。若遇到抓取失败会如实告诉 Agent 原因,而不是一股脑把空壳的内容塞给 Agent,从而浪费 Token。
跟 Firecrawl、Exa、Tavily 这些主流方案有什么优势,项目也给了一张横向对比表。搜索、抓取、提取这些核心功能大家都差不多,但是 wigolo 有几个独有的优点:查询结果本地缓存离线也能复查、每条结果有可解释的评分拆解,以及无需任何费用。

可能又有朋友会问,Claude Code 和 Codex 不是自带 WebSearch 和 WebFetch 吗?何必再装一个?其实两者定位不一样,内置工具走云端,开箱即用,临时查一下很合适。wigolo 的主要优势在这几个地方:
查过的内容全缓存在本地,同一个问题再问一次能瞬间返回,不产生额外开销。内容同时在 18 个引擎搜索,每条结果还有评分拆解,为什么这条排前面看得到原因。遇到 SPA 或者反爬的时候,还会自动换成无头浏览器去抓取,还会按域名积累经验。

另外能实现「计划、搜索、抓取、综合」的这些流程自动化循环,内置工具没这个能力。当然也可以分场景,一般查询用内置的搜索工具就可以,批量抓取或离线缓存场景则用 wigolo。
上手也非常简单,一条命令装好本地引擎,顺便把常用编程工具的 MCP 配置写好:
npx wigolo init --agents=claude-code,codex
注意由于需要在本地安装浏览器引擎和模型,所以会占用大概 1.5 GB 的磁盘存储。

想要输出带引用的报告,得配一个 Gemini API Key,不配也行,返回原始素材让主模型处理。除了 MCP 接入使用方式,还提供 REST API、TypeScript 和 Python 的 SDK,以及快速部署的 Docker 镜像,LangChain、CrewAI 这些框架也有现成集成。
写在最后
关于 Agent 联网搜索这事情,以前大部分人都是用内置的将就一下就好。遇到反爬的时候,就自己到网上查找或把内容截图发给 Agent 帮忙整理。甚至为了方便提升效率,还额外掏钱使用 Tavily 这些付费搜索服务。
现在有了 wigolo 这个新的选择,无论 Agent 用多少次搜索都无需花钱,数据也全在本地。随着 Agent 联网搜索能力逐渐增强,往后那些按量计费的搜索服务,日子恐怕不太好过。
GitHub 项目地址:https://github.com/KnockOutEZ/wigolo
更多技术内容,欢迎访问 云栈社区 。