工具推荐
1788430009更新
0

你有没有在自己的电脑里找过一份旧资料?内容大概还记得,标题死活想不起来。你在搜索框里试了好几个词,出来的都是别的东西,最后只能翻文件夹,一层一层地找。
这种尴尬,根子在搜索工具的旧规矩上,它只认字面。你说得出准确的关键词,它马上给出结果。如果你只能描述个大概,它就抓瞎,一个字对不上都算没有。
过去这规矩还能忍,因为搜索是给人用的,人搜之前总想得起几个词。现在麻烦在于,AI 助手也加入了找东西的行列,它只会照着你那几句含糊的话去猜,猜不中,就一遍遍试错,费时间也费钱。
那能不能让搜索听懂"大意",别只认字面?
一个叫 zg 的开源项目,正是来解决这个问题的。
zg 的全名是 zvec-grep。一个装在你电脑里的本地搜索工具,你和 AI 助手都能用。

它把几样成熟的技术接在了一起。阿里开源的 Zvec 负责向量检索和 BM25,相当于能"懂意思"的搜索,再加上程序员常用的 ripgrep,负责又快又准的精确查找。zg 自己多做的一件事,是先把本地内容读懂、整理、编成目录。
编目录这个动作很关键。
以前找东西,像在没有索引的图书馆里找书,全凭记忆。zg 先给每份内容做一张带编号的卡片,之后你说得出准确名字也好,只记得大概内容也罢,它都能很快把对应的文件和位置指给你。
它给人用是一套命令行工具,给 AI 助手用的是 MCP 接口,人和 AI 共用同一份目录,不用各建一遍。项目支持 Windows、macOS、Linux,目前还在快速迭代。
那这个项目具体能解决什么问题呢?

其实,把"找不到东西"的烦恼拆开,只有三层,zg 会一层一层地处理。
第一层,想不起来原话,就搜不到。 你搜"访问申请流程",资料里写的是"账号授权与批准",一个词都对不上,它就当没有。zg 编目录时,会顺带给每段内容做一次阅读理解,把意思转成一组数字坐标,意思越近坐标越近。搜索时先按意思找,再把按关键词命中的结果合进来,排成一张榜单。模糊的问题它接得住,精确的验证它也做得了。
第二层,AI 帮你找,又慢又费钱。 AI 每读一段文字都计成本,一次能记住的内容还有上限,塞太多无关内容还会犯迷糊。zg 从三处下手。它把函数、章节标题这类结构拆成带地址的小卡片,检索按卡片翻页,不用把整个文件读进来。它只给 AI 留一个搜索入口,免得 AI 在一堆工具里东试西试。它返回的每条结果都写明出自哪个文件、大约第几行,先给一小段预览,需要再展开全文。无关内容根本进不了 AI 的脑子,钱就省下来了。
第三层,怕资料被传上云。 源代码、公司文档、私人笔记,很多人不愿为了搜一下就把它们发出去。zg 把扫描、建索引、连"读懂意思"都放在本机做,内置 11 个本地模型,相当于给电脑装了离线翻译器,默认那个只占 32MB 缓存,还不用独立显卡。能不能调用工具是一把锁,内容能不能出电脑是另一把锁,都要你亲手打开。
三层都做完,效果如何?官方做了对照实验:同一个 AI、同样的任务,唯一区别是有没有装 zg。代码问答组里,AI 的翻找动作少了一半以上,读入文字量少了近一半,答案质量还略有提升。深度研究组里,准确率从 98.67% 提到 99%,读入量少了约 38%,翻找动作少了约 43%,总耗时短了近四成。
如果你正被这三层烦恼困扰,上手比想象中简单,三步就能跑起来,还不用自己搭服务器、写配置文件。

第一步,安装。装好 Node.js 22 或更新版本后,在终端执行一行命令。安装过程会自动发现电脑里已有的 AI 助手,比如 Codex、Claude Code、Cursor、OpenCode,顺手把接口接好。
第二步,编目录。进入你的代码仓库或资料文件夹,再执行一条命令。默认模型很轻,官方举例说,给 Django 这样的大型项目(3457 个文件)建全量索引,在一台 Mac(M4 Pro)上不到 30 秒。之后文件有改动,它会自动增量更新。
第三步,开始找。自己用,就在终端里用大白话提问。给 AI 用,直接在 AI 助手里开口,它会自己调用 zg。
...bash
npm install -g @zvec/zvec-grep # 安装(自动接好已装的 AI 助手)
cd your-folder && zg index # 给资料编目录
zg query --human "主题设置是在哪里恢复的" # 用大白话搜索
回到开头那个场景。
过去,只有人需要找东西,而且得记得原话。现在 AI 助手也要找,你却很可能只记得大意。zg 这个项目,把"按字面找"和"按意思找"两种能力放进同一个本地入口,让人和 AI 可以共用。
项目还很“年轻”, PDF、Word、PPT 目前还不能直接搜索,但路线图里已经排上了。
如果你也常被"明明有,就是找不到"所烦恼,值得花十分钟试一试这个项目。
项目地址:https://github.com/zvec-ai/zvec-grep
豫公网安备41010702003375号