WeKnora:腾讯开源的知识管理框架,把 RAG、Agent、Wiki 叠成三层,让文档自己长成知识体系

工具推荐 1789380402更新

0

"

知识存了 ,它其实一直在那儿,只是 没人找得到

老板在群里问你,去年那个项目的复盘文档在哪。你回一句「我找找」,然后开始 考古 。

先在飞书里搜关键词,出来七八个同名文件,不知道哪个是最新的。再翻语雀,没有。回去翻群聊记录,往上刷三百条,终于看到一个链接,点开, 权限申请还挂着 。

四十分钟后,终于拿到手了,那份文档当初花了 两个人两周 才写出来。

它其实一直在那儿,只是没人找得到,这个问题,几乎每家都会遇到。这事有个正经名字,叫 知识管理 。过去两年的主流解法是 RAG,把文档喂给大模型,模型回答之前先去文档里把相关的几段捞出来,再照着捞出来的内容作答。

方向是对的,但难的是 做完整 。所以开源社区里做 RAG 的项目一抓一大把,真能愉快地跑起来的却没那么多。

腾讯开源了一个LLM 知识管理框架 WeKnora (维娜拉)瞄准的就是企业里的文档理解、语义检索和推理这几件事。

这个项目的能力,拆开看有三层。

最底下是 RAG 问答 ,你有问题,它去知识库里捞答案。中间是 ReAct Agent ,碰到复杂问题,它会自己拆步骤,该检索就检索,该调工具就调工具,还能调沙箱执行命令和脚本。最上面是 Wiki 模式 ,Agent 去读你的原始文档,把它重写成一套相互链接的 Markdown 知识页面。

它擅长解决的三件麻烦事:

第一件,文档散在十个地方,先把东西收进来,还得搜得准。

飞书知识库、飞书云盘、GitLab、Notion、语雀、RSS 订阅,都能挂上去 自动同步 。格式覆盖 PDF、Word、Excel、PPT、图片等十几种,传文件夹时会保留你原来的目录结构,侧边栏就是一棵树,能重命名,也能把文档挪到别的文件夹里重新归档。

检索上,比较少见的一点是,切完之后的分块你能 直接在界面上改 ,每次修改留一个 版本快照 ,能看 diff 能回滚,改完自动重建索引。检索不准的时候,问题经常就出在某一段切歪了,以前只能干瞪眼,现在能上手改对。

第二件,AI 开始知道你们公司的事了。

WeKnora 让模型每次回答之前先去你的文档里找答案,回答里 带引用 ,鼠标移上去能看来源,还会标出这条引用来自网络搜索还是来自你的知识库。

除了回答问题,它还能自己拆步骤干活。0.8.0 版本把技能做成了空间级的技能目录,从 ClawHub 或 GitHub 装,也能传 zip 包。

它还有一层跨会话的 长期记忆 ,能记住你是谁、你常问什么,抽出来的记忆要你点过才算数。

第三件,知识能自己长成体系。

这是 Wiki 模式 。Agent 去读你上传的原始文档,整理成结构化的、互相链接的 Markdown 页面,页和页之间能跳转,再配一张可视化的 知识图谱 ,能看出段落之间的关联。

而且它生成完还会接着管。Wiki 页面在浏览器里能 直接编辑 ,每次改动留版本历史,支持行级 diff 和 一键回滚 ,理解成 AI 先草拟一版,你作为人来审、来改、来定稿。

怎么跑起来:

装好 Docker(带 Compose)和 Git, 就这么几行 。

...bash


git clone https://github.com/Tencent/WeKnora.git

cd WeKnora

cp .env.example .env

docker compose pull

docker compose up -d

起来之后访问 http://localhost 就是界面。想要知识图谱、对象存储、链路追踪这些附加能力,加个 profile 就行。

用起来也简单。

先把模型配上,OpenAI、Claude、DeepSeek、Qwen、Ollama 这些主流厂商都支持,也可以走 LiteLLM 用一个网关对接一堆上游。然后 建知识库 ,拖文件、传文件夹、挂数据源都行。接着等解析,进度按阶段可视化出来。最后开问,日常查东西用快速问答,复杂任务切到 Agent 模式,想让它自己整理知识就开 Wiki。

知识库建好之后还能接到 企业微信、飞书、Slack 这些聊天工具里,同事不用再打开一个后台,在群里就能问。它还有官方的 MCP Server,让别的 Agent 也能查你的知识库。

最后说两句。

回到开头那份文档。它从写出来的那天起,就跟周围的上下文散了伙,躺在某个角落,没人知道它在,也没人能问它。WeKnora 想干的事,就是把 散了伙的东西重新聚起来 。

需要注意的是,如果只是想给自己存点笔记,Notion 就够了。但如果你的团队正在被文档淹没,每次找东西都要考古一遍,那这个项目值得去尝试一下 。