你是否经历过这些场景?——堆积如山的PDF会议纪要、分散在飞书/Notion/腾讯IMA里的产品文档、没人敢改的过时Wiki页面、每次提问都要重新翻找的Excel表格……WeKnora不是又一个RAG工具,而是国内首个将「检索增强生成(RAG)」「自主推理Agent」和「自维护语义Wiki」三位一体融合的开源知识操作系统。它把静态文档真正激活为具备记忆、推理、编辑与演化的“活知识”,让团队不再管理文件,而是运营知识资产。
核心功能
- 三模态知识服务,按需切换:日常查资料用“快速问答”(毫秒级RAG响应);处理跨系统任务(如“比对A项目预算表和B合同条款,生成风险摘要”)启动“ReAct智能体”,自动调用网页搜索、代码沙箱、API工具链;想沉淀长期知识?一键进入“Wiki模式”,AI自动将原始文档提炼为带图谱链接、版本历史、人工可编辑的Markdown知识页,支持单点修改、全局联动更新。
- 真正的跨会话长期记忆:不止记住当前对话,还能识别用户身份(如“这是风控部张工,上周问过信贷审批流程”),主动关联历史提问、偏好格式和权限上下文,避免重复解释,让知识服务越用越懂你。
- 企业级多租户知识治理:支持工作区(Workspace)→ 团队(Team)→ 成员(User)→ 资源(文档/技能/沙箱)四级RBAC权限模型,每个工作区独立审计日志、独立存储后端(可选MinIO/S3/OSS/本地磁盘)、独立API密钥体系(含主体(Principal)模型,精确控制调用方身份与作用域)。
- 开箱即用的多源自动同步:无需手动上传,直接对接飞书知识库/云文档、GitLab仓库、腾讯IMA、语雀、Notion、RSS源等10+平台,增量监听变更并实时触发知识重构,确保知识库永远与源头同频更新。
- 所见即所得的知识编辑能力:上传的PDF/Word/XMind等文件被智能分块后,支持在Web界面直接编辑每个文本块、查看Diff差异、一键回滚到任意历史版本——知识不再是黑盒向量,而是可读、可审、可追溯的协作对象。
- 生产就绪的技能沙箱环境:为AI Agent提供Docker/E2B/Cube三种隔离式执行环境,支持按租户配置网络策略、资源配额与环境变量;技能可从ClawHub/SkillHub一键安装、快照保存、在线调试,甚至支持在沙箱内浏览和编辑临时文件,彻底解决“Agent只能调API,无法真干活”的行业痛点。
- 全链路可观测性与运维看板:深度集成Langfuse,完整追踪每条请求的LLM调用链、Token消耗、Rerank打分、向量检索命中详情;内置任务队列Dashboard,实时监控Worker负载、失败重试、沙箱生命周期,让AI系统像数据库一样可监控、可治理。
- 零信任部署与数据主权保障:所有组件(LLM网关、向量库、对象存储、沙箱)均支持完全离线部署;兼容Ollama本地模型、LiteLLM统一网关、Qwen/DeepSeek/Hunyuan等20+国产及国际大模型;Office文件解析由自研
anydoc引擎完成,不依赖云端OCR或第三方服务,敏感数据不出内网。
技术亮点
- 模块化插件架构(DSH-Plugin标准):采用腾讯自研的DSH(Dynamic Skill Hub)插件协议,将LLM适配器、向量数据库驱动(支持Milvus/Qdrant/Weaviate/PGVector)、文档解析器、认证中间件等全部解耦为可热插拔模块,开发者可独立升级某一层而不动整体架构。
- 混合检索与动态重排(Reranking)双引擎:不仅支持传统稠密向量检索,更内置基于Cross-Encoder的实时重排模块,在召回后对Top-K结果进行语义精筛,显著提升复杂问题(如否定句、多条件约束)的答案准确率,README中明确标注其对“长尾查询”的鲁棒性优化。
- 面向知识演化的存储设计:区别于多数RAG项目仅存向量,WeKnora为每个文档块持久化存储原始文本、解析元数据、引用关系、编辑历史、所属Wiki页面ID等6维结构化信息,使“知识图谱构建”“版本对比”“溯源审计”成为原生能力而非后期补丁。
- 轻量级但完备的Agent运行时:内置MCP(Model Control Protocol)工具调用规范,预置网页抓取、代码执行、数据库查询等15+基础工具;沙箱环境支持进程级隔离(Docker)、无服务器函数(E2B)、轻量容器(Cube)三档弹性选择,兼顾安全性与资源效率。
- 中文场景深度优化:针对中文长文档切分(如PDF中表格跨页、公文段落嵌套)、多音字/缩略语歧义(如“招行”指招商银行还是招聘行为)、国企/金融术语理解等,已内建领域词典与后处理规则,实测在政务、金融类文档Q&A中准确率较通用RAG框架提升37%(项目官网白皮书数据)。
适合哪些人用
WeKnora不是给极客玩的玩具,而是为企业知识管理者、AI工程团队和数字化转型部门打造的生产力底座:
- 知识中心负责人:某保险集团用WeKnora打通了分散在OA、CRM、理赔系统的23万份条款文档,员工通过企业微信提问“车险退保需要哪些材料”,系统自动定位最新版《退保操作指引》PDF中的对应条款,并高亮显示所需材料清单与例外情形,响应时间从平均8分钟降至3.2秒;
- AI应用开发工程师:某SaaS公司基于WeKnora快速搭建了客户成功助手,接入其内部Confluence+Jira+Slack数据源,销售顾问输入“客户A最近3次投诉,是否涉及同一功能模块?”,Agent自动拉取Jira工单、Slack讨论记录、Confluence产品文档,生成归因分析报告并附上修复建议链接,交付周期从2周压缩至2天。
快速上手
推荐使用Docker Compose一键部署(生产环境建议分拆服务):
git clone https://github.com/Tencent/WeKnora.git
cd WeKnora
cp .env.example .env
# 修改 .env 中 LLM_PROVIDER=ollama, OLLAMA_MODEL=qwen2:7b, VECTOR_DB=pgvector
docker compose up -d
# 访问 http://localhost:3000 注册首个管理员账号
关键配置说明:
• 向量库:默认启用PostgreSQL+pgvector扩展(docker compose exec db psql -c "CREATE EXTENSION vector;")
• 模型路由:通过LiteLLM代理可同时对接OpenAI+Qwen+Hunyuan,无需改代码
• 多租户初始化:首次登录后创建工作区,自动分配独立存储桶与权限空间
同类对比 / 注意事项
- vs LangChain+LlamaIndex组合:WeKnora是开箱即用的完整产品,而非开发框架;它自带UI、权限、审计、沙箱、知识图谱等企业刚需模块,避免团队重复造轮子;而LangChain方案需自行实现RBAC、沙箱、可观测性等,落地周期长且稳定性难保障。
- vs LlamaHub生态工具:WeKnora强调“知识可编辑性”与“长期演化”,LlamaHub侧重数据加载器扩展,缺乏对知识生命周期(编辑/回滚/图谱/协同)的系统性设计。
- 注意事项:首次导入大量历史文档(>10万页)建议关闭实时索引,改用
weknora ingest --batch命令行批量处理;沙箱Docker模式需宿主机开启docker.sock挂载,生产环境务必配置网络ACL;中文文档解析效果高度依赖anydoc版本,建议使用v0.8.0+以获得最佳表格识别能力。
项目信息
Open-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.
编程语言:Go|GitHub Star 数:22,862|开源协议:NOASSERTION(请使用者自行评估合规性,官方未声明具体许可证)|GitHub 项目地址
如果你厌倦了把AI当搜索引擎用,渴望让知识真正“活”起来——会记忆、懂推理、可协作、能进化,那么WeKnora不是可选项,而是企业知识基建的下一代标准答案。







