微信开源知识库 WeKnora 上生产前,运维要过的四道关

举报
yd_272633676 发表于 2026/09/25 21:50:48 2026/09/25
【摘要】 WeKnora 本地部署生产化实录:资源规划、模型选型、入库质量、运营反馈四道关的实战经验

WeKnora(微信刚开源的知识库 RAG 系统)上手很快,docker-compose 一把就能跑起来。但从「我本机能跑」到「敢放公司内网给同事用」,中间隔着几道坎。周末完整走了一遍,把生产化要过的四道关整理给同病相怜的运维同学。

第一道:资源关——解析服务是内存大户

默认 compose 配置在小机器上必翻车:文档解析服务会把大 PDF 整个读进内存。给解析服务显式加内存限制+调小批处理是第一步。我们的经验值:8G 机器稳跑 20 人内网规模,16G 可以放开并发。embedding 模型如果本机部署,再按模型大小加 2~4G 预算。

第二道:模型关——embedding 决定上限

默认模型配置是「能跑」档。中文企业文档场景,embedding 换中文优化版(bge 系)后召回质量立上一个台阶——这步零成本,只有十分钟配置,是所有调优里性价比最高的一步。LLM 侧按公司合规要求选:内网私有化部署 or 走内部 API 网关。

第三道:数据关——入库质量决定一切

表格 PDF 直接解析出来是碎片,双栏论文更惨。入库前统一预处理:表格转 Markdown、扫描件过 OCR、按文档类型分块(手册按标题层级、FAQ 按问答对、长文按语义段)。检索效果差的问题,八成根因在入库而不是检索参数——这个认知能帮你省掉大半无谓的调参时间。

第四道:运营关——没有反馈闭环的 RAG 都是 demo

上生产最容易被忽略的:用户点了「没找到答案」的 query 要落日志。每周看一次这些坏例,要么补文档、要么调分块——知识库是养出来的,不是建完就完的。WeKnora 自带的对话日志导出够用,配个 cron 周报就能转起来。

结语

四道关过了,WeKnora 在内网环境就是个能打的生产级知识问答。私有化部署的价值不只是数据不出门——外文技术文档灌进去配翻译工具,整个资料库变成中文可问答的,这个组合技我们实测很香。

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0)

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。