智策 — 企业级RAG智能知识库问答平台产品系统Vibe Coding

我要开发同款
proginn16085915992026年08月23日
6阅读

技术信息

语言技术
PythonKafkapostgresDockerRedis
系统类型
算法模型Web
行业分类
企业服务人工智能

作品详情

行业场景

某大型律所拥有超过10万份合同文书、法规文件及内部制度文档,律师在查找历史案例与条款引用时平均耗时45分钟,效率极低且容易遗漏关键信息。传统的关键词全文检索无法理解语义,也无法处理跨文档的复杂关联问题。为解决这一痛点,我们立项构建基于大语言模型的RAG(检索增强生成)智能问答平台,让律师能够用自然语言直接提问,系统秒级返回精准答案并附原文出处引用。该平台同时服务于新员工培训场景,大幅降低制度学习成本。

功能介绍

核心功能模块包括:
1、多格式文档解析入库:支持PDF、Word、扫描件OCR识别,自动切分语义段落并生成向量索引;
2、混合检索引擎:结合BM25关键词检索与向量语义检索,通过bge-reranker重排序模型二次精排,Top-K召回准确率达92%;
3、智能问答对话:支持多轮上下文追问,回答自动附带原文段落级引用链接,可一键跳转验证;
4、权限分级体系:按部门/角色控制可见文档范围,敏感合同仅限授权人员查询,所有问答记录留痕审计;
5、管理后台:支持文档批量上传、知识库分类管理、热门问题统计、模型回复质量人工标注反馈闭环。
日均承载3000+次查询,P95响应时间1.4秒,回答准确率89%。

项目实现

本人独立承担整体架构设计与全部核心开发工作。
技术栈:Python + LangChain + Qdrant向量数据库 + FastAPI + PostgreSQL + Redis + Vue3 + Ollama本地化部署Qwen2.5-72B + vLLM推理加速 + Docker容器化 + MinIO对象存储。
架构亮点:采用混合检索(BM25+向量)双通道召回策略解决纯语义检索对专业术语召回不足的问题;引入rerank精排层将准确率从68%提升至89%;针对律所数据敏感性要求,全部模型私有化部署,杜绝数据外泄风险;设计增量索引更新机制,新文档入库后30秒内可被检索。
难点攻克:长文档切分策略优化(按语义边界而非固定token数),显著改善了跨段落的引用准确性;实现流式输出(SSE)提升用户体感响应速度。

示例图片

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论