某大型律所拥有超过10万份合同文书、法规文件及内部制度文档,律师在查找历史案例与条款引用时平均耗时45分钟,效率极低且容易遗漏关键信息。传统的关键词全文检索无法理解语义,也无法处理跨文档的复杂关联问题。为解决这一痛点,我们立项构建基于大语言模型的RAG(检索增强生成)智能问答平台,让律师能够用自然语言直接提问,系统秒级返回精准答案并附原文出处引用。该平台同时服务于新员工培训场景,大幅降低制度学习成本。
点击空白处退出提示
某大型律所拥有超过10万份合同文书、法规文件及内部制度文档,律师在查找历史案例与条款引用时平均耗时45分钟,效率极低且容易遗漏关键信息。传统的关键词全文检索无法理解语义,也无法处理跨文档的复杂关联问题。为解决这一痛点,我们立项构建基于大语言模型的RAG(检索增强生成)智能问答平台,让律师能够用自然语言直接提问,系统秒级返回精准答案并附原文出处引用。该平台同时服务于新员工培训场景,大幅降低制度学习成本。
核心功能模块包括:
1、多格式文档解析入库:支持PDF、Word、扫描件OCR识别,自动切分语义段落并生成向量索引;
2、混合检索引擎:结合BM25关键词检索与向量语义检索,通过bge-reranker重排序模型二次精排,Top-K召回准确率达92%;
3、智能问答对话:支持多轮上下文追问,回答自动附带原文段落级引用链接,可一键跳转验证;
4、权限分级体系:按部门/角色控制可见文档范围,敏感合同仅限授权人员查询,所有问答记录留痕审计;
5、管理后台:支持文档批量上传、知识库分类管理、热门问题统计、模型回复质量人工标注反馈闭环。
日均承载3000+次查询,P95响应时间1.4秒,回答准确率89%。
本人独立承担整体架构设计与全部核心开发工作。
技术栈:Python + LangChain + Qdrant向量数据库 + FastAPI + PostgreSQL + Redis + Vue3 + Ollama本地化部署Qwen2.5-72B + vLLM推理加速 + Docker容器化 + MinIO对象存储。
架构亮点:采用混合检索(BM25+向量)双通道召回策略解决纯语义检索对专业术语召回不足的问题;引入rerank精排层将准确率从68%提升至89%;针对律所数据敏感性要求,全部模型私有化部署,杜绝数据外泄风险;设计增量索引更新机制,新文档入库后30秒内可被检索。
难点攻克:长文档切分策略优化(按语义边界而非固定token数),显著改善了跨段落的引用准确性;实现流式输出(SSE)提升用户体感响应速度。



评论