智库项目面向客服人员,实现非结构化文档(如PDF、Markdown、Word)的导入与知识库构建,支持用户通过自然语言提问获取带有引用依据的答案。
1. 基于Markdown标题与语义信息进行文本切分,确保语义完整性
2. 采用BGE-Large-zh模型生成密集向量与稀疏向量,实现语义检索与关键词检索的兼容
3. 对问题进行产品名称相关的重写处理,消除提示词中的歧义
4. 构建包含Query向量检索、HyDE假设性问题生成与Web Search的多路召回体系(MCP)
5. 通过RRF与Reranker进行精排序,提升答案生成的准确性
6. 引入LLM-as-Judge机制,结合RAGAS评估框架,保障检索与生成质量
需求方专属客服,免费梳理匹配