吴锐-面向智能研发的知识引擎.pdf
1、面向智能研发的知识引擎面向智能研发的知识引擎构建及业务应用构建及业务应用演讲人:吴锐目录目录01020304智能研发现状构建研发知识引擎落地案例未来趋势分析01智能研发现状AIAI CodingCoding 百花齐放百花齐放多样的形式多样的形式不同的设计不同的设计丰富的生态丰富的生态业务落地的“最后一公里”业务落地的“最后一公里”隐藏在代码外的业务知识业务专家经验、业务规则、业务黑话存量代码的复杂性10w+行的代码仓库、复杂设计模式复杂的系统间依赖跨系统调用、复杂的包依赖内部研发知识的匮乏常见的中间件的接入方式02构建研发知识引擎架构设计架构设计常用知识中间件库产研通用知识产研通用知识精品数据
2、资产核心应用代码需求/系分文档业务知识业务知识产研规范日常小记个人知识个人知识聊天/会议记录个人语雀文档/ATA知识解析与存储知识解析与存储智能解析统一知识管理多数据源接入知识理解知识理解ChunkingEmbeddingLinkingKG构建通识导入业务知识图谱个人知识图谱知识生产知识生产个人Wiki业务Wiki编码rules业务代码示例冲突检测过时文档发现孤岛发现知识治理知识治理MCP/OpenAPI知识检索快速问答知识召回知识召回Query处理多路召回DeepSearch多模态检索模型训练模型训练RLSFTRerank图检索知识引擎的必要性1.深度理解、高效管理存量业务知识,让AI读懂现
3、有业务,降低生成代码的幻觉率2.挂载企业内部私有的中间件文档与规范,填补通用模型的认知空白3.提供准确、快速的检索能力,在有限上下文内提供关键信息,降低模型理解门槛知识索引与检索知识索引与检索-Chunking 结构化分割-索引-检索解耦-知识粒度对齐(HyDE)-QA 挖掘-文档标签与优先级部分关键优化点:基础检索能力:朴素基础检索能力:朴素RAG知识索引与检索知识索引与检索进阶检索能力:进阶检索能力:GraphRAG优势:1.依赖Node 和Edge 进行结构化的信息关联,有效地扩大检索范围,提升召回率2.前置进行了信息的归纳与总结,面对全局性问题效果更好劣势:1.依赖模型抽取三元组,导致





点击查看更多