RAG在企业落地的难点与创新

会议室:黄山厅
出品人:周景博 博士

近年来,大型语言模型(LLMs)在语言理解与生成方面展现了革命性能力,但仍面临诸... 展开 >

专题出品人:周景博 博士

百度研究院商业智能实验室负责人

现任百度研究院商业智能实验室负责人和资深研究员。他于2014年在新加坡国立大学计算机学院获得博士学位,并于2015年底起加入百度研究院。他参与并支持了公司多项重量级大模型项目的研发与落地工作,包括全球首个AI原生地图产品—百度地图AI向导、智慧城市政务大模型应用、多模态生物计算大模型等。此外,他曾主持和参与多项国家级科研课题项目,并在 KDD、SIGMOD、ACL、ICDE、AAAI 等顶级学术会议和 Nature Machine Intelligence、Nature Sustainability、TKDE 等期刊上发表了50余篇论文。

地点:黄山厅

专题:RAG在企业落地的难点与创新

近年来,大型语言模型(LLMs)在语言理解与生成方面展现了革命性能力,但仍面临诸多固有局限,如幻觉现象和知识更新的时效性等问题。检索增强生成(Retrieval-Augmented Generation,RAG)技术通过提供可靠且最新的外部知识,有效提升了LLM的输出质量,极大地便利了各类任务,并对多个行业产生了日益显著的影响。随着RAG技术的持续进步和应用领域的扩展,其在企业实际落地中所面临的局限性与技术挑战也逐渐显现,亟需进一步的探索与改进。本次专题将深入探讨RAG及相关框架在企业应用中的难点与创新实践,拓展RAG技术在不同领域中的应用维度。

by 夏源

百度
灵医大模型底座技术负责人

在医疗健康领域,RAG(检索增强生成)是大模型应用的重要方向。它有效缓解了部分大模型幻觉、信息更新时效性等问题,能够提升大模型在医学知识库问答的效果。然而,在实际应用中,我们发现 RAG 仍存在一些挑战,如文档解析结构理解、大模型生成幻觉、复杂医学问题难以解答等。

在本次演讲中,我将分享针对这些问题的解决方案,希望为大家带来启发和思考。

演讲提纲:

  1. RAG技术背景及应用场景
  2. RAG内容理解和建设
  3. RAG检索排序优化
  4. RAG大模型推理能力优化
  5. 案例分享与未来展望

听众收益:

  • 了解百度灵医大模型RAG在医疗健康领域的问题和解决方案
  • 掌握优化大模型RAG在企业的实践的经验和教训,学习内容建设和检索优化的最佳实践

by 尹一峰

Hugging Face
Machine Learning Engineer

RAG 要不要做语义检索,有很多讨论,还没有定论。我将深入探讨基于语义搜索(Semantic Search)的 RAG 系统的重要性,揭示它为何在当前技术背景下被严重低估。我也将分析语义搜索的本质及其在RAG系统中的关键作用,并分享如何基于这一本质设计出高效的系统架构。此外,演讲还将讨论KG驱动的RAG系统,并指出它并非适用于所有数据类型,帮助听众理解如何根据不同的数据特性选择最合适的 RAG 范式。

演讲提纲:

  1. RAG 简史
  2. Semantic Search 为什么看上去像是要被淘汰
  3. Semantic Search 到底是在做什么
  4. Semantic Search based RAG系统设计
  5. KG RAG 简介
  6. 什么样的数据适合KG?什么样的数据适合Semantic search
  7. 总结展望

听众收益:

  • 如何设计出更有效的 RAG 系统
  • 根据自己的数据和系统,该如何选择 RAG 范式

 

by 田昕晖

火山引擎
技术专家

RAG 是一种消除大模型幻觉以及增强大模型专业领域理解能力的有效方法,目前在很多生成式 AI 产品中已经得到广泛应用。当前 RAG 的构建方式呈现多样化发展,对底层数据引擎提出很多新的挑战。本次演讲将重点探讨如何在云原生数据仓库架构中设计和实现 RAG 相关技术,并介绍一些复杂 RAG 场景中的应用和实践经验。

演讲提纲:

  1. RAG 概念及相关技术分析
    • 常用 RAG 技术介绍 
    • RAG 场景下数据引擎面临挑战
  2. 向量检索技术进展
    • 向量检索基本概念
    • 云数仓架构中高效向量检索的算法与实现方案
  3. 全文检索技术实现
    • 全文检索基本概念
    • 云数仓架构中高效全文检索设计与实现
  4. 混合检索技术设计与实现
    • 混合检索概念及常用算法介绍
    • 云数仓架构中混合检索设计与实现
  5. 其他 RAG 相关技术尝试

听众收益:

  • 了解当前 RAG 场景针对数据引擎的技术需求分析
  • 了解云原生数据仓库在向量检索计算、全文检索和混合检索技术实践
     

by 费跃

阿里云
高级技术专家

检索增强生成(RAG)已成为生成式AI产品中的主流应用。然而,构建企业级的RAG系统仍然面临诸多挑战。首先,应用场景多样化:系统需支持处理结构化和非结构化文档,满足多模态问答需求,并整合不同工具,以适应多种业务场景。其次,系统优化难题:文档解析、文本切分、查询改写、检索优化、重排序、生成等多个算法模块需要高效协同,以提升整体性能。最后,企业级能力集成:RAG系统需具备高可扩展性、良好的可观测性,并支持知识库的持续迭代与更新。

在本次演讲中,我将分享阿里云PAI团队在构建企业级RAG服务方面的设计理念与实践经验,希望与大家共同探索、持续进步。

演讲提纲:

  1. RAG 技术背景
  2. 企业级 RAG 落地面临的挑战
  3. 模块化 RAG 架构介绍
  4. RAG 核心模块优化策略
  5. 企业级 RAG 能力集成
  6. 案例分享

听众收益:

  • 了解阿里云人工智能平台 RAG 产品的架构落地过程
  • 企业级 RAG 落地过程中的经验和思考

by

研讨话题:

  1. 在RAG场景中,数据引擎的检索能力还有哪些潜在的改进空间?
  2. 未来,检索技术与大型语言模型(LLM)的结合将如何进一步发展?
  3. 除了RAG,还有哪些方法可以减少大型语言模型的幻觉问题并提高回答的准确性?
  4. 多模态技术的发展将如何为RAG带来新的机遇?
  5. 目前检索和生成模块相对独立,如何更有效地整合检索器和LLM?
  6. RAG对于O1类推理模型的意义何在?
  7. 在Transformer时代之后,RAG将如何演进?
  8. 最近市面上出现了很多开源类的RAG类产品,如何看待这类产品的竞争力,以及他们未来的商业模式?
  9. 未来RAG,是否有希望发展成类似像数据库一样的独立基础设施?

交通指南

北京丰大国际大酒店

Beijing Fengda International Hotel
地址:北京市大兴区荣华中路20号
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

领取往期热门演讲视频

领取往期热门演讲视频二维码
如您在购票过程中遇到问题,请扫码咨询票务小助手