智源行业数据集及训练方法落地实践

所属专题:大模型数据集构建及评测技术落地

嘉宾 : 周华 | 智源研究院大模型行业应用总监

会议室 : 钻石厅 A

讲师介绍

专题演讲嘉宾:周华

智源研究院大模型行业应用总监

专注人工智能、云计算和大数据相关 IT 技术领域 20 余年,现任北京智源人工智能研究院大模型行业应用总监,主要负责面向行业应用的人工智能大模型技术研究、行业数据研究和人工智能数据平台集成开发,主导形成研究院行业模型训练范式和行业数据集构建模式研究成果,并致力于推进人工智能大模型的规模化产业落地应用。

议题介绍

演讲:智源行业数据集及训练方法落地实践

近年来,闭源大语言模型(LLMs)和开源社区在通用领域取得了显著进展,甚至在某些方面超越了人类。然而,在医学、政务等专业领域,语言模型的表现仍然不足。

面对决这些挑战,智源研究院致力于推进人工智能大模型在行业应用方向上的最后一公里进程,通过行业合作伙伴联合实验室机制,基于行业数据集构造和示范模型训练实践,提出了数据集构建技术体系,以及包含持续预训练、监督微调(SFT)以及强化学习(RLHF)技术的完整行业模型训练范式,获得了良好的模型性能效果,在大模型行业应用的落地方面为从业者和用户提供有益的参考。

演讲提纲:

  1. 人工智能大模型在行业落地发展的概括和问题分析
  2. 智源研究院在大模型行业落地方面的工作思路和研究方向
  3. 行业数据集构建方法
  4. 行业模型训练范式
  5. 实践案例经验分享1:Aquila-Med 示范模型的数据集构建和模型训练
  6. 实践案例经验分享2:Aquila-SQL 模型的训练和应用
  7. 总结与展望

听众收益:

  • 企业内部大模型构建的方法
  • 行业大模型训练的技术经验
  • 数据处理的方法和技术体系

交通指南

上海中谷小南国花园酒店

China Grain Hotel
地址:上海市杨浦区佳木斯路777号(近营口路口)
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手