vivo 蓝心大模型端侧轻量化部署的创新路径

所属专题:大模型架构创新与端侧智能落地实践

嘉宾 : 章苏迟 | vivo AI 研究院高性能计算工程师

会议室 : 上海厅

讲师介绍

专题演讲嘉宾:章苏迟

vivo AI 研究院高性能计算工程师

于 vivo AI 研究院任职,主要从事 AI 高性能计算方向,负责 NN 网络在移动端的部署与性能优化,在 CPU、GPU、DSP 指令集优化和 AI 推理框架设计上有丰富经验,是 vivo 端计算解决方案 VCAP 的主力开发之一。当前正在负责 AI 大模型在移动端的部署与优化,解决大模型落端的性能和功耗问题,打造行业领先的端侧大模型能力。

议题介绍

演讲:vivo 蓝心大模型端侧轻量化部署的创新路径

业内 AI 大模型正在飞速发展,近年来,行业内不断涌现各种十亿,百亿,千亿级别的大模型,在各个领域均展现了强大的能力。而智能手机作为拥有最大用户数量的终端设备,正成为大模型实现个性化场景与服务的核心载体。然而想在移动端有限的硬件资源上部署参数量庞大的大模型,其性能,内存,功耗均面临着严峻的挑战。

本次演讲将从 vivo 已上线的业务场景出发,深度剖析大模型落端过程中的核心瓶颈问题及其对应的解决方案,包含模型参数规模选择,性能 / 内存 / 功耗技术指标的优化等多个方面。

演讲提纲:

  1. AI 业务端侧化相关背景
  2. vivo 大模型端侧化业务场景介绍
  3. 大模型端侧化瓶颈问题与解决方案
    • 大模型端侧化核心瓶颈指标
    • 端侧大模型参数规模选择
    • 端侧大模型性能/内存/功耗优化方案
    • 针对不同任务类型的业务场景如何定制优化策略
  4. 未来展望

听众收益:

  • 大模型落端过程中有哪些技术难点,如何克服
  • 了解 vivo 在支撑业务场景良好体验的一些思考

交通指南

上海中优城市万豪酒店

Shanghai Marriott Hotel Pudong South
地址:上海市浦东新区沪南公路7688弄1号
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手