目前负责字节数据平台大模型应用效果评估团队,主导了数据应用Agent 的评测体系建设,覆盖从数据开发到数据应用的多个业务场景,在大数据技术、自动化评测算法、评估平台搭建等方面有丰富实践经验。曾就职于微软、阿里巴巴。

目前负责字节数据平台大模型应用效果评估团队,主导了数据应用Agent 的评测体系建设,覆盖从数据开发到数据应用的多个业务场景,在大数据技术、自动化评测算法、评估平台搭建等方面有丰富实践经验。曾就职于微软、阿里巴巴。
在大模型技术飞速发展的当下,大数据领域的各类应用如雨后春笋般涌现,从数仓开发到ChatBI问数,再到深度分析 Agent,这些领域的大模型应用极大地提升了数据处理和分析的效率。但与此同时,如何科学、准确地评估这些应用的效果,成为了行业面临的重要难题。
作为字节跳动数据平台的大模型效果评估团队,我们深耕数据应用Agent 领域,构建了覆盖从数据开发到数据应用垂直领域Agent应用的评测技术体系,尤其在自动化评测算法、Agent 级评测框架等方面形成了可落地的技术方案。本次分享将聚焦这一领域的技术细节与实践经验。
演讲提纲:
听众收益:



微信咨询

电话咨询
微信联系我们

