2019年毕业于北京大学。目前主要研究领域包括自然语言处理及多模态表征学习,侧重于多模态预训练及其应用,曾在自然语言处理、机器学习等领域以第一作者和共同作者的身份在多个顶级会议,包括ACL、KDD、EMNLP、NeurIPS、ICML等发表30余篇论文,引用量近800。曾打造全球最大规模的十万亿参数多模态预训练模型M6,广泛应用于下游应用如图像生成、自然语言生成、跨模态检索等,并研究大模型的低碳训练、提示学习、轻量化应用等问题。M6服务化平台在集团内部服务40余个业务场景,包括但不限于服装设计、自动文案生成、搜索推荐、自动驾驶等,日均调用量超5亿,推动预训练大模型的商业化落地及普惠AI的发展。







