生成式大模型的内容安全挑战与实践

所属专题:大模型安全性实践

嘉宾 : 梁堃 | 北京数美时代科技联合创始人兼 CTO

会议室 : 钻石厅 C

讲师介绍

专题演讲嘉宾:梁堃

北京数美时代科技联合创始人兼 CTO

北京大学计算机硕士,人工智能领域专家。先后在百度、小米担任高级工程师、架构师等职位。拥有多年机器学习、人工智能、风控体系及平台建设、风控算法实践经验。

议题介绍

演讲:生成式大模型的内容安全挑战与实践

随着大模型技术的进步与发展,尤其是以 GPT-4o 为代表的多模态大模型,在交互能力和生成内容上突破不断,由此也带来更加复杂多变的内容风险,不同内容模态的自由组合让内容审核难度加剧,在技术和成本上都面临巨大的挑战。同时在监管政策的要求下,大模型厂商必须旋紧内容合规的阀门,才能安全可持续发展。本次分享讲结合当前的监管环境及大模型平台的属性,介绍已经落地应用到大模型内容安全领域的技术实践以及未来需要深耕的方向。

演讲提纲:

  1. 1.多模态AIGC场景下内容审核的特点
    • 情感语义识别要求高
    • 违规类型不可预测
    • 模型价值观构建难
    • 时效性要求高
  2. 用 AI 治理 AI,突破 AIGC 内容审核的难点
  3. 匹配业务流程,做好内容审核的关键三步
    • 语料筛选
    • 用户输入
    • 模型输出
  4. 总结与展望

听众收益:

  • 了解大模型内容治理的技术体系
  • 学习模型对抗的底层技术要点
  • 了解内容治理未来需要深耕的技术方向

交通指南

上海中谷小南国花园酒店

China Grain Hotel
地址:上海市杨浦区佳木斯路777号(近营口路口)
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手