大模型安全性实践

会议室:钻石厅 C
出品人:郑亮

本次论坛旨在汇聚行业专家、学者、企业代表以及政策制定者,共同探讨和分享大模型在安... 展开 >

专题出品人:郑亮

蚂蚁集团安全生态风险运营部 总经理

全面引领蚂蚁集团安全生态系统构建与风控运营管理,深耕蚂蚁安全科技及产品创新领域,专注于安全科技的生产、研发、算法生态体系建构及战略合作。率团队在资金安全、数据安全、内容安全等关键生态风险领域发挥主导作用,通过高效对抗与精细化运营策略,对平台生态及业务健康发展负责。

地点:钻石厅 C

专题:大模型安全性实践

本次论坛旨在汇聚行业专家、学者、企业代表以及政策制定者,共同探讨和分享大模型在安全和价值观对齐方面的最新研究成果、挑战和解决方案。

by 冯景辉

百度
安全平台 副总经理

大模型以其更智能、不确定和不可解释的特点,给安全领域,尤其是内容安全带来了更大的挑战。百度在打造文心一言之初就意识到,传统的内容审核技术无法从根本上满足大模型内容安全的需求。因此,我们必须从头开始构建一套全新的方法。本次分享聚焦于百度在过去两年中在大模型内容安全领域遭遇的挑战和问题,以及我们尝试的解决思路和应对方法进行阐述,包括数据清洗、内生安全与安全对齐、安全围栏建设,以及应用安全与基础模型安全等方面。

演讲提纲:

  1. 大模型安全在全生命中期中遇到的挑战
    • 训练阶段的挑战
    • 运营阶段的挑战
  2. 为什么要构建大模型原生安全?
    • 内生安全主要技术
    • 百度在安全围栏建设上的经验
  3. 如何构建应用安全
    • 应用安全于基础模型内容安全边界
    • 应用安全要关注的几个主要问题
    • 应用防火墙构建
  4. 总结与展望

听众收益:

  • 了解大模型内容安全面临哪些问题,以及监管要求
  • 了解国际最先进的大模型内生安全于安全围栏构建技术方法
  • 了解AI智能体开发时应该如何关注安全,避免风险

by 梁堃

北京数美时代科技
联合创始人兼 CTO

随着大模型技术的进步与发展,尤其是以 GPT-4o 为代表的多模态大模型,在交互能力和生成内容上突破不断,由此也带来更加复杂多变的内容风险,不同内容模态的自由组合让内容审核难度加剧,在技术和成本上都面临巨大的挑战。同时在监管政策的要求下,大模型厂商必须旋紧内容合规的阀门,才能安全可持续发展。本次分享讲结合当前的监管环境及大模型平台的属性,介绍已经落地应用到大模型内容安全领域的技术实践以及未来需要深耕的方向。

演讲提纲:

  1. 1.多模态AIGC场景下内容审核的特点
    • 情感语义识别要求高
    • 违规类型不可预测
    • 模型价值观构建难
    • 时效性要求高
  2. 用 AI 治理 AI,突破 AIGC 内容审核的难点
  3. 匹配业务流程,做好内容审核的关键三步
    • 语料筛选
    • 用户输入
    • 模型输出
  4. 总结与展望

听众收益:

  • 了解大模型内容治理的技术体系
  • 学习模型对抗的底层技术要点
  • 了解内容治理未来需要深耕的技术方向

by 崔世文

蚂蚁集团
大模型安全检测算法负责人

大模型安全带来新机遇的同事也带来了诸多安全挑战,蚂蚁集团在可信 AI 领域有深厚的积淀,在大模型安全领域也快速积累丰富的实战经验,并积极参与行业标准,这次分享会对蚂蚁的安全应用及标准实践展开介绍。

演讲提纲:

  1. 大模型安全挑战
  2. 大模型安全框架
  3. 大模型应用及标准实践
  4. 总结与未来展望

听众收益:

  • 了解目前大模型面临的安全挑战以及解决方案
  • 了解大模型真实应用以及标准的安全实践

交通指南

上海中谷小南国花园酒店

China Grain Hotel
地址:上海市杨浦区佳木斯路777号(近营口路口)
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手