百度大模型原生安全构建之路

所属专题:大模型安全性实践

嘉宾 : 冯景辉 | 百度安全平台 副总经理

会议室 : 钻石厅 C

讲师介绍

专题演讲嘉宾:冯景辉

百度安全平台 副总经理

现任职于百度安全部,任副总经理,负责集团业务安全、业务风控和大模型安全解决方案;其负责的百度搜索内容检测系统,多年来致力于持续改善搜索生态健康度,打击各种违法违规黑产利用搜索引擎传播,尤其是在打击搜索结果中的涉诈内容方面,为保护网民,净化网络空间内容履行百度社会责任,连续七年持续投入打击力量;其负责的业务风控、流量安全、反爬虫等方向是百度所有互联网业务的核心安全能力,历年来百度移动生态业务中发挥重要的保障作用;其主导的大模型安全解决方案是国内第一个可商用的覆盖大模型训练、部署和运营全生命周期的安全解决方案。在进入百度之前,冯景辉是国内第一家完全基于 SaaS 的云安全服务厂商安全宝的联合创始人兼研发副总裁,安全宝系统架构总设计师。

议题介绍

演讲:百度大模型原生安全构建之路

大模型以其更智能、不确定和不可解释的特点,给安全领域,尤其是内容安全带来了更大的挑战。百度在打造文心一言之初就意识到,传统的内容审核技术无法从根本上满足大模型内容安全的需求。因此,我们必须从头开始构建一套全新的方法。本次分享聚焦于百度在过去两年中在大模型内容安全领域遭遇的挑战和问题,以及我们尝试的解决思路和应对方法进行阐述,包括数据清洗、内生安全与安全对齐、安全围栏建设,以及应用安全与基础模型安全等方面。

演讲提纲:

  1. 大模型安全在全生命中期中遇到的挑战
    • 训练阶段的挑战
    • 运营阶段的挑战
  2. 为什么要构建大模型原生安全?
    • 内生安全主要技术
    • 百度在安全围栏建设上的经验
  3. 如何构建应用安全
    • 应用安全于基础模型内容安全边界
    • 应用安全要关注的几个主要问题
    • 应用防火墙构建
  4. 总结与展望

听众收益:

  • 了解大模型内容安全面临哪些问题,以及监管要求
  • 了解国际最先进的大模型内生安全于安全围栏构建技术方法
  • 了解AI智能体开发时应该如何关注安全,避免风险

交通指南

上海中谷小南国花园酒店

China Grain Hotel
地址:上海市杨浦区佳木斯路777号(近营口路口)
  • 微信咨询

  • 电话咨询

    联系电话:13269078023

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手