AI 的外部风险

AI 安全与风险管理

Angeline Corvaglia

Founder and Digital Transformation Expert

外部风险

内部风险

源自设计或数据

分隔符

外部风险

来自外部行为者

  • 操纵模型

 

  • 针对不同环节
AI 安全与风险管理

常见外部风险

外部风险示意

  • 对抗性输入攻击
  • 数据篡改与投毒
  • 模型窃取与反演
  • 基础设施攻击
  • 供应链攻击
AI 安全与风险管理

对抗性输入攻击

  • 影响推理阶段(处理新数据时)
  • 影响决策

分隔符

示例

  • 轻微篡改图像
  • 导致误分类

对抗性输入攻击示意

AI 安全与风险管理

数据篡改与投毒

  • 影响训练阶段
  • 针对学习完整性

灯泡

示例

  • 伪造产品评价
  • 影响电商推荐系统

数据篡改示意

AI 安全与风险管理

模型窃取与反演

模型反演示意

  • 针对敏感信息
  • 利用模型本身

灯泡

示例

  • 操纵过的输入推断训练中的私有数据
AI 安全与风险管理

基础设施攻击

基础设施攻击示意

  • 针对物理与虚拟环境
  • 攻击底层基础设施

灯泡

示例

  • 请求洪泛 AI 服务器,致其过载不可用
AI 安全与风险管理

供应链攻击

供应链攻击示意

  • 入侵组件或库
  • 利用模型的构件

灯泡

示例

  • 广泛使用的库中植入漏洞
AI 安全与风险管理

安全最佳实践

  • 定期安全审计
  • 数据校验与清洗
  • 严格的访问控制
  • 加密敏感数据
  • 数据匿名化

工具包示意

AI 安全与风险管理

更多最佳实践

  • 持续监控
  • 使用可信工具
  • 定期更新工具
  • 持续培训

最佳实践示意

AI 安全与风险管理

风险快速演变

  • 持续适应
  • 持续学习
  • 主动风险管理
  • 保持警惕

快速变化示意

AI 安全与风险管理

Passons à la pratique !

AI 安全与风险管理

Preparing Video For Download...