负责任的生成式 AI 应用

生成式 AI 概念

Daniel Tedesco

Data Lead, Google

大选前夕

虚假新闻标题合集

生成式 AI 概念

恶意使用类型

  • 深度伪造
  • 虚假信息活动
  • AI 增强的黑客攻击

AI 生成的教皇羽绒服图片

1 Pablo Xavier
生成式 AI 概念

发现与防护

关键使用原则

  • 人在回路
  • 防止伤害
  • 持续监测

 

发现与防护点

AI 使用各环节的流程图:访问、提示、响应、应用,以及沟通与反馈。

生成式 AI 概念

访问

AI 可能无意协助犯罪团伙的非犯罪活动。

  • 避免支持恶意团体
  • 了解你的客户(KYC)
    • 核验用户身份

一个神秘人物做噤声手势。

生成式 AI 概念

提示与响应

提示词审核

  • 类似网站或群聊的内容审核
  • 越狱提示仍可能绕过开发者指南

响应审核

  • 在展示前对响应进行筛查或过滤
生成式 AI 概念

应用场景

恶意行为者可将看似良性的响应用于非法或不道德行为。

  • 隐形水印可追溯内容来源
  • 可能需要执法部门介入
生成式 AI 概念

沟通与反馈

  • 明确使用规范
  • 反馈闭环
    • 用户研究与利益相关方圆桌
    • 与公民社会组织合作
    • 在产品内提供反馈渠道

一位司机正在系安全带

生成式 AI 概念

让我们练习!

生成式 AI 概念

Preparing Video For Download...