負責任的生成式 AI 應用

生成式 AI 概念

Daniel Tedesco

Data Lead, Google

選前之夜

假新聞標題集錦

生成式 AI 概念

惡意使用類型

  • 深偽內容
  • 錯誤資訊戰
  • AI 強化駭攻

AI 生成的羽絨外套教宗圖像

1 Pablo Xavier
生成式 AI 概念

偵測與預防

關鍵使用原則

  • 人在迴圈中(Human-in-the-loop)
  • 防止傷害
  • 持續監控

 

偵測與預防節點

AI 使用流程中的節點:存取、提示、回應、應用,以及溝通與回饋。

生成式 AI 概念

存取

AI 可能無意間協助犯罪團體的非犯罪活動。

  • 避免支援惡意團體
  • KYC(Know Your Customer)
    • 驗證使用者身分

神祕人物做噓手勢

生成式 AI 概念

提示與回應

審核提示

  • 類似網站或聊天室的版主機制
  • 越獄式提示仍可能繞過開發者準則

審核回應

  • 在顯示給使用者前先篩檢或過濾回應
生成式 AI 概念

應用

惡意行為者可能將看似良性的回應,用於非法或不道德活動。

  • 看不見的浮水印可協助判定內容來源
  • 可能需要執法機關介入
生成式 AI 概念

溝通與回饋

  • 明確的使用準則
  • 回饋迴路
    • 使用者研究與利害關係人座談
    • 與公民社會組織合作
    • 在產品中提供回饋機會

駕駛繫上安全帶

生成式 AI 概念

一起來練習吧!

生成式 AI 概念

Preparing Video For Download...