責任ある利用

生成 AI の基本概念

Daniel Tedesco

Data Lead, Google

選挙前夜...

様々なフェイクニュースの見出し

生成 AI の基本概念

悪用の種類

  • ディープフェイク
  • 誤情報キャンペーン
  • AI 強化型ハッキング

生成 AI によるパフダウンジャケットを着たローマ教皇の画像

1 Pablo Xavier
生成 AI の基本概念

検出と予防

重要な利用原則

  • ヒューマン・イン・ザ・ループ
  • 有害性の防止
  • 継続的な監視

検出と予防

AI における危害の予防と検出フローチャート: 左から順にアクセス、プロンプト、応答、アプリケーション、コミュニケーションとフィードバック。

生成 AI の基本概念

アクセス

AI は、意図せずに、犯罪組織の非犯罪活動を支援することがある

  • 悪意ある組織の支援を回避
  • KYC(顧客確認)
    • ユーザーの本人確認

不審な外観の人物が、指を口に当て、黙っていろと合図している。

生成 AI の基本概念

プロンプトと応答

プロンプトのモデレーション

  • ウェブサイトやチャットの投稿管理に類似
  • ジェイルブレイクでガイドラインが回避されるリスクあり

応答のモデレーション

  • ユーザーに表示する前に、応答をスクリーニング
生成 AI の基本概念

アプリケーション

悪意ある者が、問題のない応答を違法行為に転用するリスク

  • 見えないウォーターマーク(透かし)は、コンテンツの出所を特定するのを助ける
  • 法執行機関の介入が必要な場合もあり
生成 AI の基本概念

コミュニケーションとフィードバック

  • 明確な使用ガイドライン
  • フィードバックループ
    • ユーザー調査、関係者との意見交換の場
    • 市民社会組織との連携
    • 製品内にフィードバック機能を組み込む

シートベルトを締める車のドライバー

生成 AI の基本概念

練習しましょう!

生成 AI の基本概念

Preparing Video For Download...