Відповідальні застосунки генеративного ШІ

Концепції Generative AI

Daniel Tedesco

Data Lead, Google

Напередодні виборів

Збірка заголовків фейкових новин

Концепції Generative AI

Типи зловмисного використання

  • Діпфейки
  • Кампанії дезінформації
  • Хакінг із ШІ

Згенероване ШІ зображення Папи в пуховику

1 Pablo Xavier
Концепції Generative AI

Виявлення та запобігання

Ключові принципи використання

  • Людина в циклі
  • Запобігання шкоді
  • Безперервний моніторинг

 

Точки виявлення та запобігання

Блок-схема точок у використанні ШІ: доступ, підказки, відповіді, застосунок і комунікація та фідбек.

Концепції Generative AI

Доступ

ШІ може ненавмисно допомагати некримінальній діяльності злочинних груп.

  • Не підтримуйте зловмисні групи
  • Знай свого клієнта (KYC)
    • Верифікуйте особу користувача

Зловісний персонаж, що закликає мовчати.

Концепції Generative AI

Підказки та відповіді

Модерація підказок

  • Подібно до модерації сайтів або чатів
  • «Джейлбрейк» підказок все ще може обходити вимоги розробників

Модерація відповідей

  • Перевіряйте або фільтруйте відповіді перед показом користувачу
Концепції Generative AI

Застосунки

Зловмисники можуть застосовувати безпечні відповіді до незаконних чи неетичних дій.

  • Невидимі водяні знаки допомагають визначити джерело контенту
  • Може знадобитися участь правоохоронців
Концепції Generative AI

Комунікація та фідбек

  • Чіткі правила використання
  • Зворотний зв'язок
    • Дослідження користувачів і круглі столи зі стейкхолдерами
    • Партнерство з громадськими організаціями
    • Можливості фідбеку в продукті

Водій пристібає ремінь безпеки

Концепції Generative AI

Перейдемо до практики!

Концепції Generative AI

Preparing Video For Download...