Ứng dụng AI tạo sinh có trách nhiệm

Các khái niệm về Generative AI

Daniel Tedesco

Data Lead, Google

Đêm trước bầu cử

Tổng hợp các tiêu đề tin giả

Các khái niệm về Generative AI

Các kiểu lạm dụng độc hại

  • Deepfake
  • Chiến dịch thông tin sai lệch
  • Tấn công mạng tăng cường bởi AI

Hình AI tạo: Giáo hoàng mặc áo phao

1 Pablo Xavier
Các khái niệm về Generative AI

Phát hiện và phòng ngừa

Nguyên tắc sử dụng chính

  • Con người giám sát (human-in-the-loop)
  • Ngăn ngừa tác hại
  • Giám sát liên tục

 

Điểm phát hiện và phòng ngừa

Lưu đồ các điểm trong quy trình AI: truy cập, prompt, phản hồi, ứng dụng, truyền thông và phản hồi.

Các khái niệm về Generative AI

Truy cập

AI có thể vô tình hỗ trợ hoạt động không phạm pháp của các nhóm tội phạm.

  • Tránh hỗ trợ các nhóm độc hại
  • Know Your Customer (KYC)
    • Xác minh danh tính người dùng

Nhân vật đáng ngại ra hiệu im lặng.

Các khái niệm về Generative AI

Prompt và phản hồi

Kiểm duyệt prompt

  • Tương tự kiểm duyệt website hoặc nhóm chat
  • Prompt “jailbreak” vẫn có thể lách hướng dẫn của nhà phát triển

Kiểm duyệt phản hồi

  • Sàng lọc/phê duyệt trước khi hiển thị cho người dùng
Các khái niệm về Generative AI

Ứng dụng

Kẻ xấu có thể áp dụng phản hồi vô hại cho hành vi phi pháp hoặc phi đạo đức.

  • Watermark vô hình giúp xác định nguồn nội dung
  • Có thể cần cơ quan thực thi pháp luật can thiệp
Các khái niệm về Generative AI

Truyền thông và phản hồi

  • Hướng dẫn sử dụng rõ ràng
  • Vòng lặp phản hồi
    • Nghiên cứu người dùng, tọa đàm với bên liên quan
    • Hợp tác với các tổ chức xã hội dân sự
    • Kênh góp ý ngay trong sản phẩm

Tài xế đang cài dây an toàn

Các khái niệm về Generative AI

Ayo berlatih!

Các khái niệm về Generative AI

Preparing Video For Download...