Ansvarsfull generativ AI

Koncept inom generativ AI

Daniel Tedesco

Data Lead, Google

Kvällen före valet

Samling av falska nyhetsrubriker

Koncept inom generativ AI

Typer av skadlig användning

  • Deepfakes
  • Desinformationskampanjer
  • AI-förstärkt hacking

AI-genererad bild av påven i en pufferjacka

1 Pablo Xavier
Koncept inom generativ AI

Detektion och förebyggande

Viktiga användningsprinciper

  • Människa i loopen
  • Skadeförebyggande
  • Kontinuerlig övervakning

 

Detektions- och förebyggandepunkter

Ett flödesschema över punkter i AI-användning: åtkomst, prompter, svar, applikation samt kommunikation och återkoppling.

Koncept inom generativ AI

Åtkomst

AI kan oavsiktligt stödja kriminella gruppers icke-kriminella aktiviteter.

  • Undvik att stödja skadliga grupper
  • Know Your Customer (KYC)
    • Verifiera användarens identitet

En hotfull gestalt som tystar betraktaren.

Koncept inom generativ AI

Prompter och svar

Moderering av prompter

  • Liknar moderering av webbplatser eller chattgrupper
  • Jailbreaking-prompter kan kringgå utvecklarens riktlinjer

Moderering av svar

  • Granska eller filtrera svar innan de visas för användaren
Koncept inom generativ AI

Applikationer

Illasinnade aktörer kan använda harmlösa svar för olaglig eller oetisk verksamhet.

  • Osynliga vattenstämplar kan hjälpa till att spåra innehållets källa
  • Kan kräva insats från brottsbekämpande myndigheter
Koncept inom generativ AI

Kommunikation och återkoppling

  • Tydliga användningsriktlinjer
  • Återkopplingsslingor
    • Användartester och intressentrundabordssamtal
    • Samarbeta med civilsamhällesorganisationer
    • Återkopplingsmöjligheter i produkten

En bilförare som spänner säkerhetsbältet

Koncept inom generativ AI

Nu kör vi en övning!

Koncept inom generativ AI

Preparing Video For Download...