Łagodzenie stronniczości

Odpowiedzialne zarządzanie danymi w AI

Maria Prokofieva

Lead ML engineer

Omówimy

  • Strategie w całym cyklu życia projektu
  • Ponowne próbkowanie i ważenie
  • Ponowne etykietowanie i usuwanie atrybutów wrażliwych
  • Trening adversarialny i rekalibracja modelu
  • Zachowanie użytkowników
  • Ograniczenia sprawiedliwości i wybór algorytmu
  • Istnieją również inne strategie
Odpowiedzialne zarządzanie danymi w AI

Stronniczość — przypomnienie

  • Systematyczne błędy lub uprzedzenia
  • Niesprawiedliwe wyniki dla grup lub jednostek

Stronniczość w AI

1 Image by Streamline HQ
Odpowiedzialne zarządzanie danymi w AI

Stronniczość w projekcie

  • W danych surowych
  • W pre-processingu
  • W modelowaniu
  • Po wdrożeniu

cykl życia

Odpowiedzialne zarządzanie danymi w AI

Stronniczość w pre-processingu

  • Ponowne próbkowanie
  • Ponowne ważenie
  • Ponowne etykietowanie
  • Usunięcie atrybutów wrażliwych
Odpowiedzialne zarządzanie danymi w AI

Strategie w pre-processingu

  • Ponowne próbkowanie:
    • Dostosowanie rozkładu dla zrównoważonej reprezentacji klas
  • Ponowne ważenie:
    • Korekcja stronniczości za pomocą wag klas przy stałym rozmiarze zbioru
  • Ponowne etykietowanie:
    • Aktualizacja etykiet dla dokładnej reprezentacji celu
  • Usunięcie atrybutów wrażliwych:
    • Eliminacja atrybutów chronionych
Odpowiedzialne zarządzanie danymi w AI

Stronniczość w modelowaniu

  • Stronniczość wynikająca z algorytmu
  • Trening adversarialny
  • Ograniczenia sprawiedliwości
  • Wybór algorytmu: prostsze, odporne lub uogólnialne modele
Odpowiedzialne zarządzanie danymi w AI

Doradca finansowy

  • Stronniczość związana z regionalnymi dysproporcjami ekonomicznymi
  • Trening adversarialny w celu korekcji stronniczości
  • Drzewa decyzyjne i regularyzowane modele liniowe

doradca finansowy

1 Image by Streamline HQ
Odpowiedzialne zarządzanie danymi w AI

Stronniczość po wdrożeniu i w użyciu

  • Monitorowanie stronniczości w celu zapobiegania dryfowi modelu
  • Rekalibracja modelu
  • Niewłaściwe zastosowanie

aplikacja w użyciu

1 Image by Streamline HQ
Odpowiedzialne zarządzanie danymi w AI

Doradca finansowy

Dryf modelu:

  • Niedoreprezentowana gospodarka freelancerów

Nieprawidłowe użycie:

  • Aktualizacja informacji finansowych

doradca finansowy

1 Image by Streamline HQ
Odpowiedzialne zarządzanie danymi w AI

Czas na ćwiczenia!

Odpowiedzialne zarządzanie danymi w AI

Preparing Video For Download...