Tata kelola dan keamanan

Konsep LLMOps

Max Knobbout, PhD

Applied Scientist, Uber

Siklus hidup LLM: Tata kelola dan keamanan

Ikhtisar fase siklus hidup aplikasi LLM

Konsep LLMOps

Tata kelola dan keamanan

 

Gambar jenaka polisi menunjuk lampu merah

 

  • Tata kelola mencakup kebijakan, pedoman, dan kerangka kerja
  • Keamanan mencakup langkah-langkah untuk mencegah:
    • Akses tidak sah
    • Kebocoran data
    • Serangan adversarial
    • Potensi penyalahgunaan atau manipulasi output/kemampuan model
Konsep LLMOps

Kontrol akses

  • Gunakan Role Based Access Control (RBAC)

  • Semua API harus mematuhi standar keamanan

  • Gunakan model keamanan zero trust

  • Pastikan aplikasi mengasumsikan peran yang benar saat mengakses informasi eksternal

 

Alur API saat aplikasi LLM mengasumsikan peran pengguna

Konsep LLMOps

Ancaman: Prompt injection

  • Prompt injection: Penyerang memanipulasi kolom input atau prompt dalam aplikasi untuk menjalankan perintah atau aksi tanpa izin.
  • Mitigasi:
    • Asumsikan instruksi prompt dapat ditimpa dan konten dapat diungkap
    • Perlakukan LLM sebagai pengguna yang tidak tepercaya
    • Identifikasi (dan blokir) prompt adversarial yang dikenal

Demonstrasi prompt injection

Konsep LLMOps

Ancaman: Manipulasi output

  • Output LLM dapat dimanfaatkan untuk serangan lanjutan.
  • Menjalankan aksi berbahaya atas nama pengguna
  • Mitigasi:
    • Jangan beri aplikasi otoritas/izin yang tidak perlu
    • Sensor dan blokir output tertentu yang tidak diinginkan

Demonstrasi manipulasi output

Konsep LLMOps

Ancaman: Denial-of-service

  • Pengguna membanjiri aplikasi LLM dengan permintaan, menimbulkan biaya besar serta masalah ketersediaan dan kinerja

  • Mitigasi:

    • Batasi laju permintaan
    • Batasi sumber daya per permintaan

 

Gambar yang menampilkan serangan penolakan layanan

Konsep LLMOps

Ancaman: Integritas data dan poisoning

  • Data poisoning menyuntikkan data palsu, menyesatkan, atau berbahaya ke dalam set pelatihan

    • Data bisa berisi informasi berhak cipta dan/atau pribadi
    • Konten bisa berbahaya
  • Mitigasi:

    • Gunakan sumber tepercaya dan verifikasi legitimasi
    • Gunakan filter
    • Sensor output

Gambar dokumen teks, salah satunya teracuni

Konsep LLMOps

Melindungi diri

Gambar jenaka kartun yang menjadi sasaran benda jatuh

 

  • Gunakan standar keamanan terbaru dan terapkan strategi mitigasi
  • Selalu asumsikan sudut pandang pengguna berbahaya yang menargetkan sistem kita
  • Tetap mutakhir, lihat Open Web Application Security Project (OWASP)
1 OWASP untuk LLM: https://llmtop10.com/
Konsep LLMOps

Ayo berlatih!

Konsep LLMOps

Preparing Video For Download...