การกำกับดูแลและความปลอดภัย

แนวคิด LLMOps

Max Knobbout, PhD

Applied Scientist, Uber

วงจรชีวิต LLM: การกำกับดูแลและความปลอดภัย

ภาพรวมของขั้นตอนในวงจรชีวิตแอปพลิเคชัน LLM

แนวคิด LLMOps

การกำกับดูแลและความปลอดภัย

 

ภาพตำรวจชี้ไฟแดงในสไตล์น่ารัก

 

  • การกำกับดูแล ครอบคลุมนโยบาย แนวทาง และกรอบการทำงาน
  • ความปลอดภัย ครอบคลุมมาตรการป้องกัน:
    • การเข้าถึงโดยไม่ได้รับอนุญาต
    • การรั่วไหลของข้อมูล
    • การโจมตีแบบ adversarial
    • การนำผลลัพธ์หรือความสามารถของโมเดลไปใช้ในทางที่ผิดหรือบิดเบือน
แนวคิด LLMOps

การควบคุมการเข้าถึง

  • ใช้ Role Based Access Control (RBAC)

  • API ทุกตัวต้องปฏิบัติตามมาตรฐานความปลอดภัย

  • ใช้ zero trust security model

  • ตรวจสอบให้แน่ใจว่าแอปพลิเคชันใช้สิทธิ์ที่ถูกต้องเมื่อเข้าถึงข้อมูลภายนอก

 

กระบวนการ API ที่แอปพลิเคชัน LLM รับบทบาทของผู้ใช้

แนวคิด LLMOps

ภัยคุกคาม: Prompt injection

  • Prompt injection: ผู้โจมตีบิดเบือนช่องอินพุตหรือ prompt ในแอปพลิเคชันเพื่อสั่งให้ระบบทำงานโดยไม่ได้รับอนุญาต
  • แนวทางลดความเสี่ยง:
    • ถือว่าคำสั่งใน prompt อาจถูก แทนที่ และเนื้อหาอาจถูก เปิดเผย
    • ปฏิบัติต่อ LLM เสมือนผู้ใช้ที่ไม่น่าไว้วางใจ
    • ระบุ (และบล็อก) prompt ที่เป็นอันตรายที่รู้จัก

ตัวอย่างการโจมตีแบบ prompt injection

แนวคิด LLMOps

ภัยคุกคาม: การบิดเบือนผลลัพธ์

  • ผลลัพธ์ของ LLM อาจถูกนำไปใช้โจมตีในขั้นตอนถัดไป
  • สั่งให้ดำเนินการที่เป็นอันตรายในนามของผู้ใช้
  • แนวทางลดความเสี่ยง:
    • อย่าให้แอปพลิเคชันมีสิทธิ์หรือสิทธิ์เข้าถึงเกินความจำเป็น
    • กรองและบล็อกผลลัพธ์ที่ไม่พึงประสงค์

ตัวอย่างการบิดเบือนผลลัพธ์

แนวคิด LLMOps

ภัยคุกคาม: Denial-of-service

  • ผู้ใช้ส่งคำขอจำนวนมากมายังแอปพลิเคชัน LLM จนทำให้เกิดปัญหาด้านต้นทุน ความพร้อมใช้งาน และประสิทธิภาพอย่างมีนัยสำคัญ

  • แนวทางลดความเสี่ยง:

    • จำกัดอัตราคำขอ
    • กำหนดเพดานการใช้ทรัพยากรต่อคำขอ

 

ภาพแสดงการโจมตีแบบ denial of service

แนวคิด LLMOps

ภัยคุกคาม: ความสมบูรณ์ของข้อมูลและการวางยาพิษ

  • การวางยาพิษข้อมูล (data poisoning) คือการแทรกข้อมูลเท็จ ทำให้เข้าใจผิด หรือเป็นอันตรายเข้าไปในชุดข้อมูลฝึกสอน

    • ข้อมูลอาจมีเนื้อหาที่มีลิขสิทธิ์และ/หรือข้อมูลส่วนบุคคล
    • เนื้อหาอาจเป็นอันตราย
  • แนวทางลดความเสี่ยง:

    • ใช้แหล่งข้อมูลที่น่าเชื่อถือและตรวจสอบความถูกต้อง
    • ใช้ตัวกรอง
    • กรองผลลัพธ์ที่ไม่เหมาะสม

ภาพเอกสารข้อความที่มีหนึ่งฉบับถูกวางยาพิษ

แนวคิด LLMOps

การปกป้องระบบของเรา

ภาพการ์ตูนน่ารักของตัวละครที่ถูกโจมตีด้วยวัตถุที่ตกลงมา

 

  • ใช้มาตรฐานความปลอดภัยล่าสุดและนำกลยุทธ์ลดความเสี่ยงไปปฏิบัติ
  • มองจากมุมของผู้ไม่หวังดีที่พยายามโจมตีระบบอยู่เสมอ
  • ติดตามข้อมูลอัปเดตจาก Open Web Application Security Project (OWASP)
1 OWASP for LLMs: https://llmtop10.com/
แนวคิด LLMOps

มาฝึกกันเถอะ!

แนวคิด LLMOps

Preparing Video For Download...