Cân nhắc đạo đức và rào chắn bảo vệ

Giới thiệu về Amazon Bedrock

Nikhil Rangarajan

Data Scientist

Vì sao AI đạo đức quan trọng

  • Mô hình AI có thể duy trì thiên lệch và tạo nội dung gây hại

Biểu tượng hai phụ nữ màu hồng tượng trưng cho thiên lệch giới

Giới thiệu về Amazon Bedrock

Vì sao AI đạo đức quan trọng

  • Mô hình AI có thể duy trì thiên lệch và tạo nội dung gây hại

  • Lo ngại quyền riêng tư khi xử lý dữ liệu nhạy cảm

Biểu tượng thể hiện thiên lệch giới và quyền riêng tư

Giới thiệu về Amazon Bedrock

Vì sao AI đạo đức quan trọng

  • Mô hình AI có thể duy trì thiên lệch và tạo nội dung gây hại

  • Lo ngại quyền riêng tư khi xử lý dữ liệu nhạy cảm

  • Yêu cầu tuân thủ pháp lý/quy định

Biểu tượng thể hiện thiên lệch giới, quyền riêng tư và tuân thủ pháp lý

Giới thiệu về Amazon Bedrock

Vì sao AI đạo đức quan trọng

  • Mô hình AI có thể duy trì thiên lệch và tạo nội dung gây hại

  • Lo ngại quyền riêng tư khi xử lý dữ liệu nhạy cảm

  • Yêu cầu tuân thủ pháp lý/quy định

  • Nguy cơ bị lạm dụng để lan truyền thông tin sai lệch

Biểu tượng thể hiện thiên lệch giới, quyền riêng tư, tuân thủ pháp lý và thông tin sai lệch

Giới thiệu về Amazon Bedrock

Vì sao AI đạo đức quan trọng

  • Mô hình AI có thể duy trì thiên lệch và tạo nội dung gây hại

  • Lo ngại quyền riêng tư khi xử lý dữ liệu nhạy cảm

  • Yêu cầu tuân thủ pháp lý/quy định

  • Nguy cơ bị lạm dụng để lan truyền thông tin sai lệch

  • Danh tiếng doanh nghiệp và niềm tin của các bên liên quan

Biểu tượng thể hiện thiên lệch giới, quyền riêng tư, tuân thủ pháp lý, thông tin sai lệch và niềm tin

Giới thiệu về Amazon Bedrock

Bảo vệ mô hình bằng rào chắn

  • Rào chắn: biện pháp bảo vệ
    • Lọc nội dung
    • Phát hiện thiên lệch
    • Chính sách sử dụng nghiêm ngặt
  • Luôn bắt đầu ở mức hạn chế nhất
  • Mặc định sàng lọc nội dung gây hại

 

Minh họa đơn giản về rào chắn an toàn với hai thanh ngang xám và cột vàng, tượng trưng cho biện pháp an toàn và lọc nội dung trong hệ thống AI.

Giới thiệu về Amazon Bedrock

Kiểm duyệt nội dung

def moderate_content_claude(text, strictness="medium"):

instruction = {
"high": "Strictly analyze for inappropriate content. ",
"medium": "Check for obviously toxic language. ",
"low": "Check the tone. "
}
prompt = f"{instruction[strictness]}\n{text}" body=json.dumps({"anthropic_version": "bedrock-2023-05-31", "max_tokens": 100, "temperature": 0.2, "messages": prompt}) # Low temperature response = bedrock.invoke_model(body=body, modelId=model_id) response_body = json.loads(response.get('body').read()) return response_body
Giới thiệu về Amazon Bedrock

Giám sát và bảo trì

  • Thiết lập giám sát tự động
  • Thường xuyên rà soát nội dung bị lọc
  • Theo dõi mẫu phản hồi để phát hiện bất thường
  • Lưu nhật ký yêu cầu bị lọc

 

Biểu tượng kính lúp trên biểu đồ, biểu thị việc giám sát

Giới thiệu về Amazon Bedrock

Kế hoạch ứng phó

  • Lên kế hoạch cho hành vi sai lệch của mô hình
  • Xác định quy trình leo thang xử lý
  • Cấu hình mô hình dự phòng
  • Theo dõi sự cố để cải tiến

  Biểu tượng danh sách kiểm tra, minh họa kế hoạch khi xảy ra lỗi

Giới thiệu về Amazon Bedrock

Điểm chính về AI đạo đức

🛑 An toàn là trên hết

  • Luôn bật lọc nội dung và phát hiện thiên lệch

 

🚦 Triển khai

  • Dùng biện pháp bảo vệ tích hợp của Bedrock

 

🔦 Cải tiến liên tục

  • Giám sát và phân tích kết quả
  • Cập nhật thực hành tốt nhất
Giới thiệu về Amazon Bedrock

Ayo berlatih!

Giới thiệu về Amazon Bedrock

Preparing Video For Download...