AI의 위험 완화

업무를 위한 AI 입문

James Chapman

AI Curriculum Manager, DataCamp

지식 허위 생성 완화

신뢰하되 검증하라 마인드셋

  • 중요한 정보는 항상 재확인
    • 📈 수치와 데이터 포인트
    • 📖 인용 및 참고문헌
    • 🏛 역사적 사실과 날짜
    • 💻 기술적 세부사항

hallucination1.jpg

업무를 위한 AI 입문

AI 과장 주장 이유

next_word_prediction.png

  • AI 모델은 가장 가능성 높은 다음 단어를 생성합니다
  • 학습 데이터에서 \"I don't know\"통계적으로 드뭅니다
1 https://openai.com/index/why-language-models-hallucinate/
업무를 위한 AI 입문

AI가 불확실성을 인정하도록 코칭하기

 

🤝 기권 허용: \"확신이 없으면 추측하지 말고 '모르겠습니다'라고 말하세요.\"

🎯 보정: \"각 주장에 대해 다음 중 하나로 표시하세요: 확신 / 불확실 / 추론.\"

📚 인용 또는 레이블: \"모든 사실 주장에 대해 출처를 제시하거나 출처 없음으로 레이블을 붙이세요.\"

 

🧹 자체 점검 통과: \"잘못되었을 수 있거나 가정한 모든 것을 리스트하세요.\"

🧭 범위 제한: \"답변을 입력에 직접 명시된 내용으로만 제한하세요. 추정하지 마세요.\"

업무를 위한 AI 입문

최근성 무시 완화

  • 항상 지식 컷오프 날짜를 확인하세요
  • 그 이후에 발생한 내용은 반드시 검증하세요

    • 💰 가격
    • 🏛 규정
    • 👷 인사 변경
    • 📰 뉴스
  • 🌐 웹 브라우징 지원을 사용하세요

recency.png

업무를 위한 AI 입문

편향된 출력 완화

  • 출력을 비판적으로 검토

    • 🤝 채용 자료
    • ✨ 마케팅 콘텐츠
    • 👉 의사결정
  • ❗ 편향 탐지 도구

biased.png

업무를 위한 AI 입문

아첨성 출력 완화

  • 🧭 AI를 객관성과 비판적 분석으로 이끄세요
  • 🤔 AI 출력에 대해 회의적인 태도를 유지하세요
  • 💬 비판적 피드백을 명시적으로 요청하세요
    • 이 접근 방식의 잠재적 문제는 무엇인가요?
    • 이 문제에 대한 다른 관점은 무엇인가요?

sycophancy.png

업무를 위한 AI 입문

개인정보 보호 및 데이터 노출 완화

 

  • 절대 공유하지 마세요:{{1}} 🔑 비밀번호 또는 자격 증명{{2}} 🔍 고객 개인정보(예: PII){{3}} 📣 회사 독점 정보{{4}} 📜 기밀 전략 또는 계획
  • 경험칙: 공개적으로 올리지 않을 내용이라면, 일반 AI 도구에 붙여넣지 마세요

privacy.png

업무를 위한 AI 입문

AI 안전 체크리스트

checklist1.jpg

업무를 위한 AI 입문

AI 안전 체크리스트

checklist2.jpg

업무를 위한 AI 입문

AI 안전 체크리스트

checklist3.jpg

업무를 위한 AI 입문

AI 안전 체크리스트

checklist4.jpg

업무를 위한 AI 입문

AI 안전 체크리스트

checklist4_5.jpg

업무를 위한 AI 입문

AI 안전 체크리스트

checklist5.jpg

업무를 위한 AI 입문

실습 문제를 풀어봅시다!

업무를 위한 AI 입문

Preparing Video For Download...