LLMOps 概念
Max Knobbout, PhD
Applied Scientist, Uber
三步驟鏈:
常用向量資料庫實作。
實作與 embedding 模型選項眾多。多做實驗與測試!
監督式微調(transfer learning)
所需資料類型 📂:
Reinforcement Learning from Human Feedback (RLHF)
方法 🔍: