Мониторинг и наблюдаемость
Концепции LLMOps
Max Knobbout, PhD
Applied Scientist, Uber
Жизненный цикл LLM: мониторинг и наблюдаемость
Мониторинг и наблюдаемость
- Мониторинг — непрерывное наблюдение за системой.
- Наблюдаемость — раскрытие внутренних состояний системы для внешних наблюдателей.
- Источники данных для наблюдаемости:
- Логи
- Метрики
- Трассировки
Мониторинг входных данных
- Мониторинг входных данных:
- Изменения
- Ошибки
- Вредоносный контент
- Дрейф данных — изменение распределения входных данных со временем
- Для устранения дрейфа данных:
- Отслеживайте распределение данных
- Периодически обновляйте модель
Функциональный мониторинг
Примеры:
- Время отклика
- Объём запросов
- Простой
- Частота ошибок
Для LLM-приложений:
- Выполнение цепочек и агентов
- Системные ресурсы (GPU)
- Затраты
Мониторинг выходных данных
- Используйте метрики, определённые при тестировании:
- Предвзятость
- Токсичность
- Полезность
- Дрейф модели:
- Изменение связи между входными и выходными данными
- Цензурирование — активное вмешательство в вывод модели
Обработка оповещений
- Получайте уведомления при возникновении проблем
- Используйте чёткие процедуры реагирования
- Могут применяться соглашения об уровне обслуживания (SLA)
Давайте потренируемся!
Концепции LLMOps
Preparing Video For Download...