Optimalizace AI z hlediska rychlosti, nákladů a kvality
AI-Assisted Coding for Developers
Francesca Donadoni
AI Curriculum Manager, DataCamp
Metriky
Latence
(doba odezvy): Jak dlouho trvá modelu vygenerovat odpověď
Metriky
Latence
(doba odezvy): Jak dlouho trvá modelu vygenerovat odpověď
$$
Náklady na tokeny
(za 1M tokenů): Peněžní náklady na použití modelu AI
Metriky
Latence
(doba odezvy): Jak dlouho trvá modelu vygenerovat odpověď
$$
Náklady na tokeny
(za 1M tokenů): Peněžní náklady na použití modelu AI
$$
Kvalita
(úspěšnost testů/pokrytí): Jak často vygenerovaný kód funguje správně
Benchmarking modelů
$$
1
https://github.com/openai/human-eval
Benchmarking modelů
$$
1
https://github.com/bigcode-project/bigcodebench
Benchmarking modelů
$$
1
https://github.com/SWE-bench/SWE-bench
Benchmarking modelů
$$
1
https://github.com/JohnnyPeng18/Coffe
Verzování promptů
Verzování promptů
Verzování promptů
Ukládání promptů do mezipaměti
Ukládání do mezipaměti zahrnuje:
Prompt
Vstup
Model
Teplota
Pojďme si procvičit!
AI-Assisted Coding for Developers
Preparing Video For Download...