Úvod do RLHF

Reinforcement Learning from Human Feedback (RLHF)

Mina Parham

AI Engineer

Vítejte v kurzu!

 

  • Instruktor: Mina Parham

 

  • AI inženýr
  • Velké jazykové modely (LLM)
  • Zpětnovazební učení z lidské zpětné vazby (RLHF)

 

  • Téma: Zpětnovazební učení z lidské zpětné vazby (RLHF)

Diagram reprezentující model umělé inteligence s dodatečným krokem zahrnujícím člověka.

Reinforcement Learning from Human Feedback (RLHF)

Vítejte v kurzu!

 

  • Instruktor: Mina Parham

 

  • AI inženýr
  • Velké jazykové modely (LLM)
  • Zpětnovazební učení z lidské zpětné vazby (RLHF)

 

  • Téma: Zpětnovazební učení z lidské zpětné vazby (RLHF)

Diagram reprezentující model umělé inteligence s dodatečným krokem zahrnujícím člověka, vedoucím k lepším výsledkům.

Reinforcement Learning from Human Feedback (RLHF)

Přehled zpětnovazebního učení

Diagram zobrazující ikonu agenta, akci a politiku odměn v cyklu, reprezentující proces zpětnovazebního učení.

Reinforcement Learning from Human Feedback (RLHF)

Přehled zpětnovazebního učení

Diagram zobrazující ikonu agenta, akci a politiku odměn v cyklu, reprezentující proces zpětnovazebního učení.

Reinforcement Learning from Human Feedback (RLHF)

Přehled zpětnovazebního učení

Diagram zobrazující ikonu agenta, akci a politiku odměn v cyklu, reprezentující proces zpětnovazebního učení.

Reinforcement Learning from Human Feedback (RLHF)

Přehled zpětnovazebního učení

Diagram zobrazující ikonu agenta, akci a politiku odměn v cyklu, reprezentující proces zpětnovazebního učení.

Reinforcement Learning from Human Feedback (RLHF)

Od RL k RLHF

 

  Diagram zobrazující ikonu LLM, textový výstup a lidského hodnotitele, reprezentující část cyklu zpětnovazebního učení z lidské zpětné vazby.

Reinforcement Learning from Human Feedback (RLHF)

Od RL k RLHF

 

  Diagram zobrazující ikonu LLM, textový výstup a lidského hodnotitele, reprezentující část cyklu zpětnovazebního učení z lidské zpětné vazby.

Reinforcement Learning from Human Feedback (RLHF)

Od RL k RLHF

  • Trénování modelu odměn
  • Sladění s lidskými preferencemi

Diagram zobrazující ikonu LLM, textový výstup a lidského hodnotitele, reprezentující část cyklu zpětnovazebního učení z lidské zpětné vazby.

Reinforcement Learning from Human Feedback (RLHF)

Doladění LLM v RLHF

 

Ikona velkého jazykového modelu.

Reinforcement Learning from Human Feedback (RLHF)

Doladění LLM v RLHF

  • Trénování počátečního LLM

Ikona velkého jazykového modelu doladěného pomocí vstupní datové sady.

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" vstupující do LLM.

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" s odpovědí LLM: „a 16th Century author".

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" s odpovědí LLM: „a 16th Century author" a dodatečným modelem (policy model) přijímajícím dotaz.

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" s odpovědí LLM: „a 16th Century author" a dodatečným modelem (policy model) trénovaným pomocí modelu odměn.

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" s odpovědí LLM: „a 16th Century author" a dodatečným modelem (policy model) trénovaným pomocí modelu odměn, který vrací odpověď „William Shakespeare".

Reinforcement Learning from Human Feedback (RLHF)

Celý proces RLHF

Dotaz „Who wrote Romeo and Juliet" s odpovědí LLM: „a 16th Century author" a dodatečným modelem (policy model) vracejícím „William Shakespeare" a porovnáním obou výsledků.

Reinforcement Learning from Human Feedback (RLHF)

Interakce s LLM laděnými pomocí RLHF

  • Předtrénované modely RLHF na Hugging Face 🤗
from transformers import pipeline

text_generator = pipeline('text-generation', model='lvwerra/gpt2-imdb-pos-v2')
# Provide a review prompt review_prompt = "This is definitely a" # Generate the continuation output = text_generator(review_prompt, max_length=50) #Print the generated text print(output[0]['generated_text'])
This is definitely a crucial improvement.
Reinforcement Learning from Human Feedback (RLHF)

Interakce s LLM laděnými pomocí RLHF

from transformers import pipeline, AutoModelForSequenceClassification, AutoTokenizer


# Instantiate the pre-trained model and tokenizer model = AutoModelForSequenceClassification.from_pretrained("lvwerra/distilbert-imdb") tokenizer = AutoTokenizer.from_pretrained("lvwerra/distilbert-imdb")
# Use pipeline to create the sentiment analyzer sentiment_analyzer = pipeline('sentiment-analysis', model=model, tokenizer=tokenizer) # Pass the text to the sentiment analyzer and print the result sentiment = sentiment_analyzer("This is definitely a crucial improvement.")
print(f"Sentiment Analysis Result: {sentiment}")
positive
Reinforcement Learning from Human Feedback (RLHF)

Pojďme procvičovat!

Reinforcement Learning from Human Feedback (RLHF)

Preparing Video For Download...