Response-parameters beheersen

Werken met de OpenAI Responses API

James Chapman

AI Curriculum Manager, DataCamp

Modelkeuze

response = client.responses.create(
    model="gpt-5.4-mini",
    input="What is recursion?",
)
1 https://platform.openai.com/docs/models
Werken met de OpenAI Responses API

Modelkeuze

response = client.responses.create(
    model="gpt-5.4-mini",
    input="What is recursion?",
)
  • Vuistregel: gebruik het goedkoopste model dat aan de overige eisen voldoet
Model Snelheid Kosten Beste voor
gpt-5.4-mini Snel Laag Eenvoudige taken, Q&A
gpt-5.5 Gemiddeld Hoger Complexe redenering
1 https://platform.openai.com/docs/models
Werken met de OpenAI Responses API

LLM's en tokens

  • Tokens: teksteenheden die de AI helpen tekst te begrijpen en te interpreteren

$$

De zin: "How can the OpenAI API deliver business value?" met elk token in een andere kleur gemarkeerd.

1 https://platform.openai.com/tokenizer
Werken met de OpenAI Responses API

LLM's en tokens

 

  • Niet-redenerende LLM's: Genereert de tokens met de hoogste kans na de prompt

uitvoer zonder redenering

Werken met de OpenAI Responses API

LLM's en tokens

uitvoer met redenering

Werken met de OpenAI Responses API

Redeneerinspanning

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",

reasoning={"effort": "none"}
)
Werken met de OpenAI Responses API

Redeneerinspanning

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={"effort": "none"}
)
Inspanning Beste voor
none Triviale of mechanische taken.
low Eenvoudige taken met focus op snelheid en kosten.
medium Standaard: balans tussen redenering en efficiëntie.
high Complexe, meerstaps- of logische taken.
xhigh De zwaarste taken op de grens van het haalbare.
Werken met de OpenAI Responses API

Redeneersamenvattingen

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={
        "effort": "medium",

"summary": "auto"
} )
Werken met de OpenAI Responses API

Uitvoertokens beperken

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={"effort": "none"},

max_output_tokens=500
)
  • max_output_tokens telt ook de reasoning tokens mee
Werken met de OpenAI Responses API

Samenvatting

  • Eenvoudige taken → begin met kleine modellen, zonder redenering en weinig tokens
  • Complexe taken → begin met middelgrote modellen en redenering, daarna fine-tunen

parameterkoppeling

Werken met de OpenAI Responses API

Laten we oefenen!

Werken met de OpenAI Responses API

Preparing Video For Download...