Опановуємо параметри відповіді

Робота з OpenAI Responses API

James Chapman

AI Curriculum Manager, DataCamp

Вибір моделі

response = client.responses.create(
    model="gpt-5.4-mini",
    input="What is recursion?",
)
1 https://platform.openai.com/docs/models
Робота з OpenAI Responses API

Вибір моделі

response = client.responses.create(
    model="gpt-5.4-mini",
    input="What is recursion?",
)
  • Правило великого пальця: використовуйте найдешевшу модель, що відповідає іншим вимогам
Model Speed Cost Best For
gpt-5.4-mini Fast Low Simple tasks, Q&A
gpt-5.5 Moderate Higher Complex reasoning
1 https://platform.openai.com/docs/models
Робота з OpenAI Responses API

LLM і токени

  • Токени: одиниці тексту, які допомагають ШІ розуміти й інтерпретувати текст

$$

Речення «How can the OpenAI API deliver business value?» з кожним токеном, виділеним іншим кольором.

1 https://platform.openai.com/tokenizer
Робота з OpenAI Responses API

LLM і токени

 

  • LLM без міркування: генерує токени з найвищою ймовірністю продовжити підказку

non_reasoning_output.gif

Робота з OpenAI Responses API

LLM і токени

reasoning_output.gif

Робота з OpenAI Responses API

Рівень міркування

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",

reasoning={"effort": "none"}
)
Робота з OpenAI Responses API

Рівень міркування

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={"effort": "none"}
)
Effort Best For
none Тривіальні або механічні задачі.
low Прості задачі з пріоритетом швидкості й вартості.
medium Типово: баланс міркування й ефективності.
high Складні, багатокрокові або логічно насичені задачі.
xhigh Найскладніші задачі на межі можливого
Робота з OpenAI Responses API

Підсумки міркувань

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={
        "effort": "medium",

"summary": "auto"
} )
Робота з OpenAI Responses API

Обмеження вихідних токенів

response = client.responses.create(
    model="gpt-5.4-mini",
    input="Explain LLMs to a 6yr old.",
    reasoning={"effort": "none"},

max_output_tokens=500
)
  • max_output_tokens включає токени міркувань
Робота з OpenAI Responses API

Підсумок

  • Прості задачі → починайте з малих моделей, без міркування та з небагатьма токенами
  • Складні задачі → починайте з моделей середнього розміру та з міркуванням, потім тонко налаштовуйте

parameter_link.jpg

Робота з OpenAI Responses API

Давайте потренуємось!

Робота з OpenAI Responses API

Preparing Video For Download...