SSkilvy

Три роли сообщений

  • system — правила и роль ассистента на весь диалог («ты — вежливый помощник службы поддержки»).
  • user — сообщения пользователя.
  • assistant — прошлые ответы модели (передаёте для контекста).
const res = await fetch(URL, {
  method: 'POST',
  headers: { Authorization: 'Bearer ' + key, 'Content-Type':'application/json' },
  body: JSON.stringify({
    model: 'some-model',
    max_tokens: 300,
    system: 'Ты — краткий технический ассистент.',
    messages: [{ role:'user', content:'Объясни, что такое кэш' }]
  })
});
const data = await res.json();

Главные параметры

  • temperature — «творческость»: 0 — строго и предсказуемо, ~1 — разнообразно. Для фактов берите низкую.
  • max_tokens — потолок длины ответа (и расходов).
  • stop — стоп-последовательности, где обрывать генерацию.
  • stream — получать ответ по частям для «печатающегося» UI.

Упражнение

Сделайте два одинаковых запроса с temperature 0 и 1. Сравните стабильность ответов. Почувствуйте, когда какая нужна.

Системный промпт задаёт правила игры. Параметры настраивают поведение. Освойте их — и получите предсказуемый продукт.

🧠 Какой temperature брать для фактических ответов?