Три роли сообщений
- system — правила и роль ассистента на весь диалог («ты — вежливый помощник службы поддержки»).
- user — сообщения пользователя.
- assistant — прошлые ответы модели (передаёте для контекста).
const res = await fetch(URL, {
method: 'POST',
headers: { Authorization: 'Bearer ' + key, 'Content-Type':'application/json' },
body: JSON.stringify({
model: 'some-model',
max_tokens: 300,
system: 'Ты — краткий технический ассистент.',
messages: [{ role:'user', content:'Объясни, что такое кэш' }]
})
});
const data = await res.json();
Главные параметры
- temperature — «творческость»: 0 — строго и предсказуемо, ~1 — разнообразно. Для фактов берите низкую.
- max_tokens — потолок длины ответа (и расходов).
- stop — стоп-последовательности, где обрывать генерацию.
- stream — получать ответ по частям для «печатающегося» UI.
Упражнение
Сделайте два одинаковых запроса с temperature 0 и 1. Сравните стабильность ответов. Почувствуйте, когда какая нужна.
Системный промпт задаёт правила игры. Параметры настраивают поведение. Освойте их — и получите предсказуемый продукт.
🧠 Какой temperature брать для фактических ответов?