раздел 04

Параметры: температура и другие

Это «крутилки», которые управляют тем, как модель выбирает токены из распределения (раздел 01). В чат-интерфейсах они часто скрыты, но в API доступны.

Температура - главная крутилка

temperature масштабирует распределение перед выбором токена.

Низкая (к 0)
Распределение «острое»: модель берёт самые вероятные токены. Ответы предсказуемые, сфокусированные, повторяемые. Для фактов, кода, извлечения.
Высокая (около 1 и выше)
Распределение «плоское»: больше случайности и разнообразия, более креативно - но больше ошибок и отклонений. Для текстов, идей, брейншторма.

Типичный диапазон 0-2. Грубо: факты и код - около 0; письма и идеи - 0.7-1.

Остальные параметры

ПараметрЧто делаетКогда менять
top_pСэмплинг только из верхушки распределения с суммарной вероятностью p (напр. 0.9)Альтернатива температуре для контроля разнообразия
top_kБрать только из k самых вероятных токеновЖёстко ограничить выбор
max_tokensПредел длины ответа (и стоимости)Короткий ответ или контроль расходов
frequency_penaltyШтраф за повторы словЕсли модель «зацикливается»
presence_penaltyПоощрение новых темЧтобы не топталась на одном
stopСтроки, на которых генерация останавливаетсяЧёткие границы ответа
seedФиксирует случайность для воспроизводимостиКогда нужен повторяемый результат