Когда обучение закончится, нажмите chat на блоке Train (или в строке запуска в History) и поговорите с новой моделью:
- Режимы: Adapter (быстрый — база + адаптер), Merged (если слияние есть) и Base (исходная модель, для контраста).
- сэмплирование: чат отвечает с temperature 0.7 и до 96 новых токенов; оба параметра точно настраиваются через API (
temperature,max_new). - диалог многотурный — модель видит предыдущий контекст.
- ранняя остановка — это норма: модель выдаёт EOS, когда ответ завершён.

Совет: если ответы превращаются в бессмыслицу, learning rate был слишком высок — см. урок 6. Низкий loss + ответы в стиле данных = успешный запуск.
