学習完了後、Trainブロック(またはHistoryのラン行)のchatボタンで新しいモデルと話しましょう:
- モード:Adapter(高速 — ベース+アダプター)、Merged(マージがあれば)、Base(比較用の元モデル)。
- サンプリング:チャットUIはtemperature 0.7、最大96新トークンで応答。API(
temperature、max_new)で正確に調整可能。 - 会話はマルチターン — モデルはこれまでの文脈を見ます。
- 早めの停止は正常:答えが完了するとモデルはEOSを出力します。

ヒント:応答が意味不明になったら学習率が高すぎた証拠 — レッスン6参照。低いloss+データの方向に合う応答=成功したラン。
