12レッスン中のレッスン 9

ファインチューン済みモデルとのテストチャット

学習完了後、Trainブロック(またはHistoryのラン行)のchatボタンで新しいモデルと話しましょう:

  • モード:Adapter(高速 — ベース+アダプター)、Merged(マージがあれば)、Base(比較用の元モデル)。
  • サンプリング:チャットUIはtemperature 0.7、最大96新トークンで応答。API(temperaturemax_new)で正確に調整可能。
  • 会話はマルチターン — モデルはこれまでの文脈を見ます。
  • 早めの停止は正常:答えが完了するとモデルはEOSを出力します。
ファインチューン済みモデルとのチャット
ヒント:応答が意味不明になったら学習率が高すぎた証拠 — レッスン6参照。低いloss+データの方向に合う応答=成功したラン。
コース目次 · 12レッスン中のレッスン 9
TheTensorTune workbench