训练结束后,用训练块(或历史里的运行行)上的 chat 按钮和你的新模型聊聊:
- 模式:Adapter(快——基座 + 适配器)、Merged(若已有合并)和 Base(原始模型,作对照)。
- 采样:对话界面以 temperature 0.7、最多 96 个新 token 回复;两者都可通过 API(
temperature、max_new)精确调节。 - 对话是多轮的——模型看得到之前的上下文。
- 提前停止很正常:模型答完会输出结束符(EOS)。

提示:如果回复变成乱码,说明学习率过高——见第 6 课。低 loss + 贴合数据风格的回复 = 成功的训练。
