第 9 课,共 12 课

与微调模型测试对话

训练结束后,用训练块(或历史里的运行行)上的 chat 按钮和你的新模型聊聊:

  • 模式:Adapter(快——基座 + 适配器)、Merged(若已有合并)和 Base(原始模型,作对照)。
  • 采样:对话界面以 temperature 0.7、最多 96 个新 token 回复;两者都可通过 API(temperaturemax_new)精确调节。
  • 对话是多轮的——模型看得到之前的上下文。
  • 提前停止很正常:模型答完会输出结束符(EOS)。
与微调模型对话
提示:如果回复变成乱码,说明学习率过高——见第 6 课。低 loss + 贴合数据风格的回复 = 成功的训练。
课程目录 · 第 9 课,共 12 课
TheTensorTune workbench