- 在训练页面新增 LoRA 秩输入框,使用户可以动态设置 LoRA 秩 - 更新训练模型函数,添加 LoRA 秩参数并将其用于模型配置 - 保留原有功能,仅增加 LoRA 秩相关配置
- 引入 train_on_responses_only 函数,用于优化训练过程 - 设置 instruction_part 和 response_part 参数,以适应特定的对话格式 - 此修改旨在提高模型在生成响应方面的性能和效率