InternLM / InternLM/Tutorial

关于训练后的模型文件结构以及使用方式上的疑惑

未关闭
#439 6 条评论 0 个 reaction 已指派 0 人 在 GitHub 查看
主要语言
Python
星标
2k
派生
1.5k
PR 合并指标
30 天内没有已合并 PR

描述

![image](https://github.com/InternLM/tutorial/assets/100982130/6520bcc0-73a7-4e75-9df9-d541ebe7fa46)
以上为我qlora之后得到的lora文件以及合并后的文件结构,以下为原始qwen-1.8b-chat文件结构,两者并不完全一致。
![image](https://github.com/InternLM/tutorial/assets/100982130/a3e8ff2e-707a-49c9-869d-6c9195fe82b7)
由于qwen在modelscope上对chat模型做了特殊的问答代码处理,比如chat模型可以以history保存对话记录,如果我们的模型结构不一致,并且少了部分文件,是否可以用同样的代码调用训练好的模型呢?

贡献指南

这个仓库没有索引到贡献指南

评估

这个 Issue 还没有评估数据。

把新 issue 发到你的邮箱

精选适合新手参与的 GitHub issue 摘要。