InternLM / InternLM/InternLM-XComposer

预训练放开vision encoder,效果很差

Open
#195 5 comments 0 reactions 1 assignee Claimed by @myownskyW7 View on GitHub
Dominant language
Python
Stars
2.9k
Forks
175
PR merge metrics
No merged PRs in 30d

Description

模拟InternLM-XComposer2三阶段训练,在第一个预训练使用caption数据放开vision encoder、mlp_2x、plora的参数训练,训练多步后测试模型发现模型完全没有caotion能力,而且loss也比单独放开mlp_2x大很多,消融发现是vision encoder放开后提取图像信息能力变差了很多,请问我试验配置的有问题吗?如果放开vision encoder应该如何训练?另外有没有书生多模态大语言模型的交流群呢?

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.