InternLM / InternLM/lmdeploy

[Docs] LoRA 推理服务

Open
#2,686 1 comment 0 reactions 1 assignee Claimed by @AllentDan View on GitHub
Dominant language
Python
Stars
8.1k
Forks
748
Avg merge
6d 2h
Merged PRs (30d)
54

Description

### 📚 The doc issue

请问 使用lmdeploy serve api_server THUDM/chatglm2-6b --adapters mylora=chenchi/lora-chatglm2-6b-guodegang
启动服务之后,调用的时候能不能即使用裸模型也使用lora训练后的?
比如openai方式调用的时候model_name=mylora就是调用adpters;上面的命令行加上--model-name=chatglm2的参数,openai方式调用的时候model_name=chatglm2就是调用的裸模型?

### Suggest a potential alternative/fix

_No response_

Contributor guide

Open the contributing guide

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.