deepseek-ai / deepseek-ai/DeepSeek-V2

why i use vllm inference deepseek v2 ,speed is low

Open
#24 2 comments 1 reaction 0 assignees View on GitHub
Dominant language
No language data
Stars
5k
Forks
550
PR merge metrics
No merged PRs in 30d

Description

i use vllm to inference deepspeed, use flask to deploy model. When the problem enters the model, it always gets stuck for a long time in the processd prompt step,the code i use is your example code

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.