InternLM / InternLM/lmdeploy

是否可以提供一个用来监控异步引擎死活的方法

Open
#2,895 2 comments 0 reactions 1 assignee Claimed by @lvhan028 View on GitHub
Dominant language
Python
Stars
8.1k
Forks
748
Avg merge
6d 2h
Merged PRs (30d)
54

Description

随着Lmdeploy支持的模型越来越多,尤其是差异性极强的VLM。推理后端崩溃的现象变得也越来越难以避免,尤其是OOM等报错导致后端崩溃后,其并不会反映到服务端上。如果有一个方法能够检测后端引擎的状态,这样我就可以在healthy端点定时的检测服务的死活,并决定是否要重启服务。我想这一方法对于打算使用Lmdeploy部署长期服务的人非常有帮助。

Contributor guide

Open the contributing guide

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.