MegEngine / MegEngine/examples
how to dump a int4 model
Nadie ha tomado este issue todavía.
- Lenguaje dominante
- Python
- Estrellas
- 31
- Forks
- 5
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
hi我使用代码中提示的dump.py脚本,不加载模型文件,生成的mgb模型速度远低于resnet50.int4.mge的模型
另外参考int8的模型,https://github.com/MegEngine/Models/tree/master/official/quantization#quantization-aware-training-qat
dump成量化模型需要quantize。麻烦请教一下是否是我操作有误best
yours
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Línea de trabajo
Comienza con el script dump.py mencionado en el issue y compara su salida con resnet50.int4.mge. Lee la documentación enlazada de MegEngine sobre quantization-aware training para entender el flujo de cuantización esperado. Se considera terminado cuando se haya identificado si el procedimiento de volcado del modelo es incorrecto y se haya documentado la operación correcta o reproducido un problema confirmado.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- python
- Área
- machine-learning
- Tipo de issue
- Error
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 25/100