AlibabaResearch/flash-llm
Ver en GitHubFlash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity
- Estrellas
- 247
- Forks
- 24
- Issues abiertos para principiantes
- 0
- Issues indexados
- 7
- Lenguaje dominante
- Cuda
- Licencia
- Apache-2.0
- Último push a GitHub
- 22/9/2023
- Última indexación
- 13/9/2026
- Guía de contribución
- Sin guía de contribución
- Código de conducta
- Sin código de conducta
- Etiquetas para principiantes
- Sin etiquetas para principiantes indexadas
- Métricas de merge de PR
- Sin PR fusionados en 30 d
-
Incorpopration with llama 2? Abierto
AlibabaResearch/flash-llm#8 · 5 comentarios · 0 reacciones · 0 asignados ·
-
AlibabaResearch/flash-llm#9 · 3 comentarios · 0 reacciones · 0 asignados ·
-
smaller OPT? Abierto
AlibabaResearch/flash-llm#10 · 0 comentarios · 0 reacciones · 0 asignados ·
-
AlibabaResearch/flash-llm#12 · 0 comentarios · 0 reacciones · 0 asignados ·
-
AlibabaResearch/flash-llm#13 · 1 comentario · 0 reacciones · 0 asignados ·
-
High error in 50% sparsity Abierto
AlibabaResearch/flash-llm#14 · 0 comentarios · 0 reacciones · 0 asignados ·
-
AlibabaResearch/flash-llm#15 · 0 comentarios · 0 reacciones · 0 asignados ·