AlibabaResearch / AlibabaResearch/flash-llm
Incorpopration with llama 2?
Abierto
- Lenguaje dominante
- Cuda
- Estrellas
- 247
- Forks
- 24
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Evaluación
Este issue todavía no se ha evaluado.