AlibabaResearch / AlibabaResearch/flash-llm
Incorpopration with llama 2?
Ouverte
- Langage dominant
- Cuda
- Étoiles
- 247
- Forks
- 24
- Métriques de merge des PR
- Aucune PR mergée en 30 j
Description
Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now
Guide de contribution
Aucun guide de contribution indexé pour ce dépôt
Évaluation
Cette issue n'a pas encore été évaluée.