AlibabaResearch / AlibabaResearch/flash-llm
Incorpopration with llama 2?
Aperta
- Lingua principale
- Cuda
- Stelle
- 247
- Fork
- 24
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Descrizione
Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now
Guida per i contributori
Nessuna guida per i contributori indicizzata per questo repository
Valutazione
Questa issue non è ancora stata valutata.