AlibabaResearch / AlibabaResearch/flash-llm

Incorpopration with llama 2?

Aperta
#8 5 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Lingua principale
Cuda
Stelle
247
Fork
24
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Valutazione

Questa issue non è ancora stata valutata.

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.