AlibabaResearch / AlibabaResearch/flash-llm
Incorpopration with llama 2?
Offen
- Vorherrschende Sprache
- Cuda
- Sterne
- 247
- Forks
- 24
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Bewertung
Dieses Issue wurde noch nicht bewertet.