AlibabaResearch/flash-llm
Auf GitHub ansehenFlash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity
- Sterne
- 247
- Forks
- 24
- Offene Anfänger-Issues
- 0
- Indexierte Issues
- 7
- Vorherrschende Sprache
- Cuda
- Lizenz
- Apache-2.0
- Letzter GitHub-Push
- 22.9.2023
- Zuletzt indexiert
- 13.9.2026
- Beitragsleitfaden
- Kein Beitragsleitfaden
- Verhaltenskodex
- Kein Verhaltenskodex
- Anfänger-Labels
- Keine Anfänger-Labels indexiert
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
-
AlibabaResearch/flash-llm#8 · 5 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
AlibabaResearch/flash-llm#9 · 3 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
smaller OPT? Offen
AlibabaResearch/flash-llm#10 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
AlibabaResearch/flash-llm#12 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
AlibabaResearch/flash-llm#13 · 1 Kommentar · 0 Reaktionen · 0 zugewiesene Personen ·
-
AlibabaResearch/flash-llm#14 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
AlibabaResearch/flash-llm#15 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·