AlibabaResearch/flash-llm
Xem trên GitHubFlash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity
- Star
- 247
- Fork
- 24
- Issue cho người mới đang mở
- 0
- Issue đã lập chỉ mục
- 7
- Ngôn ngữ chính
- Cuda
- Giấy phép
- Apache-2.0
- Lần push lên GitHub gần nhất
- 22/9/2023
- Lập chỉ mục gần nhất
- 13/9/2026
- Hướng dẫn đóng góp
- Không có hướng dẫn đóng góp
- Quy tắc ứng xử
- Không có quy tắc ứng xử
- Label cho người mới
- Chưa lập chỉ mục label nào cho người mới
- Chỉ số merge pull request
- Không có pull request nào được merge trong 30 ngày
-
Incorpopration with llama 2? Đang mở
AlibabaResearch/flash-llm#8 · 5 bình luận · 0 reaction · 0 người được giao ·
-
AlibabaResearch/flash-llm#9 · 3 bình luận · 0 reaction · 0 người được giao ·
-
smaller OPT? Đang mở
AlibabaResearch/flash-llm#10 · 0 bình luận · 0 reaction · 0 người được giao ·
-
AlibabaResearch/flash-llm#12 · 0 bình luận · 0 reaction · 0 người được giao ·
-
AlibabaResearch/flash-llm#13 · 1 bình luận · 0 reaction · 0 người được giao ·
-
High error in 50% sparsity Đang mở
AlibabaResearch/flash-llm#14 · 0 bình luận · 0 reaction · 0 người được giao ·
-
AlibabaResearch/flash-llm#15 · 0 bình luận · 0 reaction · 0 người được giao ·