AlibabaResearch/flash-llm
在 GitHub 檢視Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity
- 星號
- 247
- 分支
- 24
- 開放的新手 issue
- 0
- 已索引 issue
- 7
- 主要語言
- Cuda
- 授權條款
- Apache-2.0
- 最近 GitHub push
- 2023年9月22日
- 最近索引
- 2026年9月13日
- 貢獻指南
- 沒有貢獻指南
- 行為準則
- 沒有行為準則
- 新手標籤
- 沒有已索引的新手標籤
- PR 合併指標
- 30 天內沒有已合併 PR
-
AlibabaResearch/flash-llm#8 · 5 則留言 · 0 個 reaction · 已指派 0 人 ·
-
AlibabaResearch/flash-llm#9 · 3 則留言 · 0 個 reaction · 已指派 0 人 ·
-
smaller OPT? 未關閉
AlibabaResearch/flash-llm#10 · 0 則留言 · 0 個 reaction · 已指派 0 人 ·
-
AlibabaResearch/flash-llm#12 · 0 則留言 · 0 個 reaction · 已指派 0 人 ·
-
AlibabaResearch/flash-llm#13 · 1 則留言 · 0 個 reaction · 已指派 0 人 ·
-
AlibabaResearch/flash-llm#14 · 0 則留言 · 0 個 reaction · 已指派 0 人 ·
-
AlibabaResearch/flash-llm#15 · 0 則留言 · 0 個 reaction · 已指派 0 人 ·