AlibabaResearch/flash-llm
GitHub で見るFlash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity
- スター
- 247
- フォーク
- 24
- オープンの初心者向け issue
- 0
- 索引済み issue
- 7
- 主要言語
- Cuda
- ライセンス
- Apache-2.0
- 最終 GitHub push
- 2023年9月22日
- 最新の索引
- 2026年9月13日
- コントリビューションガイド
- コントリビューションガイドがありません
- 行動規範
- 行動規範がありません
- 初心者向けラベル
- 初心者向けラベルは索引されていません
- PR マージ指標
- 30日以内にマージされた PR はありません
-
AlibabaResearch/flash-llm#8 · コメント 5 件 · リアクション 0 件 · 担当者 0 名 ·
-
AlibabaResearch/flash-llm#9 · コメント 3 件 · リアクション 0 件 · 担当者 0 名 ·
-
smaller OPT? オープン
AlibabaResearch/flash-llm#10 · コメント 0 件 · リアクション 0 件 · 担当者 0 名 ·
-
AlibabaResearch/flash-llm#12 · コメント 0 件 · リアクション 0 件 · 担当者 0 名 ·
-
AlibabaResearch/flash-llm#13 · コメント 1 件 · リアクション 0 件 · 担当者 0 名 ·
-
AlibabaResearch/flash-llm#14 · コメント 0 件 · リアクション 0 件 · 担当者 0 名 ·
-
AlibabaResearch/flash-llm#15 · コメント 0 件 · リアクション 0 件 · 担当者 0 名 ·