Support 1 * 128 and 128 * 128 block-wise quant?
@szkarpinski ci sta già lavorando.
Dal 6/8/2025.
Valutazione
Questa issue non è ancora stata valutata.
Descrizione
In the CUDA 12.9 cuBLASLt documentation, I noticed support for 1×128 and 128×128 block-wise quantization methods. However, I found that nvmath-python currently lacks bindings for this type of quantize approach. I wonder do we have any plan for support this approach?
https://docs.nvidia.com/cuda/cublas/index.html#cublasltmatmulmatrixscale-t
- Lingua principale
- Cython
- Stelle
- 601
- Fork
- 46
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Guida per i contributori
Apri la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di NVIDIA/nvmath-python
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
NVIDIA/nvmath-python#61 · 2 reazioni ·
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 35/100
NVIDIA/nvmath-python#56 · 3 commenti ·
-
NVIDIA/nvmath-python#53 · 3 commenti · 1 assegnatario ·
-
Reconsider this approuch Aperta
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
NVIDIA/nvmath-python#44 · 2 commenti ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
NVIDIA/nvmath-python#32 · 2 commenti · 2 reazioni ·