Support 1 * 128 and 128 * 128 block-wise quant?
@szkarpinski ya está trabajando en esto.
Desde el 6/8/2025.
Evaluación
Este issue todavía no se ha evaluado.
Descripción
In the CUDA 12.9 cuBLASLt documentation, I noticed support for 1×128 and 128×128 block-wise quantization methods. However, I found that nvmath-python currently lacks bindings for this type of quantize approach. I wonder do we have any plan for support this approach?
https://docs.nvidia.com/cuda/cublas/index.html#cublasltmatmulmatrixscale-t
- Lenguaje dominante
- Cython
- Estrellas
- 601
- Forks
- 46
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de NVIDIA/nvmath-python
-
NVMath.Net for C# first revision Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
NVIDIA/nvmath-python#61 · 2 reacciones ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
NVIDIA/nvmath-python#56 · 3 comentarios ·
-
NVIDIA/nvmath-python#53 · 3 comentarios · 1 asignado ·
-
Reconsider this approuch Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
NVIDIA/nvmath-python#44 · 2 comentarios ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
NVIDIA/nvmath-python#32 · 2 comentarios · 2 reacciones ·