Support 1 * 128 and 128 * 128 block-wise quant?

Abierto
#38 2 comentarios 0 reacciones 1 asignado Ver en GitHub

@szkarpinski ya está trabajando en esto.

Desde el 6/8/2025.

Evaluación

Este issue todavía no se ha evaluado.

Descripción

enhancement

In the CUDA 12.9 cuBLASLt documentation, I noticed support for 1×128 and 128×128 block-wise quantization methods. However, I found that nvmath-python currently lacks bindings for this type of quantize approach. I wonder do we have any plan for support this approach?

https://docs.nvidia.com/cuda/cublas/index.html#cublasltmatmulmatrixscale-t

Lenguaje dominante
Cython
Estrellas
601
Forks
46
Métricas de merge de PR
Sin PR fusionados en 30 d

Guía de contribución

Abrir la guía de contribución

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de NVIDIA/nvmath-python

Todos los issues de NVIDIA/nvmath-python

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.