Questions about test_float8_blockwise_gemm_exact.py
Los mantenedores suelen responder en 2 días
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Aptitud para principiantes
- 35/100
- Tipo de issue
- Error
- Claridad
- Necesita aclaración
- Estado de actividad
- Tranquilo
- Área
- testing-qa
Línea de trabajo
Lea test_float8_blockwise_gemm_exact.py y siga la referencia de float8_blockwise_gemm a través de torch._scaled_mm. Compare esa ruta con cublasLtMatmul y la llamada a TE blockwise GEMM; después, documente si la prueba detecta de forma independiente un resultado incorrecto de BLAS GEMM y aclare el propósito de la prueba.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Hello :
We notice that the ref function in float8_blockwise_gemm is torch._scaled_mm, however torch._scaled_mm may call cublasLtMatmul , which is same to what TE blockwise gemm calls.
So I'm confused that this utest will pass even when the blas gemm returns wrong result. What is the purpose of this utest?
- Lenguaje dominante
- Python
- Estrellas
- 3.6k
- Forks
- 844
- Merge medio
- 4 d 55 min
- PR fusionados (30 d)
- 51
Preparar el entorno
- Sin Dockerfile ni archivo de Docker Compose
- Tiene una plantilla de pull request
- Leer la guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de NVIDIA/TransformerEngine
-
[PyTorch] fp8_cs_quantize fake implementation returns a vector inverse scale instead of a scalarAbierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
NVIDIA/TransformerEngine#3636 ·
Los mantenedores suelen responder en 2 días
-
[Bug] Backend selection picks FA3 for training with head_dim_qk=192 / v_head_dim=128, but FA3 backward cannot run itPosiblemente ocupada @yuweih205 la tomó hace 30 días. Abiertoattention
Dificultad 2/5 1-3 horas Aptitud para principiantes 85/100
NVIDIA/TransformerEngine#3481 · 4 comentarios ·
Los mantenedores suelen responder en 2 días
-
Increase MAX_TENSOR_NUMAbiertobug
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
NVIDIA/TransformerEngine#2189 · 7 comentarios · 5 reacciones ·
Los mantenedores suelen responder en 2 días
-
bug
Dificultad 4/5 3-5 días Aptitud para principiantes 54/100
NVIDIA/TransformerEngine#3640 · 5 comentarios ·
Los mantenedores suelen responder en 2 días
-
[BUG] Grouped MXFP8 quantization is not concurrency safe with multiple streamsPosiblemente ocupada @kainzhong la tomó hace 1 día. Abiertobug
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
NVIDIA/TransformerEngine#3630 ·
Los mantenedores suelen responder en 2 días
Todos los issues de NVIDIA/TransformerEngine
Issues similares
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 85/100
Vector35/community-plugins#376 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
py-econometrics/pyfixest#1883 ·
Los mantenedores suelen responder en 1 día
-
bad links in rfc5890.htmlAbierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 65/100
ietf-tools/rfc2html#81 ·
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 88/100
mysql/mysql-operator#60 ·
-
Python: Bug: split_plaintext_paragraph / split_markdown_paragraph can return a chunk larger than max_tokensPosiblemente ocupada @xThreeh la tomó hoy. Abiertopython triage
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
microsoft/semantic-kernel#14566 ·
Los mantenedores suelen responder en 4 días