Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

Qualify HRX dense WMMA after Loom removes a live template provider

Abierto
#3,081 0 comentarios 0 reacciones 0 asignados Ver en GitHub

Los mantenedores suelen responder en 1 día

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
5/5
Tiempo estimado
Más de una semana
Aptitud para principiantes
35/100
Tipo de issue
Error
Claridad
Bastante claro
Estado de actividad
Activo
Stack tecnológico
cpp
Área
compilers

Línea de trabajo

Comienza con la evidencia de #3080 y reproduce el fallo usando loom-link y loom-compile sin modificar; después inspecciona loom/src/loom/transforms/symbol/template_selection.c:585 y el comportamiento de inline-callables. Usa test-hrx-ops y la receta exacta de WMMA densa como comprobaciones de cualificación. Se considera terminado cuando una regresión upstream-native falla antes de la corrección, las dependencias activas del proveedor sobreviven al inlining, la receta exacta compila y la revisión independiente y la prueba de operación nativa pasan.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

Row: BACKEND-ROCM

Native HRX qualification for #3080 fails because Loom removes a live template provider during dense WMMA compilation. This issue owns the bounded compiler repair and its qualification evidence.

At ROCm/hrx-system 6bcd5a4ff111fa5bf160ab9f4592ca8e7cc810b1 and AMD-Ecosystem/llama.cpp 6319038132ed12f968ea68f37753f705da830ea8, test-hrx-ops on an RX 7900 XTX fails at the first Q4_K dense WMMA case: input_size=2048, output_size=128, token_count=2, output_accumulation=0, output_unary_op=23, weight_format=4. The native backend detects gfx1100 successfully.

Unmodified loom-link plus loom-compile reproduces the same failure without a GPU. The first template selection succeeds. inline-callables then removes template definitions while scalar template calls to ggml_unary_f32_apply remain. The next selection reports template.call callee has no template provider contract at loom/src/loom/transforms/symbol/template_selection.c:585.

The owning operator retains the exact linked recipe, pass snapshots, source pins, commands, and failed GPU run under the #3080 evidence. The repair must add an upstream-native regression that fails before the change, preserve live provider dependencies through inlining, compile the exact dense recipe, and pass independent review. Root reruns the native operation test. Do not weaken a verifier, tolerance, or operation contract, and do not treat this failure as a gfx1100 hardware limitation.

Use a committed scoped spec before implementation. The #3080 operator owns the work and the eventual disposition of the upstream patch. Native performance remains unaccepted until its declared correctness gate passes.

Lenguaje dominante
C++
Estrellas
440
Forks
55
Merge medio
1 d 4 h
PR fusionados (30 d)
366

Preparar el entorno

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de mudler/vllm.cpp

Todos los issues de mudler/vllm.cpp

Issues similares

Más issues de C++

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.