Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

OVMS load error with HETERO and Qwen3-32B

Abierto
#3,696 13 comentarios 1 reacción 0 asignados Ver en GitHub

Los mantenedores suelen responder en 1 día

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
4/5
Tiempo estimado
3-5 días
Aptitud para principiantes
42/100
Tipo de issue
Error
Claridad
Necesita aclaración
Estado de actividad
Tranquilo
Stack tecnológico
cpp
Área
ai, backend

Línea de trabajo

Comienza reproduciendo la carga de Qwen3-32B con la configuración hetero y los modelos generados por export_model.py. Usa la ruta registrada a través de servable_initializer.cpp, compiled_model.cpp y program_builder.cpp para investigar el fallo CL_INVALID_KERNEL_ARGS. Se considera completado cuando OVMS carga correctamente el modelo en la VRAM con la configuración de GPU indicada.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

bug

Describe the bug
When attempting to load Qwen3-32B with a hetero config, the model_server fails to do so.

To Reproduce
Steps to reproduce the behavior:

  1. Launch ovms with models in directory converted from export_model.py
  2. fail.

Expected behavior
OVMS should load the model into VRAM.

Logs
[2025-10-12 04:26:45.371][367240][modelmanager][debug][modelmanager.cpp:490] Mediapipe graph:Qwen/Qwen3-32B was not loaded so far. Triggering load
[2025-10-12 04:26:45.371][367240][modelmanager][debug][mediapipegraphdefinition.cpp:129] Started validation of mediapipe: Qwen/Qwen3-32B
[2025-10-12 04:26:45.371][367240][modelmanager][debug][mediapipe_utils.cpp:84] setting input stream: input packet type: UNKNOWN from: HTTP_REQUEST_PAYLOAD:input
[2025-10-12 04:26:45.371][367240][modelmanager][debug][mediapipe_utils.cpp:84] setting output stream: output packet type: UNKNOWN from: HTTP_RESPONSE_PAYLOAD:output
[2025-10-12 04:26:45.371][367240][serving][info][mediapipegraphdefinition.cpp:421] MediapipeGraphDefinition initializing graph nodes
[2025-10-12 04:26:45.371][367240][modelmanager][info][servable_initializer.cpp:424] Initializing Language Model Continuous Batching servable
[2025-10-12 04:27:41.099][367240][serving][error][servable_initializer.cpp:145] Error during llm node initialization for models_path: /media/models/Qwen/Qwen3-32B/./ exception: Exception from src/inference/src/cpp/core.cpp:109:
Exception from src/inference/src/dev/plugin.cpp:53:
Exception from src/plugins/hetero/src/compiled_model.cpp:36:
Standard exception from compilation library: Exception from src/inference/src/dev/plugin.cpp:53:
Check 'false' failed at src/plugins/intel_gpu/src/plugin/program_builder.cpp:163:
[GPU] ProgramBuilder build failed!
Exception from src/plugins/intel_gpu/src/runtime/ocl/ocl_common.hpp:40:
[GPU] clEnqueueNDRangeKernel, error code: -52 CL_INVALID_KERNEL_ARGS

Configuration

  1. OVMS version - built from latest.
  2. 11600KF, 3 x A770's with latest drivers.

Additional context
Add any other context about the problem here.

Lenguaje dominante
C++
Estrellas
932
Forks
278
Merge medio
3 d 5 h
PR fusionados (30 d)
70

Preparar el entorno

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de openvinotoolkit/model_server

Todos los issues de openvinotoolkit/model_server

Issues similares

Más issues de C++

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.