OVMS 2026.1-gpu fails to load OpenVINO/gemma-4-E4B-it-int4-ov with Unsupported 'gemma4' VLM model type
I maintainer di solito rispondono entro 1 giorno
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Idoneità per principianti
- 45/100
- Tipo di issue
- Bug
- Chiarezza
- Abbastanza chiara
- Stato di attività
- Tranquilla
- Stack tecnologico
- cpp, docker
- Ambito
- backend, machine-learning
Direzione di ricerca
Riprodurre il fallimento all’avvio con l’immagine openvino/model_server:2026.1-gpu e il modello Gemma4 indicato. Confrontare il comportamento incluso con src/cpp/src/visual_language/vlm_config.cpp, dove l’issue indica il mapping di gemma4, e verificare le versioni del backend riportate. Il lavoro è completato quando si è stabilito se l’immagine distribuita supporta Gemma4 e si è corretta la compatibilità oppure si è documentata chiaramente la limitazione.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Describe the bug
OVMS fails to load the VLM model OpenVINO/gemma-4-E4B-it-int4-ov and exits during initialization with:
Unsupported 'gemma4' VLM model type
This happens when running openvino/model_server:2026.1-gpu.
The behavior appears inconsistent with the current openvinotoolkit/openvino.genai source, where gemma4 is explicitly recognized in VLM config parsing.
To Reproduce
-
Prepare a model repository containing:
models/OpenVINO/gemma-4-E4B-it-int4-ov/- The model used is
OpenVINO/gemma-4-E4B-it-int4-ov
-
Launch OVMS:
docker run -it --rm \ -p 8000:8000 \ --device /dev/dri \ --group-add=$(stat -c "%g" /dev/dri/render* | head -n 1) \ -v $(pwd)/models:/models:ro \ openvino/model_server:2026.1-gpu \ --rest_port 8000 \ --model_name OpenVINO/gemma-4-E4B-it-int4-ov \ --model_path ./models/OpenVINO/gemma-4-E4B-it-int4-ov/ -
No client request is needed. The failure happens during model initialization at server startup.
-
Observe the error:
Error during llm node initialization ... Unsupported 'gemma4' VLM model type
Expected behavior
OVMS should recognize model_type: "gemma4" and initialize the model successfully, or the image/docs should clearly state that Gemma4 is not supported by this OVMS image.
Logs
Startup version info:
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:88] OpenVINO Model Server 2026.1.0.72cc06244
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:89] OpenVINO backend 2026.1.0-21367-63e31528c62-releases/2026/1
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:92] OpenVINO GenAI backend 2026.1.0.0-2957-1dabb8c2255
Relevant failure logs:
[2026-05-05 08:06:22.232][1][modelmanager][info][servable_initializer.cpp:448] Initializing Visual Language Model Continuous Batching servable
[2026-05-05 08:06:23.062][1][serving][error][servable_initializer.cpp:214] Error during llm node initialization for models_path: //./models/OpenVINO/gemma-4-E4B-it-int4-ov/./ exception: Exception from ../../../../../repos/openvino.genai/src/cpp/src/visual_language/vlm_config.cpp:34:
Unsupported 'gemma4' VLM model type
[2026-05-05 08:06:23.062][1][modelmanager][error][servable_initializer.cpp:453] Error during LLM node resources initialization: The LLM Node resource initialization failed
[2026-05-05 08:06:23.062][1][serving][error][mediapipegraphdefinition.cpp:474] Failed to process LLM node graph OpenVINO/gemma-4-E4B-it-int4-ov
[2026-05-05 08:06:23.062][1][modelmanager][info][pipelinedefinitionstatus.hpp:59] Mediapipe: OpenVINO/gemma-4-E4B-it-int4-ov state changed to: LOADING_PRECONDITION_FAILED after handling: ValidationFailedEvent:
[2026-05-05 08:06:23.062][1][modelmanager][error][modelmanager.cpp:184] Couldn't start model manager
[2026-05-05 08:06:23.062][1][serving][error][servablemanagermodule.cpp:58] ovms::ModelManager::Start() Error: The LLM Node resource initialization failed
There is no client log because the server fails before serving requests.
Configuration
-
OVMS version:
openvino/model_server:2026.1-gpu- Logged as:
OpenVINO Model Server 2026.1.0.72cc06244
-
OVMS config.json file:
- Not used
- Model was provided via CLI arguments:
--model_name OpenVINO/gemma-4-E4B-it-int4-ov--model_path ./models/OpenVINO/gemma-4-E4B-it-int4-ov/
-
CPU / accelerator versions if applicable:
- OpenVINO backend:
2026.1.0-21367-63e31528c62-releases/2026/1 - OpenVINO GenAI backend:
2026.1.0.0-2957-1dabb8c2255 - Device exposed in container: GPU via
/dev/dri
- OpenVINO backend:
-
Model repository directory structure:
models/ └── OpenVINO/ └── gemma-4-E4B-it-int4-ov/ ├── config.json ├── preprocessor_config.json ├── tokenizer.json ├── tokenizer_config.json ├── openvino_language_model.xml ├── openvino_language_model.bin ├── ... -
Model or publicly available similar model that reproduces the issue:
OpenVINO/gemma-4-E4B-it-int4-ov
Additional context
The current openvinotoolkit/openvino.genai source appears to support gemma4 in VLM config parsing, for example in src/cpp/src/visual_language/vlm_config.cpp, where gemma4 is mapped to VLMModelType::GEMMA4.
Because of that, this looks like one of:
- OVMS
2026.1-gpudoes not actually include effective Gemma4 support yet - the bundled GenAI backend is inconsistent with the source support
- Gemma4 support exists in
openvino.genairepo but is not yet supported in the shipped OVMS image
If helpful, I can test a nightly image or provide additional model files / exact directory contents.
- Lingua principale
- C++
- Stelle
- 932
- Fork
- 278
- Merge medio
- 3g 5h
- PR unite (30g)
- 70
Preparare l'ambiente
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di openvinotoolkit/model_server
-
Difficoltà 3/5 1-2 giorni Idoneità per principianti 58/100
openvinotoolkit/model_server#4613 · 1 assegnatario ·
I maintainer di solito rispondono entro 1 giorno
-
enhancement
Difficoltà 3/5 1-2 giorni Idoneità per principianti 68/100
openvinotoolkit/model_server#4609 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
`/v3/models` lists every model twice when `group_name` and `--idle_unload_timeout_seconds` are combinedForse già presa @atobiszei l’ha presa 5 giorni fa. Aperta
openvinotoolkit/model_server#4604 · 1 reazione · 1 assegnatario ·
I maintainer di solito rispondono entro 1 giorno
-
Idle unload never happens again if the client disconnects while a sleeping graph is waking upForse già presa @atobiszei l’ha presa 5 giorni fa. Aperta
openvinotoolkit/model_server#4603 · 1 assegnatario ·
I maintainer di solito rispondono entro 1 giorno
-
bug
Difficoltà 4/5 3-5 giorni Idoneità per principianti 45/100
openvinotoolkit/model_server#4599 · 4 commenti ·
I maintainer di solito rispondono entro 1 giorno
Tutte le issue di openvinotoolkit/model_server
Issue simili
-
component: split-view platform: windows
Difficoltà 2/5 1-3 ore Idoneità per principianti 74/100
zen-browser/desktop#15616 · 1 reazione ·
I maintainer di solito rispondono entro 1 giorno
-
area/ysql kind/bug priority/medium status/awaiting-triage
Difficoltà 2/5 1-3 ore Idoneità per principianti 84/100
yugabyte/yugabyte-db#34415 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 86/100
WayfireWM/wayfire#3148 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
bug
Difficoltà 2/5 1-3 ore Idoneità per principianti 84/100
I maintainer di solito rispondono entro 1 giorno
-
backend:DirectX
Difficoltà 2/5 1-3 ore Idoneità per principianti 84/100
llvm/llvm-project#227530 ·
I maintainer di solito rispondono entro 1 giorno