OVMS 2026.1-gpu fails to load OpenVINO/gemma-4-E4B-it-int4-ov with Unsupported 'gemma4' VLM model type
メンテナーはふだん 1 日以内に返信
まだ誰も着手していません。
評価
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 初心者へのやさしさ
- 45/100
- issue の種類
- バグ
- 明瞭さ
- おおむね明確
- 活発さ
- 静か
- 技術スタック
- cpp, docker
調査の方向性
openvino/model_server:2026.1-gpu イメージと、記載されている Gemma4 モデルを使って起動失敗を再現します。issue で gemma4 のマッピングに言及されている src/cpp/src/visual_language/vlm_config.cpp と、バンドルされた動作を比較し、報告されているバックエンドのバージョンを確認します。完了条件は、配布されているイメージが Gemma4 をサポートしているかを明らかにし、サポートを修正するか、制限事項を明確に文書化することです。
索引モデルが issue の本文から書いたものです。
説明
Describe the bug
OVMS fails to load the VLM model OpenVINO/gemma-4-E4B-it-int4-ov and exits during initialization with:
Unsupported 'gemma4' VLM model type
This happens when running openvino/model_server:2026.1-gpu.
The behavior appears inconsistent with the current openvinotoolkit/openvino.genai source, where gemma4 is explicitly recognized in VLM config parsing.
To Reproduce
-
Prepare a model repository containing:
models/OpenVINO/gemma-4-E4B-it-int4-ov/- The model used is
OpenVINO/gemma-4-E4B-it-int4-ov
-
Launch OVMS:
docker run -it --rm \ -p 8000:8000 \ --device /dev/dri \ --group-add=$(stat -c "%g" /dev/dri/render* | head -n 1) \ -v $(pwd)/models:/models:ro \ openvino/model_server:2026.1-gpu \ --rest_port 8000 \ --model_name OpenVINO/gemma-4-E4B-it-int4-ov \ --model_path ./models/OpenVINO/gemma-4-E4B-it-int4-ov/ -
No client request is needed. The failure happens during model initialization at server startup.
-
Observe the error:
Error during llm node initialization ... Unsupported 'gemma4' VLM model type
Expected behavior
OVMS should recognize model_type: "gemma4" and initialize the model successfully, or the image/docs should clearly state that Gemma4 is not supported by this OVMS image.
Logs
Startup version info:
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:88] OpenVINO Model Server 2026.1.0.72cc06244
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:89] OpenVINO backend 2026.1.0-21367-63e31528c62-releases/2026/1
[2026-05-05 08:15:34.612][1][serving][info][server.cpp:92] OpenVINO GenAI backend 2026.1.0.0-2957-1dabb8c2255
Relevant failure logs:
[2026-05-05 08:06:22.232][1][modelmanager][info][servable_initializer.cpp:448] Initializing Visual Language Model Continuous Batching servable
[2026-05-05 08:06:23.062][1][serving][error][servable_initializer.cpp:214] Error during llm node initialization for models_path: //./models/OpenVINO/gemma-4-E4B-it-int4-ov/./ exception: Exception from ../../../../../repos/openvino.genai/src/cpp/src/visual_language/vlm_config.cpp:34:
Unsupported 'gemma4' VLM model type
[2026-05-05 08:06:23.062][1][modelmanager][error][servable_initializer.cpp:453] Error during LLM node resources initialization: The LLM Node resource initialization failed
[2026-05-05 08:06:23.062][1][serving][error][mediapipegraphdefinition.cpp:474] Failed to process LLM node graph OpenVINO/gemma-4-E4B-it-int4-ov
[2026-05-05 08:06:23.062][1][modelmanager][info][pipelinedefinitionstatus.hpp:59] Mediapipe: OpenVINO/gemma-4-E4B-it-int4-ov state changed to: LOADING_PRECONDITION_FAILED after handling: ValidationFailedEvent:
[2026-05-05 08:06:23.062][1][modelmanager][error][modelmanager.cpp:184] Couldn't start model manager
[2026-05-05 08:06:23.062][1][serving][error][servablemanagermodule.cpp:58] ovms::ModelManager::Start() Error: The LLM Node resource initialization failed
There is no client log because the server fails before serving requests.
Configuration
-
OVMS version:
openvino/model_server:2026.1-gpu- Logged as:
OpenVINO Model Server 2026.1.0.72cc06244
-
OVMS config.json file:
- Not used
- Model was provided via CLI arguments:
--model_name OpenVINO/gemma-4-E4B-it-int4-ov--model_path ./models/OpenVINO/gemma-4-E4B-it-int4-ov/
-
CPU / accelerator versions if applicable:
- OpenVINO backend:
2026.1.0-21367-63e31528c62-releases/2026/1 - OpenVINO GenAI backend:
2026.1.0.0-2957-1dabb8c2255 - Device exposed in container: GPU via
/dev/dri
- OpenVINO backend:
-
Model repository directory structure:
models/ └── OpenVINO/ └── gemma-4-E4B-it-int4-ov/ ├── config.json ├── preprocessor_config.json ├── tokenizer.json ├── tokenizer_config.json ├── openvino_language_model.xml ├── openvino_language_model.bin ├── ... -
Model or publicly available similar model that reproduces the issue:
OpenVINO/gemma-4-E4B-it-int4-ov
Additional context
The current openvinotoolkit/openvino.genai source appears to support gemma4 in VLM config parsing, for example in src/cpp/src/visual_language/vlm_config.cpp, where gemma4 is mapped to VLMModelType::GEMMA4.
Because of that, this looks like one of:
- OVMS
2026.1-gpudoes not actually include effective Gemma4 support yet - the bundled GenAI backend is inconsistent with the source support
- Gemma4 support exists in
openvino.genairepo but is not yet supported in the shipped OVMS image
If helpful, I can test a nightly image or provide additional model files / exact directory contents.
- 主要言語
- C++
- スター
- 940
- フォーク
- 278
- 平均マージ
- 3日 4時間
- マージ済み PR(30日)
- 68
環境構築
- Dockerfile・Docker Compose ファイルなし
- プルリクエストのテンプレートあり
- コントリビューションガイドを読む
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
openvinotoolkit/model_server のほかの issue
-
難易度 3/5 1〜2日 初心者へのやさしさ 58/100
openvinotoolkit/model_server#4613 · 担当者 1 名 ·
メンテナーはふだん 1 日以内に返信
-
enhancement
難易度 3/5 1〜2日 初心者へのやさしさ 68/100
openvinotoolkit/model_server#4609 · コメント 1 件 ·
メンテナーはふだん 1 日以内に返信
-
Idle unload never happens again if the client disconnects while a sleeping graph is waking up対応中かも @atobiszei が 5 日前に担当しました。 オープン
openvinotoolkit/model_server#4603 · 担当者 1 名 ·
メンテナーはふだん 1 日以内に返信
-
bug
難易度 4/5 3〜5日 初心者へのやさしさ 45/100
openvinotoolkit/model_server#4599 · コメント 4 件 ·
メンテナーはふだん 1 日以内に返信
-
難易度 3/5 1〜2日 初心者へのやさしさ 55/100
openvinotoolkit/model_server#4586 · コメント 5 件 ·
メンテナーはふだん 1 日以内に返信
openvinotoolkit/model_server の issue をすべて見る
似ている issue
-
難易度 2/5 1〜3時間 初心者へのやさしさ 75/100
mpfaffenberger/privateer_reimagined#658 ·
メンテナーはふだん 1 日以内に返信
-
難易度 1/5 1時間未満 初心者へのやさしさ 85/100
microsoft/onnxruntime#33018 ·
メンテナーはふだん 2 日以内に返信
-
難易度 2/5 1〜3時間 初心者へのやさしさ 82/100
AXERA-TECH/ax-llm#81 ·
-
enhancement
難易度 2/5 半日 初心者へのやさしさ 78/100
ros-industrial/ros2_canopen#448 ·
-
難易度 1/5 1時間未満 初心者へのやさしさ 78/100
メンテナーはふだん 1 日以内に返信