how to get the evaluation result of gemma4?
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 3/5
- Tiempo estimado
- 1-2 días
- Aptitud para principiantes
- 55/100
- Tipo de issue
- Documentación
- Claridad
- Bastante claro
- Estado de actividad
- Activo
- Stack tecnológico
- jupyter-notebook, python
- Área
- ai, documentation, machine-learning
Línea de trabajo
Look for evaluation scripts or notebooks in the repository, likely under an 'eval' or 'benchmarks' directory. Check the README for instructions on running evaluations. Compare the output format with the leaderboard image to understand the discrepancy. Running the evaluation on Gemma4 and verifying the results against the paper will confirm the process.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
I find that the evaluation result of gemme4 is different from the paper, Could you please share how to evaluate gemma4?
paper:
here:
from leader board
- Lenguaje dominante
- Jupyter Notebook
- Estrellas
- 11.1k
- Forks
- 766
- Merge medio
- 5 h 3 min
- PR fusionados (30 d)
- 6
Preparar el entorno
Aún no hemos revisado los archivos de configuración de este proyecto. Empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de OpenBMB/MiniCPM
-
Verify evals on Papers with CodeAbierto
Dificultad 1/5 Menos de una hora Aptitud para principiantes 78/100
-
Permission request: non-commercial research mirror of tokenized UltraData sets (SHADOW-125M)Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 15/100
-
feature
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
-
Dificultad 3/5 1-2 días Aptitud para principiantes 62/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
Todos los issues de OpenBMB/MiniCPM
Issues similares
-
Docs never explain image replay cost with native-vision models or the tools.media.models[] opt-outAbiertoclawsweeper:linked-pr-open clawsweeper:no-new-fix-pr impact:ux-friction issue-rating: 🌊 off-meta tidepool P2
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
openclaw/openclaw#159202 · 1 comentario · 1 reacción ·
Los mantenedores suelen responder en 1 día
-
comp/tools P2 tool/delegate type/bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
NousResearch/hermes-agent#124460 ·
Los mantenedores suelen responder en 1 día
-
Amazon as Lab ?Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
anomalyco/models.dev#8163 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
python triage
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
microsoft/semantic-kernel#14490 ·
Los mantenedores suelen responder en 2 días
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 84/100
camel-ai/camel#4378 · 1 comentario ·
Los mantenedores suelen responder en 1 día