Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

A streamlined and customizable framework for efficient large model (LLM, VLM, AIGC) evaluation and performance benchmarking.

¿Es modelscope/evalscope apto para principiantes?

En los últimos 30 días, modelscope/evalscope fusionó 58 de 74 pull requests de colaboradores externos, y sus mantenedores suelen responder en 1 día. Ahora mismo no hay ningún issue apto para principiantes abierto; la lista de abajo muestra los demás issues que tenemos de este repositorio.

Estrellas
3.5k
Forks
505
Issues abiertos para principiantes
0
Issues indexados
39
Merge medio
2 d 14 h
PR fusionados (30 d)
70
Lenguaje dominante
Python
Licencia
Apache-2.0
Último push a GitHub
30/9/2026
Última indexación
20/9/2026
Guía de contribución
Guía de contribución
Código de conducta
Sin código de conducta
Etiquetas para principiantes
Sin etiquetas para principiantes indexadas

Cómo contribuir a modelscope/evalscope

  1. Lee primero la guía de contribución: explica cómo quieren los mantenedores que se propongan, prueben y revisen los cambios.
  2. Tus contribuciones se publicarán bajo la licencia Apache-2.0 del proyecto.
  3. Sigue el repositorio para enterarte cuando se abra un nuevo issue apto para principiantes, o revisa los demás issues de abajo.

Las issues en las que quizá ya trabaja alguien aparecen al final. Ordenar todo por fecha

  • Support Terminal-Bench 4.0 in EvalScope
    Abierto

    Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100

    modelscope/evalscope#1821 ·

    Los mantenedores suelen responder en 1 día

  • perf: uncaught ValueError in parse_responses aborts the whole benchmark run when a successful response has no usage
    Abierto

    Dificultad 2/5 1-3 horas Aptitud para principiantes 85/100

    modelscope/evalscope#1817 ·

    Los mantenedores suelen responder en 1 día

  • 任务是否可以获取当前正在进行的任务?
    Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 45/100

    modelscope/evalscope#1781 ·

    Los mantenedores suelen responder en 1 día

  • 增加模型评估哪些数据集是必做的
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100

    modelscope/evalscope#1779 ·

    Los mantenedores suelen responder en 1 día

  • 是否接入jev类选择模型
    Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 45/100

    modelscope/evalscope#1762 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • mv_bench 评测报错,fine_grained_pose 子数据集截断
    Abierto

    Dificultad 3/5 1-2 días Aptitud para principiantes 45/100

    modelscope/evalscope#1708 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • [bug] omni_doc_bench_v1_6,GLM-OCR两阶段模型,测评精度数值异常
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 52/100

    modelscope/evalscope#1682 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • perf(multi-turn): warmup still drains before the measured window, and benchmark conversations pay a cold first turn
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 52/100

    modelscope/evalscope#1648 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • ifbench评测集指标问题
    Abierto

    Dificultad 3/5 1-2 días Aptitud para principiantes 38/100

    modelscope/evalscope#1606 · 7 comentarios ·

    Los mantenedores suelen responder en 1 día

  • Cross-project discussion: reproducibility, uncertainty and benchmark provenance
    Abierto

    Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100

    modelscope/evalscope#1582 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • [Feature] Framing-robustness benchmark: does a judge's moral verdict survive the act being reworded?
    Abierto

    Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100

    modelscope/evalscope#1540 · 2 comentarios ·

    Los mantenedores suelen responder en 1 día

  • [需求]EvalScope 模型推理性能评测支持 Multi-LoRA 服务的性能评测
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 52/100

    modelscope/evalscope#1493 · 2 comentarios ·

    Los mantenedores suelen responder en 1 día

  • [Feature ] video generate datasets support
    Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 45/100

    modelscope/evalscope#1452 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • Feature proposal: Benchmark pruning via variance-weighted stratified sampling
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100

    modelscope/evalscope#1393 ·

    Los mantenedores suelen responder en 1 día

  • 希望支持tts模型的基准,例如:Seed-TTS-Eval,CPP / g2pM
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100

    modelscope/evalscope#1360 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • 最近很多新模型在toolcall / 代码生成等任务上表现优异,希望evalscope能集成更多相关数据集的支持
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 42/100

    modelscope/evalscope#1278 · 2 comentarios ·

    Los mantenedores suelen responder en 1 día

  • Qwen3_VL_Embedding/Reranker支持
    Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 30/100

    modelscope/evalscope#1151 ·

    Los mantenedores suelen responder en 1 día

  • Audio ASR benchmarks (LibriSpeech / TORGO) fail with 400 Bad Request when using sglang server mode
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 35/100

    modelscope/evalscope#1108 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • BFCL-v4评测复现失败
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 25/100

    modelscope/evalscope#1100 · 6 comentarios ·

    Los mantenedores suelen responder en 1 día

  • 增加对qwen-image模型的性能测试
    Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 35/100

    modelscope/evalscope#979 ·

    Los mantenedores suelen responder en 1 día

  • [🎯 Roadmap] EvalScope Roadmap
    Abierto

    Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100

    modelscope/evalscope#951 · 3 comentarios · 2 reacciones ·

    Los mantenedores suelen responder en 1 día

  • Question: standard vs CoT prompting in API calls
    Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 35/100

    modelscope/evalscope#930 · 5 comentarios ·

    Los mantenedores suelen responder en 1 día

  • Bringing Back Stages for Infer and Predict
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100

    modelscope/evalscope#842 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • 评测基准可以增加安全/合规相关测试数据集吗
    Abierto
    enhancement

    Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100

    modelscope/evalscope#742 ·

    Los mantenedores suelen responder en 1 día

  • embedding和rerank模型性能压测支持
    Abierto

    Dificultad 3/5 1-2 días Aptitud para principiantes 48/100

    modelscope/evalscope#651 · 3 comentarios ·

    Los mantenedores suelen responder en 1 día

  • FewCLUE/cluewsc数据集支持
    Quizá libre de nuevo @JerryChaox la tomó hace 23 días y no hay ningún pull request abierto. Abierto
    enhancement

    Dificultad 3/5 1-2 días Aptitud para principiantes 35/100

    modelscope/evalscope#618 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • 希望支持一下opencompass 的lawbench 法律专业测评集,Lawbench自带评分标准,对接上即可。
    Quizá libre de nuevo @Yunnglin la tomó hace 527 días y no hay ningún pull request abierto. Abierto
    enhancement native

    modelscope/evalscope#527 · 2 comentarios · 1 asignado ·

    Los mantenedores suelen responder en 1 día

  • 如何对 'http://127.0.0.1:9009/v1/completions' 进行 测试
    Quizá libre de nuevo @Yunnglin la tomó hace 570 días y no hay ningún pull request abierto. Abierto
    enhancement native

    modelscope/evalscope#393 · 3 comentarios · 1 asignado ·

    Los mantenedores suelen responder en 1 día

  • Native: reuse the default ModelScope dataset cache without dataset_id
    Posiblemente ocupada @sfeng1996 la tomó hace 9 días. Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 65/100

    modelscope/evalscope#1794 ·

    Los mantenedores suelen responder en 1 día

  • Followup to #1629: CICD Improvements
    Posiblemente ocupada Un pull request vinculado a esta issue está abierto o ya se fusionó. Abierto

    Dificultad 4/5 3-5 días Aptitud para principiantes 30/100

    modelscope/evalscope#1631 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

  • 文生图模型无法调用本地部署的服务
    Posiblemente ocupada @Excelius-Wang la tomó hace 48 días. Abierto
    enhancement

    Dificultad 4/5 3-5 días Aptitud para principiantes 30/100

    modelscope/evalscope#1040 · 1 comentario ·

    Los mantenedores suelen responder en 1 día

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.