Hacktoberfest 2026: le issue che i maintainer hanno segnato per ottobre, aperte e adatte ai principianti. Sfoglia le issue Hacktoberfest

A streamlined and customizable framework for efficient large model (LLM, VLM, AIGC) evaluation and performance benchmarking.

modelscope/evalscope è adatto ai principianti?

Negli ultimi 30 giorni modelscope/evalscope ha accettato 58 delle 74 pull request di contributori esterni, e i suoi maintainer di solito rispondono entro 1 giorno. Al momento non è aperta nessuna issue adatta ai principianti; l'elenco qui sotto mostra le altre issue che abbiamo per questo repository.

Stelle
3.5k
Fork
505
Issue aperte per principianti
0
Issue indicizzate
39
Merge medio
2g 14h
PR unite (30g)
70
Lingua principale
Python
Licenza
Apache-2.0
Ultimo push su GitHub
30/9/2026
Ultima indicizzazione
20/9/2026
Guida per i contributori
Guida per i contributori
Codice di condotta
Nessun codice di condotta
Label per principianti
Nessuna label per principianti indicizzata

Come contribuire a modelscope/evalscope

  1. Leggi prima la guida per contribuire: spiega come i maintainer vogliono che le modifiche siano proposte, testate e revisionate.
  2. I tuoi contributi saranno pubblicati con la licenza Apache-2.0 del progetto.
  3. Segui il repository per sapere quando si apre una nuova issue adatta ai principianti, oppure guarda le altre issue qui sotto.
Caricamento delle issue

Le issue su cui forse qualcuno sta già lavorando sono in fondo alla lista. Ordina tutto per data

  • Support Terminal-Bench 4.0 in EvalScope
    Aperta

    Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100

    modelscope/evalscope#1821 ·

    I maintainer di solito rispondono entro 1 giorno

  • perf: uncaught ValueError in parse_responses aborts the whole benchmark run when a successful response has no usage
    Aperta

    Difficoltà 2/5 1-3 ore Idoneità per principianti 85/100

    modelscope/evalscope#1817 ·

    I maintainer di solito rispondono entro 1 giorno

  • 任务是否可以获取当前正在进行的任务?
    Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 45/100

    modelscope/evalscope#1781 ·

    I maintainer di solito rispondono entro 1 giorno

  • 增加模型评估哪些数据集是必做的
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100

    modelscope/evalscope#1779 ·

    I maintainer di solito rispondono entro 1 giorno

  • 是否接入jev类选择模型
    Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 45/100

    modelscope/evalscope#1762 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • mv_bench 评测报错,fine_grained_pose 子数据集截断
    Aperta

    Difficoltà 3/5 1-2 giorni Idoneità per principianti 45/100

    modelscope/evalscope#1708 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • [bug] omni_doc_bench_v1_6,GLM-OCR两阶段模型,测评精度数值异常
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 52/100

    modelscope/evalscope#1682 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • perf(multi-turn): warmup still drains before the measured window, and benchmark conversations pay a cold first turn
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 52/100

    modelscope/evalscope#1648 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • ifbench评测集指标问题
    Aperta

    Difficoltà 3/5 1-2 giorni Idoneità per principianti 38/100

    modelscope/evalscope#1606 · 7 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • Cross-project discussion: reproducibility, uncertainty and benchmark provenance
    Aperta

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100

    modelscope/evalscope#1582 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • [Feature] Framing-robustness benchmark: does a judge's moral verdict survive the act being reworded?
    Aperta

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100

    modelscope/evalscope#1540 · 2 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • [需求]EvalScope 模型推理性能评测支持 Multi-LoRA 服务的性能评测
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 52/100

    modelscope/evalscope#1493 · 2 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • [Feature ] video generate datasets support
    Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 45/100

    modelscope/evalscope#1452 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • Feature proposal: Benchmark pruning via variance-weighted stratified sampling
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100

    modelscope/evalscope#1393 ·

    I maintainer di solito rispondono entro 1 giorno

  • 希望支持tts模型的基准,例如:Seed-TTS-Eval,CPP / g2pM
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100

    modelscope/evalscope#1360 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • 最近很多新模型在toolcall / 代码生成等任务上表现优异,希望evalscope能集成更多相关数据集的支持
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 42/100

    modelscope/evalscope#1278 · 2 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • Qwen3_VL_Embedding/Reranker支持
    Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 30/100

    modelscope/evalscope#1151 ·

    I maintainer di solito rispondono entro 1 giorno

  • Audio ASR benchmarks (LibriSpeech / TORGO) fail with 400 Bad Request when using sglang server mode
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 35/100

    modelscope/evalscope#1108 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • BFCL-v4评测复现失败
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 25/100

    modelscope/evalscope#1100 · 6 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • 增加对qwen-image模型的性能测试
    Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 35/100

    modelscope/evalscope#979 ·

    I maintainer di solito rispondono entro 1 giorno

  • [🎯 Roadmap] EvalScope Roadmap
    Aperta

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100

    modelscope/evalscope#951 · 3 commenti · 2 reazioni ·

    I maintainer di solito rispondono entro 1 giorno

  • Question: standard vs CoT prompting in API calls
    Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 35/100

    modelscope/evalscope#930 · 5 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • Bringing Back Stages for Infer and Predict
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100

    modelscope/evalscope#842 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • 评测基准可以增加安全/合规相关测试数据集吗
    Aperta
    enhancement

    Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100

    modelscope/evalscope#742 ·

    I maintainer di solito rispondono entro 1 giorno

  • embedding和rerank模型性能压测支持
    Aperta

    Difficoltà 3/5 1-2 giorni Idoneità per principianti 48/100

    modelscope/evalscope#651 · 3 commenti ·

    I maintainer di solito rispondono entro 1 giorno

  • FewCLUE/cluewsc数据集支持
    Forse di nuovo libera @JerryChaox l’ha presa 24 giorni fa e non c’è nessuna pull request aperta. Aperta
    enhancement

    Difficoltà 3/5 1-2 giorni Idoneità per principianti 35/100

    modelscope/evalscope#618 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • 希望支持一下opencompass 的lawbench 法律专业测评集,Lawbench自带评分标准,对接上即可。
    Forse di nuovo libera @Yunnglin l’ha presa 527 giorni fa e non c’è nessuna pull request aperta. Aperta
    enhancement native

    modelscope/evalscope#527 · 2 commenti · 1 assegnatario ·

    I maintainer di solito rispondono entro 1 giorno

  • 如何对 'http://127.0.0.1:9009/v1/completions' 进行 测试
    Forse di nuovo libera @Yunnglin l’ha presa 570 giorni fa e non c’è nessuna pull request aperta. Aperta
    enhancement native

    modelscope/evalscope#393 · 3 commenti · 1 assegnatario ·

    I maintainer di solito rispondono entro 1 giorno

  • Native: reuse the default ModelScope dataset cache without dataset_id
    Forse già presa @sfeng1996 l’ha presa 9 giorni fa. Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 65/100

    modelscope/evalscope#1794 ·

    I maintainer di solito rispondono entro 1 giorno

  • Followup to #1629: CICD Improvements
    Forse già presa Una pull request collegata a questa issue è aperta o già unita. Aperta

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 30/100

    modelscope/evalscope#1631 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

  • 文生图模型无法调用本地部署的服务
    Forse già presa @Excelius-Wang l’ha presa 48 giorni fa. Aperta
    enhancement

    Difficoltà 4/5 3-5 giorni Idoneità per principianti 30/100

    modelscope/evalscope#1040 · 1 commento ·

    I maintainer di solito rispondono entro 1 giorno

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.