Hacktoberfest 2026:メンテナが10月に向けて印を付けた、オープンで初心者向けの issue。 Hacktoberfest の issue を見る

🤗 Evaluate: A library for easily evaluating machine learning models and datasets.

huggingface/evaluate は初心者に優しい?

huggingface/evaluate のメンテナーはふだん 1 日以内に PR へ返信します。 初心者向けの issue が現在 7 件オープンです。

スター
2.5k
フォーク
346
オープンの初心者向け issue
7
索引済み issue
196
平均マージ
38分
マージ済み PR(30日)
4
主要言語
Python
ライセンス
Apache-2.0
最終 GitHub push
2026年10月6日
最新の索引
2026年9月17日
コントリビューションガイド
コントリビューションガイド
行動規範
行動規範
初心者向けラベル
初心者向けラベルは索引されていません

huggingface/evaluate にコントリビュートするには

  1. まずコントリビューションガイドを読みましょう。変更の提案、テスト、レビューの進め方が書かれています。
  2. 行動規範も読んでおきましょう。チャットだけでなく issue や PR にも適用されます。
  3. あなたのコントリビュートはプロジェクトの Apache-2.0 ライセンスで公開されます。
  4. 下にある 7 件の初心者向けのオープンな issue から 1 つ選び、作業を始める前に取り組みたいとコメントしましょう。
issue を読み込んでいます

誰かが対応中かもしれないイシューは最後に並べています。 すべて日付順に表示

  • EvalPort export/import helpers for bridging evaluate's aggregate-only API to portable per-example results
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 35/100

    huggingface/evaluate#800 ·

    メンテナーはふだん 1 日以内に返信

  • Proposal: Make SQuAD QA F1 logic reusable as a generic QA metric in `evaluate`
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 30/100

    huggingface/evaluate#724 ·

    メンテナーはふだん 1 日以内に返信

  • FileNotFoundError: Couldn't find a module script at /workspace/[email protected]/VLM/evaluate/meteor/meteor.py. Module 'meteor' doesn't exist on the Hugging Face Hub either.
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 48/100

    huggingface/evaluate#723 ·

    メンテナーはふだん 1 日以内に返信

  • bug: huggingface-hub 1.0.0 release breaks existing evaluate releases
    再び着手できるかも このイシューのプルリクエストはマージされずにクローズされました。 オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 42/100

    huggingface/evaluate#712 · コメント 7 件 · リアクション 2 件 ·

    メンテナーはふだん 1 日以内に返信

  • Unable to reproduce example results using the Unbabel/wmt22-comet-da model
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#711 ·

    メンテナーはふだん 1 日以内に返信

  • Questions around perplexity metric for language modeling
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 32/100

    huggingface/evaluate#688 ·

    メンテナーはふだん 1 日以内に返信

  • False/misleading instruction to use different checkpoints of BLEURT
    再び着手できるかも このイシューのプルリクエストはマージされずにクローズされました。 オープン

    難易度 1/5 1時間未満 初心者へのやさしさ 62/100

    huggingface/evaluate#679 · リアクション 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • `rouge` is not available
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#678 · リアクション 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • `import` is very slow
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#674 · リアクション 3 件 ·

    メンテナーはふだん 1 日以内に返信

  • comet doesn't work when gpu=0
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#673 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • Feature Request: Add support for retrieving mispredicted examples with predictions and ground truth
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 35/100

    huggingface/evaluate#672 ·

    メンテナーはふだん 1 日以内に返信

  • Issue in evaluate.EvaluationModule.add
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 52/100

    huggingface/evaluate#670 ·

    メンテナーはふだん 1 日以内に返信

  • Question: ROC_AUC metric compute signature with prediction_scores
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 25/100

    huggingface/evaluate#660 ·

    メンテナーはふだん 1 日以内に返信

  • Calculating F1 fails due to error(AttributeError: 'float' object has no attribute 'size')
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 45/100

    huggingface/evaluate#658 · コメント 2 件 ·

    メンテナーはふだん 1 日以内に返信

  • FileNotFoundError: Couldn't find a module script at /home/tooko/transformers-course/glue/glue.py.
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 30/100

    huggingface/evaluate#651 · リアクション 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • Evaluation took so much disk
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 25/100

    huggingface/evaluate#649 ·

    メンテナーはふだん 1 日以内に返信

  • evaluate.load() does not work while loading word_count
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#648 ·

    メンテナーはふだん 1 日以内に返信

  • TypeError: 'NoneType' object is not callable
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 30/100

    huggingface/evaluate#647 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • FileNotFoundError: Couldn't find a module script at /mnt/data/dingtian/exact_match/exact_match.py. Module 'exact_match' doesn't exist on the Hugging Face Hub either.
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#645 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • [FR] Binoculars as a new metric
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#644 ·

    メンテナーはふだん 1 日以内に返信

  • Perplexity for quantized models
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 25/100

    huggingface/evaluate#643 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • ImportError: To be able to use evaluate-metric/glue, you need to install the following dependencies['scipy', 'scikit-learn'] using 'pip install scipy sklearn' for instance'
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 35/100

    huggingface/evaluate#642 · コメント 3 件 ·

    メンテナーはふだん 1 日以内に返信

  • Optionally stop data deletion after compute
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#641 ·

    メンテナーはふだん 1 日以内に返信

  • Perplexity for Left Padded Models
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#636 ·

    メンテナーはふだん 1 日以内に返信

  • CI parity test is broken due to FileNotFoundError
    再び着手できるかも @albertvillanova が 759 日前に担当しましたが、オープン中のプルリクエストはありません。 オープン

    huggingface/evaluate#632 · 担当者 1 名 ·

    メンテナーはふだん 1 日以内に返信

  • `list_evaluation_modules` returns empty list
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 42/100

    huggingface/evaluate#616 · コメント 4 件 ·

    メンテナーはふだん 1 日以内に返信

  • Benchmark evaluation for language models.
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 25/100

    huggingface/evaluate#615 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • Unable to compute f1 score - Throwing Value Error trying to convert a string in non english Language to integer
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 25/100

    huggingface/evaluate#610 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • AttributeError: module 'evaluate' has no attribute 'load'
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 25/100

    huggingface/evaluate#609 · コメント 8 件 ·

    メンテナーはふだん 1 日以内に返信

  • [Metrics] ValueError: Expected to find locked file from process x but it doesn't exist.
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 32/100

    huggingface/evaluate#607 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • Gradio dependency issue
    オープン

    難易度 1/5 1〜3時間 初心者へのやさしさ 45/100

    huggingface/evaluate#602 · コメント 2 件 ·

    メンテナーはふだん 1 日以内に返信

  • LocalModuleTest.test_load_metric_code_eval fails with "The "code_eval" metric executes untrusted model-generated code in Python."
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#597 ·

    メンテナーはふだん 1 日以内に返信

  • Evaluation of empty strings with MAUVE results in error
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#593 ·

    メンテナーはふだん 1 日以内に返信

  • SyntaxError: closing parenthesis '}'
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 35/100

    huggingface/evaluate#592 · コメント 3 件 ·

    メンテナーはふだん 1 日以内に返信

  • Problems during run initial step
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 25/100

    huggingface/evaluate#590 · コメント 12 件 ·

    メンテナーはふだん 1 日以内に返信

  • Can't load exist dataset for evaluation
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 25/100

    huggingface/evaluate#589 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • [Question]Shall we adding a faster BLEU score calculator?
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 25/100

    huggingface/evaluate#586 ·

    メンテナーはふだん 1 日以内に返信

  • How to pass generation_kwargs to the TextGeneration evaluator ?
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 25/100

    huggingface/evaluate#582 ·

    メンテナーはふだん 1 日以内に返信

  • [FR] Confidence intervals for metrics
    オープン

    難易度 5/5 1週間以上 初心者へのやさしさ 35/100

    huggingface/evaluate#581 ·

    メンテナーはふだん 1 日以内に返信

  • Unable to run pip install evaluate[template]
    再び着手できるかも このイシューのプルリクエストはマージされずにクローズされました。 オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 35/100

    huggingface/evaluate#576 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • Perplexity metric does not apply batching correctly to tokenization
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 30/100

    huggingface/evaluate#573 · コメント 1 件 · リアクション 4 件 ·

    メンテナーはふだん 1 日以内に返信

  • METEOR has no option to return unaggregated results
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 52/100

    huggingface/evaluate#572 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • [Question] How to have no preset values sent into `.compute()`
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#570 ·

    メンテナーはふだん 1 日以内に返信

  • Allow for specify coda device in perplexity evaluation
    オープン

    難易度 2/5 1〜3時間 初心者へのやさしさ 52/100

    huggingface/evaluate#568 ·

    メンテナーはふだん 1 日以内に返信

  • Cannot use it offline!
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 25/100

    huggingface/evaluate#567 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • ValueError: Predictions and/or references don't match the expected format.
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 45/100

    huggingface/evaluate#563 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • It seems like evaluate.load doesnt use
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 42/100

    huggingface/evaluate#561 ·

    メンテナーはふだん 1 日以内に返信

  • Is perplexity correctly computed?
    オープン

    難易度 4/5 3〜5日 初心者へのやさしさ 35/100

    huggingface/evaluate#560 · コメント 6 件 ·

    メンテナーはふだん 1 日以内に返信

  • the difference of your bleu and sacrebleu
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 25/100

    huggingface/evaluate#558 · コメント 1 件 ·

    メンテナーはふだん 1 日以内に返信

  • After fine-tuning Gemma and want to evaluate performance: AttributeError: module 'keras._tf_keras.keras' has no attribute '__internal__'
    オープン

    難易度 3/5 1〜2日 初心者へのやさしさ 35/100

    huggingface/evaluate#555 ·

    メンテナーはふだん 1 日以内に返信

最新の 100 件のみ表示しています

このページには最近登録されたものだけが並びます。全件は詳細フィルターにあり、言語・難易度・所要時間で絞り込めます。

詳細フィルターへ

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。