Test set
まだ誰も着手していません。
評価
- 難易度
- 5/5
- 見積もり時間
- 1週間以上
- 初心者へのやさしさ
- 35/100
- issue の種類
- 機能追加
- 明瞭さ
- 説明が足りない
- 活発さ
- 静か
- 技術スタック
- python
調査の方向性
まずリポジトリのベンチマーク例を確認し、Hugging Face のデータが公開されているかどうかを調べます。非公開の評価セットが存在するか、またはその例をトレーニングに公開せずに 10–20% の分割が可能かどうかを判断します。文書化された決定と合意済みのデータセットポリシーがあれば完了とします。
索引モデルが issue の本文から書いたものです。
説明
Hey just wondering if there's a held out set for these examples?
Or are all problems available on Hugging Face as public?
Would be good to have a potential 10-20% held out set that can't be explicitly trained on.
Awesome work!
- 主要言語
- Python
- スター
- 208
- フォーク
- 12
- PR マージ指標
- 30日以内にマージされた PR はありません
コントリビューションガイド
このリポジトリのコントリビューションガイドは索引されていません
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
MoonshotAI/PerceptionBench のほかの issue
-
難易度 1/5 1〜3時間 初心者へのやさしさ 68/100
-
PBench & VisRes オープン
難易度 4/5 3〜5日 初心者へのやさしさ 35/100
MoonshotAI/PerceptionBench の issue をすべて見る
似ている issue
-
bug
難易度 2/5 1〜3時間 初心者へのやさしさ 75/100
stephrobert/dsoxlab#238 ·
-
難易度 2/5 1〜3時間 初心者へのやさしさ 75/100
-
難易度 2/5 1〜3時間 初心者へのやさしさ 75/100
sublimehq/package_control#1780 ·
-
難易度 2/5 1〜3時間 初心者へのやさしさ 65/100
-
難易度 2/5 1〜3時間 初心者へのやさしさ 70/100
nwg-piotr/nwg-displays#145 ·