Hacktoberfest 2026:メンテナが10月に向けて印を付けた、オープンで初心者向けの issue。 Hacktoberfest の issue を見る

feat: find a solution to load the dataset

オープン
#122 コメント 0 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

評価

難易度
5/5
見積もり時間
1週間以上
初心者へのやさしさ
25/100
issue の種類
機能追加
明瞭さ
説明が足りない
活発さ
停滞
技術スタック
python
領域
data

調査の方向性

まず実際のデータ抽出の問題を再現し、metadata_website_desc がない場合に datasets library が feature の型をどのように読み込むかを調査します。feature スキーマをどのように指定または推論すべきかを特定し、その後、ウェブサイトの説明がまばらな dataset が正常に読み込まれることを確認します。

索引モデルが issue の本文から書いたものです。

説明

While testing the real data extraction, I encountered a new problem: the websites descriptions are rarely present in the metadata_website_desc column. Therefore, the datasets library cannot load such a dataset by having to guessing the feature type. It has to know them beforehand.

主要言語
Python
スター
29
フォーク
11
PR マージ指標
30日以内にマージされた PR はありません

環境構築

このプロジェクトには開発コンテナ、Dockerfile、コントリビューションガイドがありません。まず README を読み、一般的な手順ははじめてのコントリビューションガイドを参照してください。

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

bigscience-workshop/metadata のほかの issue

bigscience-workshop/metadata の issue をすべて見る

似ている issue

Python の issue をもっと見る

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。