[MNT] Complete Test for Sparse Dataset Row ID and Ignore Attributes Inclusion

Aperta Adatta ai principianti
#1,644 4 commenti 0 reazioni 0 assegnatari Vedi su GitHub

Nessuno ha ancora preso questa issue.

Valutazione

Difficoltà
2/5
Tempo stimato
1-3 ore
Idoneità per principianti
82/100
Tipo di issue
Refactoring
Chiarezza
Specificata chiaramente
Stato di attività
Attiva
Stack tecnologico
python
Ambito
data, testing-qa

Direzione di ricerca

Inizia in tests/test_datasets/test_dataset.py, alla voce test_get_sparse_dataset_rowid_and_ignore_and_target, quindi esegui questo test per esaminare il comportamento attuale dello sparse dataset. Estendi o aggiungi il caso usando target="class", include_row_id=True e include_ignore_attribute=True. Il lavoro è completato quando le assertions coprono la forma di output prevista, gli ID delle righe, le colonne ignorate escluse e gli indicatori categorici aggiornati.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Descrizione

Good First Issue module:Data testing

The test test_get_sparse_dataset_rowid_and_ignore_and_target in test_dataset.py#L382 currently sets ignore_attribute and row_id_attribute on a sparse dataset but calls get_data() with include_row_id=False and include_ignore_attribute=False. This means the test doesn't verify behavior when these attributes are actually included in the output.

Steps:

  1. Add a new test case or extend the existing one to call get_data(target="class", include_row_id=True, include_ignore_attribute=True).
  2. Assert the correct output shape (should exclude the ignored columns and include row IDs if applicable).
  3. Verify that categorical indicators are updated accordingly.
  4. Run the test to ensure it passes with the sparse dataset.

The test should validate that sparse datasets handle row ID and ignore attributes correctly when included, improving test coverage for edge cases.

Source: Mentioned TODO in source code (same line)

Lingua principale
Python
Stelle
361
Fork
296
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Guida per i contributori

Apri la guida per i contributori

Come iniziare

  1. Leggi tutta la issue e poi la guida ai contributi del progetto.
  2. Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
  3. Fai un fork del repository e lavora su un branch.
  4. Apri una pull request che faccia riferimento al numero della issue.

Altre issue di openml/openml-python

Tutte le issue di openml/openml-python

Issue simili

Altre issue su Python

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.