Hacktoberfest 2026: le issue che i maintainer hanno segnato per ottobre, aperte e adatte ai principianti. Sfoglia le issue Hacktoberfest

Proposal: change the way `data_processed` is use to determine if a dataset has been processed

Aperta
#122 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub

Nessuno ha ancora preso questa issue.

Valutazione

Difficoltà
5/5
Tempo stimato
Più di una settimana
Idoneità per principianti
30/100
Tipo di issue
Funzionalità
Chiarezza
Abbastanza chiara
Stato di attività
Ferma
Stack tecnologico
mysql
Ambito
backend, databases

Direzione di ricerca

Inizia con la query data/unprocessed/{data_engine_id}/{order} e verifica come la tabella data_processed e la condizione process_data_tries determinano l’idoneità. Esamina il flusso di elaborazione di data_engine_id e i test o chiamanti esistenti relativi al database. Il lavoro è completato quando la decisione sullo stato di elaborazione corrisponde alla semantica concordata dei tentativi, senza perdere il comportamento specifico per motore.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Descrizione

behavior enhancement proposal

The data_processed table is used in data/unprocessed/{data_engine_id}/{order} where the decision on whether or not a dataset has been processed by a data engine is determined by whether or not the data has been attempted to be processed 3 (process_data_tries) times. To me this is an odd decision. I would consider any dataset which has been attempted to be processed as processed. The data_engine_id itself should determine whether or not to try to process a dataset multiple times (provided it can access that information).

AND p.num_tries < ' . $this->config->item('process_data_tries') .

mysql> DESCRIBE data_processed;
+----------------------+--------------+------+-----+---------+-------+
| Field                | Type         | Null | Key | Default | Extra |
+----------------------+--------------+------+-----+---------+-------+
| did                  | int unsigned | NO   | PRI | NULL    |       |
| evaluation_engine_id | int          | NO   | PRI | NULL    |       |
| user_id              | int          | NO   |     | NULL    |       |
| processing_date      | datetime     | NO   |     | NULL    |       |
| error                | text         | YES  |     | NULL    |       |
| warning              | text         | YES  |     | NULL    |       |
| num_tries            | int          | NO   |     | 1       |       |
+----------------------+--------------+------+-----+---------+-------+
Lingua principale
Python
Stelle
17
Fork
50
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Preparare l'ambiente

  • Include un Dockerfile o un file Docker Compose
  • Ha un modello di pull request
  • Nessuna guida per i contributori

Come iniziare

  1. Leggi tutta la issue e poi la guida ai contributi del progetto.
  2. Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
  3. Fai un fork del repository e lavora su un branch.
  4. Apri una pull request che faccia riferimento al numero della issue.

Altre issue di openml/server-api

Tutte le issue di openml/server-api

Issue simili

Altre issue su Python

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.