AutoML experiment: get model and metrics for any algorithm (not only for the best one)
Personne n'a encore pris cette issue.
Évaluation
- Difficulté
- 5/5
- Temps estimé
- Plus d'une semaine
- Accessibilité débutants
- 35/100
- Type d'issue
- Fonctionnalité
- Clarté
- Plutôt claire
- Activité
- À l'abandon
- Stack technique
- azure, jupyter-notebook, python
- Domaine
- api, machine-learning
Piste de recherche
Commencez par l’utilisation du client MLflow présentée dans l’issue, notamment get_run, le tag automl_best_child_run_id et pipeline_id_000. Suivez la manière dont les runs enfants d’AutoML sont identifiés et le lien entre les noms des algorithmes et leurs noms de runs internes. Le travail est considéré comme terminé lorsqu’il est documenté ou rendu possible de récupérer un modèle et ses métriques pour n’importe quel algorithme de l’expérience, et pas uniquement pour le meilleur run.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Description
What I'm trying to do
For an AutoML Forecasting experiment, I'd like to compare the performance of the best model with the performance of another model from the same experiment.
For an AutoML run, I understand how to get the best performing model and its metrics like this:
# ...initialize MLFlow client...
mlflow_parent_run = mlflow_client.get_run('upbeat_square_abs3942')
best_child_run_id = mlflow_parent_run.data.tags["automl_best_child_run_id"]
best_run = mlflow_client.get_run(best_child_run_id)
best_run.data.metrics
# etc...
But how can I fetch the job for any model based on the algorithm name?
Something like:
# pseudocode:
mlflow_client.get_automl_run_by_algorithm('XGBoostRegressor')
So far, I managed to figure out the following:
- list of algorithms used in the AutoML experiment
mlflow_parent_run.data.tags['pipeline_id_000']
# '__AutoML_Naive__;__AutoML_SeasonalNaive__;__AutoML_Average__;__AutoML_SeasonalAverage__;__AutoML_Ensemble__'
However, this list seems to be in an arbitrary order and I struggle to get the corresponding job names for the algorithms.
- "internal" job names for the child runs
The child runs seem to have different names than the names shown in Azure ML Studio.
They are named for instance upbeat_square_abs3942_2 - i.e. the name of the parent run upbeat_square_abs3942 followed by underscore plus a number (_2in this example).
But Azure ML Studio displays names like (no upbeat_square_abs3942_2 to be found):

So this code works:
child_run = mlflow_client.get_run('upbeat_square_abs3942_2')
but using a name shown in the screenshot above throws an exception, e.g.
child_run = mlflow_client.get_run('green_floor_0ln3tlpv')
Question
How can I obtain the model and metrics for any algorithm used in the experiment?
Thanks!
- Langage dominant
- Jupyter Notebook
- Étoiles
- 4.4k
- Forks
- 2.6k
- Métriques de merge des PR
- Aucune PR mergée en 30 j
Préparer son environnement
Nous n'avons pas encore vérifié les fichiers d'installation de ce projet. Commencez par son README, et consultez notre guide de la première contribution pour les étapes générales.
Par où commencer
- Lisez l'issue en entier, puis le guide de contribution du projet.
- Signalez en commentaire que vous la prenez — cela évite que deux personnes fassent le même travail.
- Forkez le dépôt et travaillez sur une branche.
- Ouvrez une pull request qui référence le numéro de l'issue.
Autres issues de Azure/MachineLearningNotebooks
-
Difficulté 2/5 1-3 heures Accessibilité débutants 72/100
Azure/MachineLearningNotebooks#1975 · 1 commentaire ·
-
duplicatesOuverte
Difficulté 1/5 Moins d'une heure Accessibilité débutants 68/100
Azure/MachineLearningNotebooks#1960 ·
-
machineOuverte
Difficulté 5/5 Plus d'une semaine Accessibilité débutants 10/100
Azure/MachineLearningNotebooks#1987 ·
-
Difficulté 5/5 Plus d'une semaine Accessibilité débutants 25/100
Azure/MachineLearningNotebooks#1985 · 1 commentaire ·
-
Difficulté 3/5 1-2 jours Accessibilité débutants 35/100
Azure/MachineLearningNotebooks#1981 · 1 réaction ·
Toutes les issues de Azure/MachineLearningNotebooks
Issues similaires
-
Difficulté 2/5 1-3 heures Accessibilité débutants 74/100
Les mainteneurs répondent en général sous 1 jour
-
good first issue
Difficulté 2/5 1-3 heures Accessibilité débutants 88/100
-
Difficulté 2/5 1-3 heures Accessibilité débutants 88/100
vllm-project/vllm-metal#822 ·
Les mainteneurs répondent en général sous 1 jour
-
[Bug]: chunk_span_bounds and _validated_chunk_spans reject Pydantic models ChunkSpan and AudioFileOuverte
Difficulté 2/5 1-3 heures Accessibilité débutants 78/100
BasedHardware/omi#19047 ·
Les mainteneurs répondent en général sous 1 jour
-
Screener: canary reports lose failure_subcode for every L2/L3 failure except the adjudicatorOuverte
Difficulté 2/5 1-3 heures Accessibilité débutants 68/100
ditto-assistant/ditto-subnet#2346 ·
Les mainteneurs répondent en général sous 1 jour