Implement retraining pipeline
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 25/100
- Tipo de issue
- Nueva funcionalidad
- Claridad
- Bastante claro
- Estado de actividad
- Estancado
- Stack tecnológico
- python
- Área
- data, machine-learning
Línea de trabajo
Comienza leyendo el modelo propuesto en issue #2 y el pseudocódigo deepclean.inference.pseudo. Define cómo el nuevo proyecto iterará entre entrenamiento, validación, limpieza y reentrenamiento a través de tramos de datos. Se considera terminado cuando produce ASD/ASDR y las métricas asociadas para todos los tramos limpiados y permite buscar parámetros de reentrenamiento, como el periodo de reentrenamiento.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Create a new project under the model proposed by #2 which iteratively trains and validates on a stretch of data, cleans (using the deepclean.inference.pseudo code) the next stretch, then retrains (and validates) the previously trained model on that stretch and cleans on the stretch after that, etc. The analysis from this project should be the ASD/ASDR and associated metrics on all of the cleaned stretches. This will better forecast the production performace of DeepClean and allow for search and optimization over retraining parameters e.g. the retraining period.
- Lenguaje dominante
- Python
- Estrellas
- 10
- Forks
- 6
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Preparar el entorno
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de ML4GW/DeepClean
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 15/100
-
question research topic
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
-
enhancement
Dificultad 3/5 1-2 días Aptitud para principiantes 45/100
-
bug documentation good first issue
Dificultad 2/5 1-3 horas Aptitud para principiantes 45/100
-
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
Todos los issues de ML4GW/DeepClean
Issues similares
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 76/100
PedestrianDynamics/pyFDS-Evac#199 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 65/100
521xueweihan/HelloGitHub#3790 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
sandialabs/atlas-ui-3#978 ·
Los mantenedores suelen responder en 1 día
-
area: tests perceived difficulty: 2
Dificultad 2/5 1-3 horas Aptitud para principiantes 72/100
Nitjsefnie-Harness-Commons/daedalus#1255 ·
Los mantenedores suelen responder en 1 día
-
hf-audiolm-qwen: `generate_until` hardcodes `.to("cuda")` and aborts on non-CUDA acceleratorsAbierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 86/100
EleutherAI/lm-evaluation-harness#4256 ·
Los mantenedores suelen responder en 1 día