Implement the unified activations interpretation API for similar models
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 20/100
- Tipo de issue
- Nueva funcionalidad
- Claridad
- Necesita aclaración
- Estado de actividad
- Estancado
- Stack tecnológico
- python, pytorch, scikit-learn
- Área
- ai, machine-learning
Línea de trabajo
Comienza revisando el código base de NeuroX y Captum, y después compara cómo se gestionan los modelos BERT, RoBERTa, encoder y encoder-decoder mencionados. Define el alcance unificado de la interpretabilidad y los límites de los modelos antes de la implementación; al finalizar se debe proporcionar una API coherente para los modelos de HuggingFace seleccionados.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
difficulty: scalable, can be both 170 and 340 hours
mentor: @oserikov , TBD
requirements:
- pytorch
- sklearn
- python engineering code, OOP, etc.
- experience with Transformer Language models
useful links:
- NeuroX codebase
- Bert re-invents the classical NLP pipeline
- Captum
Idea Description:
While HuggingFace quickly became the standard way to publish language models, several architectural trade-offs have been made to support the quick growth of the models' zoo. This resulted in several theoretically similar models being implemented by different teams, thus e.g. several alternative implementations of self-attentive transformers arose. While refactoring the whole zoo of models seems to be far from the accessible task, the interpretability community is forced to provide unification wrappers for handling such dissimilarities in similar models. The task is to provide a reasonable trade-off with the refactoring of the crucial models and providing the unified wrappers, and thus bring the unified interpretability API to the crucial HuggingFace models.
We could see this task from two prospects. First, one could unify the interpretability API of the sibling models such as BERT and RoBERTa . Second, one could think about bringing the unified interface to interpret and compare encoder models with e.g. encoder-decoder ones, allowing to study the similarities and distinctiveness in their behavior.
Coding Challenge
WIP
- Lenguaje dominante
- Sin datos de lenguaje
- Estrellas
- 1
- Forks
- 1
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Preparar el entorno
Este proyecto no incluye contenedor de desarrollo, Dockerfile ni guía de contribución, así que la configuración corre por tu cuenta: empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de bigscience-workshop/interpretability-ideas
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 10/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 15/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 10/100
Todos los issues de bigscience-workshop/interpretability-ideas
Issues similares
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 92/100
anomalyco/models.dev#8509 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
tintinweb/pi-subagents#368 ·
Los mantenedores suelen responder en 1 día
-
comp/cron P2 type/bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 84/100
NousResearch/hermes-agent#129609 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 76/100
deepset-ai/haystack#13046 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
code-yeongyu/senpi#2456 · 1 comentario ·
Los mantenedores suelen responder en 1 día