Feature representations for new Proteins in DiG
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Aptitud para principiantes
- 25/100
- Tipo de issue
- Documentación
- Claridad
- Necesita aclaración
- Estado de actividad
- Estancado
- Stack tecnológico
- python
Línea de trabajo
Comienza por el Apéndice B.1 del artículo y la ubicación vinculada de OpenFold model/model.py, y luego compara las salidas de Evoformer indicadas con los archivos pickle de proteínas descritos en el issue. Documenta los pasos exactos de FASTA, MSA, salida del modelo y serialización necesarios para reproducir las representaciones single y pair.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Hi,
This is regarding protein generation in DiG.
I wanted to know how you obtained the features present in the protein pickle files. As per Appendix B.1 of the paper, the single and pair representations are simply outputs of a pre-trained Evoformer model from AlphaFold given the corresponding protein's Fasta sequence and MSAs.
I set up OpenFold on our systems and saved the representations from Evoformer in a pickle file for the corresponding protein. I used the single and pair keys in the output dictionary in this link. Also, to get the MSAs for the fasta sequence I queried the ColabFold server.
Unfortunately, the representations I received from OpenFold's Evoformer and the representations in the dataset's pickle file were quite different.
Can you please let me know the exact method you used to obtain the single and pair representations for the respective protein fasta sequence?
- Lenguaje dominante
- Python
- Estrellas
- 2.5k
- Forks
- 374
- Merge medio
- 14 h 51 min
- PR fusionados (30 d)
- 3
Preparar el entorno
Aún no hemos revisado los archivos de configuración de este proyecto. Empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de microsoft/Graphormer
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 72/100
microsoft/Graphormer#211 ·
-
SAS updataAbierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
microsoft/Graphormer#210 ·
-
Interpolation between statesAbierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
microsoft/Graphormer#208 ·
-
CUDA out of memoryAbierto
Dificultad 4/5 3-5 días Aptitud para principiantes 20/100
microsoft/Graphormer#207 · 1 comentario ·
-
How do I prepare OC20 dataset?Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
microsoft/Graphormer#205 ·
Todos los issues de microsoft/Graphormer
Issues similares
-
documentation
Dificultad 2/5 1-3 horas Aptitud para principiantes 70/100
kristofdegrave/homeassistant-smart-charging#1413 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
nasa/earthdata-varinfo#113 ·
-
curriculum documentation quality
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
githubnext/gh-aw-workshop#3849 ·
Los mantenedores suelen responder en 2 días
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 90/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 84/100
Los mantenedores suelen responder en 1 día