Allowing extract_array calls to use pre-indexed grid information?
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 25/100
- Tipo de issue
- Nueva funcionalidad
- Claridad
- Necesita aclaración
- Estado de actividad
- Estancado
- Stack tecnológico
- r
- Área
- performance
Línea de trabajo
Empieza leyendo los puntos de entrada extract_array y rowAutoGrid, y luego revisa el enfoque descrito en LTLA/beachmat#20 para preindexar bloques de filas de dgCMatrix. Un cambio completo definiría una forma general para que los backends de DelayedArray adecuados utilicen información de grid preindexada y demostraría una mejora del rendimiento de la extracción basada en filas.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
The recent conversation in theislab/zellkonverter#34 reminded me of some work I did in LTLA/beachmat#20. Briefly, the idea was to speed up row-based block processing of dgCMatrix by performing a single pass over the non-zero elements beforehand to identify the start and end of each row block in each column. This avoids the need for costly per-column binary searches when each row block is extracted in the usual way, and gives a ~10-fold speed-up in row-based processing of dgCMatrixes.
Now I'm wondering whether this approach can be generalized somehow so that other DelayedArray backends can benefit. Perhaps functions like rowAutoGrid() can decorate the grid object with extra information that allows extract_array to efficiently obtain the necessary bits and pieces, if a suitable object like a dgCMatrix is passed?
Happy to give this - or other ideas - a crack with a PR if there is some interest.
- Lenguaje dominante
- R
- Estrellas
- 29
- Forks
- 12
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de Bioconductor/DelayedArray
-
Dificultad 4/5 3-5 días Aptitud para principiantes 38/100
Bioconductor/DelayedArray#129 · 11 comentarios ·
-
Custom delayed operations Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 45/100
Bioconductor/DelayedArray#127 · 1 comentario ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
Bioconductor/DelayedArray#125 · 1 comentario ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 45/100
Bioconductor/DelayedArray#123 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
Bioconductor/DelayedArray#122 ·
Todos los issues de Bioconductor/DelayedArray
Issues similares
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
briandconnelly/airnow#9 ·
-
Copy cohorts to keep old cohorts Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
OHDSI/CohortConstructor#774 ·
-
pre-review R TeX Track: 5 (DSAIS)
Dificultad 1/5 Menos de una hora Aptitud para principiantes 60/100
openjournals/joss-reviews#11330 · 7 comentarios ·
-
Release autosync 0.1.1 Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100