Allocation results in unnecessary moves around destructive operations
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Aptitud para principiantes
- 48/100
Línea de trabajo
Start with the three cases in the regalloc2-repro repository, then compare their output with the reported fib.asm and fib.vcode files from the linked botlish audit. Trace the allocation around the destructive operations and verify that the unnecessary moves into r13 are reduced without regressing the repro cases.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
I am implementing a Cranelift-based compiler stack for a new programming language where one design objective is efficient machine code. This is why early in development I am doing audits on the generated code to find out which inefficiencies are caused by the mid-end, which by the backend and which by missing language features.
In the asm dump of my fibonacci benchmark I saw this:
177: mov rsi,r13
17a: mov r14,rax
17d: sub rsi,0x2
181: mov r13,rsi
184: shl rsi,1
187: mov r13,rsi
18a: or rsi,0x1
18e: mov r13,rsi
191: mov QWORD PTR [rbx+0x8],rsi
rsi is moved repeatedly into r13 for no discernible reason, then the content of rsi is moved into memory. r13 is later overwritten. So r13 was completely useless here.
The entire ASM is available in https://github.com/mwagner-webdev/botlish/blob/9cb689a/audit/native-scalar-asm/bench/fib.asm
This code was generated via Cranelift from this CLIF: https://github.com/mwagner-webdev/botlish/blob/9cb689a/audit/native-scalar-asm/bench/fib.vcode
I have a minimal repro here with three cases that illustrate the issue: https://github.com/mwagner-webdev/regalloc2-repro
I have zero experience with the workings of register allocators and it's all pretty fascinating. Obviously perfect allocation is impossible, but this looks like a clear-cut pathological case for which some heuristic may be found.
- Lenguaje dominante
- Rust
- Estrellas
- 266
- Forks
- 54
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de bytecodealliance/regalloc2
-
Modeling subregister aliasing Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
bytecodealliance/regalloc2#247 · 3 comentarios ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 45/100
bytecodealliance/regalloc2#222 · 4 comentarios ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
bytecodealliance/regalloc2#206 · 2 comentarios ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
bytecodealliance/regalloc2#194 · 7 comentarios ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 38/100
bytecodealliance/regalloc2#191 · 3 comentarios ·
Todos los issues de bytecodealliance/regalloc2
Issues similares
-
Replayed reasoning items send "content": null, which the Responses API schema does not permit Abiertobug CLI custom-model
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
rust-bitcoin/rust-bitcoin#6930 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
fulcrumgenomics/ferro-hgvs#2251 ·
-
Missing examples for `Allocator` AbiertoA-allocators A-docs C-enhancement T-libs
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100