nvexec: `when_all` followed by `continues_on` does not compile
Los mantenedores suelen responder en 1 día
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Aptitud para principiantes
- 45/100
- Tipo de issue
- Error
- Claridad
- Bastante claro
- Estado de actividad
- Estancado
- Stack tecnológico
- cpp, docker
- Área
- backend-api-design
Línea de trabajo
Reproduce el fallo con el Dockerfile proporcionado y el comando clang-21; después, compara la ruta when_all con el ejemplo funcional transfer_when_all. Empieza por nvexec/stream/schedule_from.cuh y nvexec/stream_context.cuh; el trabajo estará terminado cuando el ejemplo con when_all seguido de continues_on compile correctamente.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
It seems that the customization of the "combo" when_all/continues_on is broken for nvexec . But transfer_when_all is fine though.
I think that using when_all, followed by continues_on is legal. Please correct me if I am wrong.
I'm using clang-21 and 3363435259b7ffae43d3f2e5f6b7a7b36d7cd7d3. See reproducer below.
To compile the transfer_when_all example, use the following command:
docker buildx build --progress=plain --target=transfer-when-all --tag=test - < dockerfile && docker run --rm -it --privileged test
It compiles and runs just fine.
To get the compile error with continues_on, use the following command:
docker buildx build --progress=plain --target=when-all --tag=test - < dockerfile
It leads to:
In file included from /stdexec/include/nvexec/stream_context.cuh:28:
#12 3.935 /stdexec/include/nvexec/stream/schedule_from.cuh:184:21: error: static assertion failed
#12 3.935 184 | static_assert(stream_completing_sender<Sender, Env>);
It feels like the schedule_from is expecting when_all to have a completion scheduler, which is wrong ? Not sure though.
FROM nvidia/cuda:12.8.1-devel-ubuntu24.04 AS base
RUN apt update
RUN apt --yes --no-install-recommends install git wget lsb-release gpg software-properties-common
ARG CLANG_VERSION=21
RUN <<EOF
set -ex
wget https://apt.llvm.org/llvm.sh
chmod +x llvm.sh
./llvm.sh ${CLANG_VERSION}
rm llvm.sh
apt --yes --no-install-recommends install clang-21
EOF
RUN git clone --branch=main https://github.com/NVIDIA/stdexec
RUN cd stdexec && git checkout 3363435259b7ffae43d3f2e5f6b7a7b36d7cd7d3
FROM base AS when-all
COPY <<EOF test_when_all.cpp
#include "nvexec/stream_context.cuh"
int main()
{
::nvexec::stream_context stream_ctx{};
::stdexec::scheduler auto sch = stream_ctx.get_scheduler();
auto fork = stdexec::schedule(sch) | stdexec::then([]{printf("Hi from 'then' 0.\n");}) | stdexec::split();
auto snd = stdexec::when_all(
fork | stdexec::bulk(::stdexec::par, 4, [](const auto item){printf("Hi from 'bulk' 1, item %d.\n", item);}),
fork | stdexec::then( []{printf("Hi from 'then' 2.\n");}),
fork | stdexec::bulk(::stdexec::par, 4, [](const auto item){printf("Hi from 'bulk' 3, item %d.\n", item);}))
| stdexec::continues_on(sch)
| stdexec::then( []{printf("Hi.\n");});
stdexec::sync_wait(std::move(snd));
}
EOF
RUN clang++-${CLANG_VERSION} -x cuda --cuda-gpu-arch=sm_86 -std=c++20 -I/stdexec/include -I/usr/local/cuda/include/ test_when_all.cpp
FROM base AS transfer-when-all
COPY <<EOF test_transfer_when_all.cpp
#include "nvexec/stream_context.cuh"
int main()
{
::nvexec::stream_context stream_ctx{};
::stdexec::scheduler auto sch = stream_ctx.get_scheduler();
auto fork = stdexec::schedule(sch) | stdexec::then([]{printf("Hi from 'then' 0.\\n");}) | stdexec::split();
auto snd = stdexec::transfer_when_all(sch,
fork | stdexec::bulk(::stdexec::par, 4, [](const auto item){printf("Hi from 'bulk' 1, item %d.\\n", item);}),
fork | stdexec::then( []{printf("Hi from 'then' 2.\\n");}),
fork | stdexec::bulk(::stdexec::par, 4, [](const auto item){printf("Hi from 'bulk' 3, item %d.\\n", item);}))
| stdexec::then( []{printf("Hi from 'then' 4.\\n");});
stdexec::sync_wait(std::move(snd));
}
EOF
RUN <<EOF
set -ex
clang++-${CLANG_VERSION} -x cuda --cuda-gpu-arch=sm_86 -std=c++20 \
-I/stdexec/include \
-I/usr/local/cuda/include/ \
-L/usr/local/cuda/lib64 -lcudart \
test_transfer_when_all.cpp
EOF
CMD ./a.out
- Lenguaje dominante
- C++
- Estrellas
- 2.4k
- Forks
- 274
- Merge medio
- 1 d 18 h
- PR fusionados (30 d)
- 39
Preparar el entorno
Este proyecto no incluye contenedor de desarrollo, Dockerfile ni guía de contribución, así que la configuración corre por tu cuenta: empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de NVIDIA/stdexec
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
NVIDIA/stdexec#1751 · 2 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
NVIDIA/stdexec#2305 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 3/5 1-2 días Aptitud para principiantes 54/100
Los mantenedores suelen responder en 1 día
-
continues_on: hop opstate not connected with secondary environmentPosiblemente ocupada @ericniebler la tomó hace 17 días. Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 45/100
NVIDIA/stdexec#2268 · 4 comentarios ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
NVIDIA/stdexec#2240 · 5 comentarios ·
Los mantenedores suelen responder en 1 día
Todos los issues de NVIDIA/stdexec
Issues similares
-
bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
Los mantenedores suelen responder en 1 día
-
lldb
Dificultad 2/5 1-3 horas Aptitud para principiantes 85/100
llvm/llvm-project#229592 · 11 comentarios ·
Los mantenedores suelen responder en 1 día
-
Bump libCEED to v1 in superbuildAbierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 66/100
Los mantenedores suelen responder en 3 días
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 94/100
llvm/offload-test-suite#1560 ·
Los mantenedores suelen responder en 1 día
-
cudf-polars feature request
Dificultad 2/5 1-3 horas Aptitud para principiantes 72/100
Los mantenedores suelen responder en 1 día