Feature request: global "Fast Math" flag
Personne n'a encore pris cette issue.
Évaluation
- Difficulté
- 4/5
- Temps estimé
- 3-5 jours
- Accessibilité débutants
- 35/100
Piste de recherche
Commencez par localiser l’option globale ftz existante de CudaBuilder et examiner comment fadd_fast et les intrinsics similaires sont exposés. Comparez ce comportement avec la sémantique de --use_fast_math de NVCC ; le travail est considéré comme terminé lorsqu’il est établi si une option globale fast_math peut être ajoutée sans modifier le comportement existant d’activation explicite pour les calculs IEEE stricts.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Description
With NVCC, I can use the flag --use_fast_math to enable algebraic optimisations globally when compiling a file. The only way I found to enable such optimisations in Rust-CUDA is to use the fadd_fast intrinsics (and similar). The typical reasoning for using this approach instead of a global "fast math" flag is that some math functions may rely on strict adherence to IEEE float semantics, so using a global "fast math" flag might silently break these. However, CudaBuilder already has a global ftz flag which may already break such functions. Therefore, perhaps it makes sense to also add a global fast_math flag, given that it's ok to globally opt-in to breaking IEEE anyway via ftz?
I'm happy to help with the implementation of this
- Langage dominant
- Rust
- Étoiles
- 5.4k
- Forks
- 251
- Merge moyen
- 4 j 15 h
- PR mergées (30 j)
- 4
Préparer son environnement
Lance le conteneur de développement du projet dans votre navigateur, avec votre propre compte GitHub.
- Aucun Dockerfile ni fichier Docker Compose
- Propose un modèle de pull request
- Lire le guide de contribution
Par où commencer
- Lisez l'issue en entier, puis le guide de contribution du projet.
- Signalez en commentaire que vous la prenez — cela évite que deux personnes fassent le même travail.
- Forkez le dépôt et travaillez sur une branche.
- Ouvrez une pull request qui référence le numéro de l'issue.
Autres issues de Rust-GPU/rust-cuda
-
Default NvvmArch::Compute75 silently produces InvalidPtx on pre-Turing GPUs (Pascal/Maxwell/Volta)Ouverte
Difficulté 4/5 3-5 jours Accessibilité débutants 48/100
-
Difficulté 5/5 Plus d'une semaine Accessibilité débutants 30/100
-
Array parameters lose alignment metadata and ICE on >16 byte alignmentsPeut-être pris @Snehal-Reddy l’a pris il y a 159 jours. Ouverte
Difficulté 4/5 3-5 jours Accessibilité débutants 45/100
-
Support llvm-19 in containersOuverte
Difficulté 4/5 3-5 jours Accessibilité débutants 35/100
-
Difficulté 5/5 Plus d'une semaine Accessibilité débutants 38/100
Toutes les issues de Rust-GPU/rust-cuda
Issues similaires
-
app enhancement
Difficulté 2/5 1-3 heures Accessibilité débutants 75/100
Les mainteneurs répondent en général sous 1 jour
-
Difficulté 1/5 Moins d'une heure Accessibilité débutants 80/100
elodin-sys/elodin#890 ·
Les mainteneurs répondent en général sous 1 jour
-
Difficulté 2/5 1-3 heures Accessibilité débutants 85/100
guidance-ai/llguidance#391 ·
-
documentation
Difficulté 1/5 Moins d'une heure Accessibilité débutants 85/100
Verifiedz/Shimmer#144 · 1 commentaire ·
Les mainteneurs répondent en général sous 1 jour
-
点击设置提示`操作未能完成,详情请查看应用日志`Ouverte
Difficulté 2/5 1-3 heures Accessibilité débutants 70/100
Y-ASLant/ElegantClipboard#166 ·