Hacktoberfest 2026:维护者为十月标记出来的 issue,仍然开放、适合新手。 浏览 Hacktoberfest issue

[BUG] NVFP4 fails on RTX 5070 Laptop (SM120): CUDA Error: no kernel image is available for execution on the device

未关闭
#3,217 2 条评论 0 个 reaction 已指派 0 人 在 GitHub 查看

维护者通常 2 天内回复

还没有人认领这个 Issue。

评估

难度
4/5
预计耗时
3-5 天
新手友好度
50/100
Issue 类型
缺陷
描述清晰度
基本清楚
活跃度
活跃
技术栈
python

调研方向

在报告的 CUDA 13.3、SM120 环境中重现 NVFP4 训练失败,然后检查第 77 行附近的 transformer_engine/common/recipe/current_scaling.cu,包括 launch_amax_kernel 和 zero_amax_kernel 的启动。将失败的 kernel 启动与 build 支持的 GPU 架构设置进行比较;当 NVFP4 训练能够在 RTX 5070 Laptop 上成功启动且不再出现缺少 kernel image 的错误时,即表示完成。

由索引模型根据 Issue 内容生成。

描述

Environment

  • GPU: NVIDIA GeForce RTX 5070 Laptop GPU
  • Compute Capability: SM120 (12.0)
  • CUDA Toolkit: 13.3
  • Python: 3.13
  • WSL2 Ubuntu 24.04
  • TransformerEngine built from source
  • Local commit: 6bf7790d
  • Upstream main: 9d92fa05

Problem

TransformerEngine builds successfully, but NVFP4 training fails immediately with:

RuntimeError:
/home/.../transformer_engine/common/recipe/current_scaling.cu:77

launch_amax_kernel

CUDA Error: no kernel image is available for execution on the device

The failure happens immediately after:

zero_amax_kernel<<<1,1,0,stream>>>(...);
NVTE_CHECK_CUDA(cudaGetLastError());
主要语言
Python
星标
3.6k
派生
851
平均合并
4 天 15 小时
30 天内合并 PR
51

环境准备

从这里开始

  1. 先读完整个 Issue,再读项目的贡献指南。
  2. 在 Issue 下留言说明你要接手 —— 这能避免两个人做同样的事。
  3. Fork 仓库,在一个分支上完成修改。
  4. 提交 Pull Request,并在描述里引用这个 Issue 编号。

NVIDIA/TransformerEngine 的其他 Issue

查看 NVIDIA/TransformerEngine 的全部 Issue

相似的 Issue

更多 Python Issue

把新 issue 发到你的邮箱

精选适合新手参与的 GitHub issue 摘要。