Hacktoberfest 2026:维护者为十月标记出来的 issue,仍然开放、适合新手。 浏览 Hacktoberfest issue

Reduce CPU overheads in te Sequential GroupedLinear Op

未关闭
#2,995 2 条评论 0 个 reaction 已指派 0 人 在 GitHub 查看

维护者通常 2 天内回复

还没有人认领这个 Issue。

评估

难度
4/5
预计耗时
3-5 天
新手友好度
38/100
Issue 类型
缺陷
描述清晰度
需要澄清
活跃度
活跃
技术栈
python

调研方向

首先阅读 PR #2923,并跟踪 graph-safe Sequential GroupedLinear Op 路径。对其进行性能分析以识别 CPU 瓶颈,然后验证在不影响该 operation 现有行为且不引入回归的情况下,开销得到了降低。

由索引模型根据 Issue 内容生成。

描述

Recently graph safe support has been added to te Sequential GroupedLinear Op https://github.com/NVIDIA/TransformerEngine/pull/2923.

But it suffers from CPU overheads. Nail the bottlenecks and fix them

主要语言
Python
星标
3.6k
派生
851
平均合并
4 天 15 小时
30 天内合并 PR
51

环境准备

从这里开始

  1. 先读完整个 Issue,再读项目的贡献指南。
  2. 在 Issue 下留言说明你要接手 —— 这能避免两个人做同样的事。
  3. Fork 仓库,在一个分支上完成修改。
  4. 提交 Pull Request,并在描述里引用这个 Issue 编号。

NVIDIA/TransformerEngine 的其他 Issue

查看 NVIDIA/TransformerEngine 的全部 Issue

相似的 Issue

更多 Python Issue

把新 issue 发到你的邮箱

精选适合新手参与的 GitHub issue 摘要。