单机多卡进行RLHF在第三步中使用Qwen模型作Actor Model报错
还没有人认领这个 Issue。
评估
- 难度
- 4/5
- 预计耗时
- 3-5 天
- 新手友好度
- 20/100
- Issue 类型
- 缺陷
- 描述清晰度
- 需要澄清
- 活跃度
- 停滞
- 技术栈
- python
调研方向
该报告涉及在一台配备多个 GPU 的机器上使用 Qwen 作为 actor 模型执行 RLHF 的第三步,但没有提及源文件或测试,只提供了一张截图。首先检查链接的图像并定位 RLHF 第三步的入口点;当你复现并解决所报告的错误,然后验证 Qwen actor 在所述配置中运行时,即表示完成。
由索引模型根据 Issue 内容生成。
描述
- 主要语言
- Python
- 星标
- 6.8k
- 派生
- 1.1k
- 平均合并
- 2 天 16 小时
- 30 天内合并 PR
- 1
贡献指南
这个仓库没有索引到贡献指南
从这里开始
- 先读完整个 Issue,再读项目的贡献指南。
- 在 Issue 下留言说明你要接手 —— 这能避免两个人做同样的事。
- Fork 仓库,在一个分支上完成修改。
- 提交 Pull Request,并在描述里引用这个 Issue 编号。
deepspeedai/DeepSpeedExamples 的其他 Issue
-
难度 2/5 1-3 小时 新手友好度 52/100
deepspeedai/DeepSpeedExamples#996 ·
-
难度 4/5 3-5 天 新手友好度 25/100
deepspeedai/DeepSpeedExamples#995 ·
-
难度 2/5 1-3 小时 新手友好度 52/100
deepspeedai/DeepSpeedExamples#989 ·
-
moe example 404 未关闭
难度 4/5 3-5 天 新手友好度 25/100
deepspeedai/DeepSpeedExamples#984 ·
-
难度 4/5 3-5 天 新手友好度 42/100
deepspeedai/DeepSpeedExamples#979 · 6 条评论 ·
查看 deepspeedai/DeepSpeedExamples 的全部 Issue
相似的 Issue
-
area: harness bug status: needs-triage
难度 2/5 1-3 小时 新手友好度 75/100
Human-Agent-Society/reef#625 ·
-
难度 2/5 1-3 小时 新手友好度 70/100
-
难度 1/5 1 小时以内 新手友好度 80/100
learningequality/kolibri#15351 · 2 条评论 ·
-
难度 2/5 1-3 小时 新手友好度 75/100
-
Name consistency 未关闭
难度 2/5 1-3 小时 新手友好度 75/100
eellak/triplestore#65 · 1 条评论 ·