仓库议题
Lightning-AI/pytorch-lightning
Pretrain, finetune and deploy AI models on multiple GPUs, TPUs with zero code changes.
议题
开放
LayerNorm / BatchNorm fp16 behavior is different in Pytorch Native and Deepspeed
bughelp wantedstrategy: deepspeed
暂无负责人带有初学者友好标签提供贡献指南
3 条评论1 个反应0 位负责人
开放
BUG when Trainer.test() with deepspeed stage 3
bughelp wantedrepro neededstrategy: deepspeed
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
2 条评论2 个反应0 位负责人
开放
Schedule in PyTorchProfiler doesn't work
bughelp wantedprofiler
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
6 条评论1 个反应0 位负责人
开放
HPC Resubmit resume on most recent epoch checkpoint
checkpointingenvironment: slurmfeaturehelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
11 条评论2 个反应0 位负责人
开放
Add `enable_device_summary` flag to disable device printout
callbackfeaturegood first issuetrainer: argument
为什么推荐带有初学者友好标签 · 提供贡献指南
带有初学者友好标签提供贡献指南
15 条评论3 个反应1 位负责人
开放
Multiple GPU per node could fail silently with KubeflowEnvironment
bugenvironment: kubeflowhelp wanted
为什么推荐带有初学者友好标签 · 提供贡献指南
带有初学者友好标签提供贡献指南
22 条评论2 个反应1 位负责人
开放
Race condition with SLURM restart
environment: slurmfeaturehelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
4 条评论0 个反应0 位负责人
开放
Use :emphasize-lines: in sphinx docs to highlight code.
docsgood first issuepriority: 1
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
11 条评论2 个反应0 位负责人
开放
Support batch size scaling with dataloaders passed directly to `fit()`
data handlingfeaturehelp wantedtuner
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
3 条评论0 个反应0 位负责人
开放
Use `FutureWarning` instead of `DeprecationWarning` for deprecation warning
featuregood first issue
为什么推荐带有初学者友好标签 · 提供贡献指南
带有初学者友好标签提供贡献指南
6 条评论2 个反应1 位负责人
开放
Tagging discussion with release number
docsfeaturehelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
4 条评论0 个反应0 位负责人
开放
[RFC] Default to infinite epochs, not 1000
help wantedlet's do it!trainer: argument
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
18 条评论0 个反应0 位负责人
开放
Distributed mode overwrites the user's choice for dataloaders shuffling
data handlingfeaturehelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
8 条评论0 个反应0 位负责人
开放
ModelCheckpoint: save_top_k > 1 cannot recognize ordering of models from ckpt names
checkpointingfeaturehelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
18 条评论1 个反应0 位负责人
开放
Allow shuffling when overfit_batches is active
featurehelp wantedrefactor
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
19 条评论0 个反应0 位负责人
开放
Progress bar doesn't show up on Kaggle TPU with `num_workers` greater than `0`.
accelerator: tpubughelp wanted
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
33 条评论0 个反应0 位负责人
开放
Syncing the log_dir across ranks is not valid with multiple nodes
bugdistributedhelp wantedloggingpriority: 1
为什么推荐带有初学者友好标签 · 提供贡献指南
带有初学者友好标签提供贡献指南
3 条评论0 个反应1 位负责人
开放
AdvancedProfiler: ValueError: Attempting to stop recording an action (run_test_evaluation) which was never started.
buggood first issuehelp wantedpriority: 1
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
18 条评论0 个反应0 位负责人
开放
Save training metadata with the fault tolerance checkpoint
fault tolerancehelp wantedlet's do it!
为什么推荐暂无负责人 · 带有初学者友好标签
暂无负责人带有初学者友好标签提供贡献指南
3 条评论0 个反应0 位负责人
开放
[RFC] Profiler Metrics
featurehelp wantedlet's do it!profiler
为什么推荐带有初学者友好标签 · 提供贡献指南
带有初学者友好标签提供贡献指南
3 条评论0 个反应2 位负责人