倉庫議題
Lightning-AI/pytorch-lightning
Pretrain, finetune and deploy AI models on multiple GPUs, TPUs with zero code changes.
議題
開放
LayerNorm / BatchNorm fp16 behavior is different in Pytorch Native and Deepspeed
bughelp wantedstrategy: deepspeed
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言1 個反應0 位負責人
開放
BUG when Trainer.test() with deepspeed stage 3
bughelp wantedrepro neededstrategy: deepspeed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
2 則留言2 個反應0 位負責人
開放
Schedule in PyTorchProfiler doesn't work
bughelp wantedprofiler
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
6 則留言1 個反應0 位負責人
開放
HPC Resubmit resume on most recent epoch checkpoint
checkpointingenvironment: slurmfeaturehelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
11 則留言2 個反應0 位負責人
開放
Add `enable_device_summary` flag to disable device printout
callbackfeaturegood first issuetrainer: argument
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
15 則留言3 個反應1 位負責人
開放
Multiple GPU per node could fail silently with KubeflowEnvironment
bugenvironment: kubeflowhelp wanted
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
22 則留言2 個反應1 位負責人
開放
Race condition with SLURM restart
environment: slurmfeaturehelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
4 則留言0 個反應0 位負責人
開放
Use :emphasize-lines: in sphinx docs to highlight code.
docsgood first issuepriority: 1
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
11 則留言2 個反應0 位負責人
開放
Support batch size scaling with dataloaders passed directly to `fit()`
data handlingfeaturehelp wantedtuner
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應0 位負責人
開放
Use `FutureWarning` instead of `DeprecationWarning` for deprecation warning
featuregood first issue
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
6 則留言2 個反應1 位負責人
開放
Tagging discussion with release number
docsfeaturehelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
4 則留言0 個反應0 位負責人
開放
[RFC] Default to infinite epochs, not 1000
help wantedlet's do it!trainer: argument
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
18 則留言0 個反應0 位負責人
開放
Distributed mode overwrites the user's choice for dataloaders shuffling
data handlingfeaturehelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
8 則留言0 個反應0 位負責人
開放
ModelCheckpoint: save_top_k > 1 cannot recognize ordering of models from ckpt names
checkpointingfeaturehelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
18 則留言1 個反應0 位負責人
開放
Allow shuffling when overfit_batches is active
featurehelp wantedrefactor
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
19 則留言0 個反應0 位負責人
開放
Progress bar doesn't show up on Kaggle TPU with `num_workers` greater than `0`.
accelerator: tpubughelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
33 則留言0 個反應0 位負責人
開放
Syncing the log_dir across ranks is not valid with multiple nodes
bugdistributedhelp wantedloggingpriority: 1
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應1 位負責人
開放
AdvancedProfiler: ValueError: Attempting to stop recording an action (run_test_evaluation) which was never started.
buggood first issuehelp wantedpriority: 1
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
18 則留言0 個反應0 位負責人
開放
Save training metadata with the fault tolerance checkpoint
fault tolerancehelp wantedlet's do it!
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應0 位負責人
開放
[RFC] Profiler Metrics
featurehelp wantedlet's do it!profiler
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應2 位負責人