倉庫議題
Lightning-AI/pytorch-lightning
Pretrain, finetune and deploy AI models on multiple GPUs, TPUs with zero code changes.
議題
開放
Checkpoint do not save under multinode training mode when using Webdataset
bughelp wantedquestionrepro needed
尚無負責人帶有初學者友善標籤提供貢獻指南
1 則留言0 個反應0 位負責人
開放
Leak RAM when training 8 core TPU
accelerator: tpubughelp wantedperformancerepro needed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應0 位負責人
開放
Support all iterator modes for fit/validate/test/predict
data handlingfeaturehelp wantedpl
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
15 則留言6 個反應0 位負責人
開放
Change in logging frequency for automated logging
bughelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應0 位負責人
開放
`configure_optimizers` in LightningCLI doesn't work in distributed mode
featurehelp wantedlightningclistrategy: ddp
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
8 則留言0 個反應0 位負責人
開放
`self.log` raised error when number of dataloader is not consistent
bughelp wantedlogging
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
1 則留言2 個反應0 位負責人
開放
How to generalize the first dimension (often assigned to batch size) on ONNX production inference?
help wantedquestion
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
1 則留言0 個反應0 位負責人
開放
MLFlow logger with remote tracking fails with CLI
bughelp wantedlightningclilogger: mlflow
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
10 則留言5 個反應0 位負責人
開放
Update the docformatter pre-commit action
cigood first issue
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
7 則留言0 個反應1 位負責人
開放
torch.randn() + DDP + GANs are easy to get wrong with lightning
discussionfeaturehelp wantedreproducibility
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
3 則留言2 個反應0 位負責人
開放
Integrating pytorch XLA when using multiple GPUs
accelerator: cudafeaturehelp wantedstrategy: xla
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
13 則留言4 個反應0 位負責人
開放
ModelCheckpoint Callback state loader with missing dir
bughelp wantedlogger: neptunerepro needed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
6 則留言0 個反應0 位負責人
開放
"MisconfigurationException: No supported gpu backend found!" with multi gpu training in jupyter notebooks
accelerator: cudabughelp wantedrepro needed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
18 則留言1 個反應0 位負責人
開放
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
9 則留言0 個反應0 位負責人
開放
Redesign dataloader re-instantiation context managers for Lite
discussionfabrichelp wantedpriority: 2refactor
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
10 則留言0 個反應1 位負責人
開放
mixed precision with Deepspeed
bughelp wantedstrategy: deepspeed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
6 則留言1 個反應0 位負責人
開放
When test, the printed log does not show the full text of the metrics, when named in Chinese
bughelp wantedloopstrainer: test
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
3 則留言0 個反應1 位負責人
開放
Come work with us at Lightning AI !!
help wanted
為什麼推薦帶有初學者友善標籤 · 提供貢獻指南
帶有初學者友善標籤提供貢獻指南
1 則留言34 個反應1 位負責人
開放
Loss does not decrease on single TPU
accelerator: tpubughelp wantedplrepro needed
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
20 則留言0 個反應0 位負責人
開放
Deadlock after training model with TPU VM 3.8 and while resuming training.
accelerator: tpubughelp wanted
為什麼推薦尚無負責人 · 帶有初學者友善標籤
尚無負責人帶有初學者友善標籤提供貢獻指南
14 則留言0 個反應0 位負責人