finetune stage2 of Internvideo2 with num_frames 12 error
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Idoneità per principianti
- 25/100
- Tipo di issue
- Bug
- Chiarezza
- Da chiarire
- Stato di attività
- Ferma
- Stack tecnologico
- python
- Ambito
- machine-learning
Direzione di ricerca
Inizia in tasks/shared_utils.py alla riga 192, dove setup_model carica lo state dict, e riproduci il stage2 finetuning con num_frames 12. Confronta le shape del checkpoint e del modello corrente riportati per vision_encoder.pos_embed, quindi verifica che il percorso di caricamento corretto venga completato senza il size-mismatch error.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
When I try to finetune stage2 of Internvideo2 with num_frames 12, I meet the error below:
[rank0]: File "/root/nginx/multi_modality/tasks/shared_utils.py", line 192, in setup_model
[rank0]: msg = model_without_ddp.load_state_dict(state_dict, strict=False)
[rank0]: File "/usr/local/Python3.8.12/lib/python3.8/site-packages/torch/nn/modules/module.py", line 2215, in load_state_dict
[rank0]: raise RuntimeError('Error(s) in loading state_dict for {}:\n\t{}'.format(
[rank0]: RuntimeError: Error(s) in loading state_dict for InternVideo2_Stage2:
[rank0]: size mismatch for vision_encoder.pos_embed: copying a param with shape torch.Size([1, 1025, 1408]) from checkpoint, the shape in current model is torch.Size([1, 3073, 1408]).
How to solve it? Looking forward to your reply. Thanks.
- Lingua principale
- Python
- Stelle
- 2.4k
- Fork
- 160
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Guida per i contributori
Nessuna guida per i contributori indicizzata per questo repository
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di OpenGVLab/InternVideo
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
OpenGVLab/InternVideo#324 · 1 commento ·
-
InternVideo2 stage-1 weights Aperta
Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100
OpenGVLab/InternVideo#323 ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
OpenGVLab/InternVideo#322 ·
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 42/100
OpenGVLab/InternVideo#321 ·
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 35/100
OpenGVLab/InternVideo#319 · 1 commento ·
Tutte le issue di OpenGVLab/InternVideo
Issue simili
-
essnmx good first issue
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 95/100
-
[Feature] 奇物选择添加优先级 Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 65/100
syfoud/Simulated_Scepter#174 ·
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100
Giskard-AI/giskard-oss#2840 · 1 commento ·
-
A claim comment carrying the issue number is silently declined while the workflow reports success Apertaarea: repo bug perceived difficulty: 2
Difficoltà 2/5 1-3 ore Idoneità per principianti 70/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100
yeti-platform/yeti#1380 ·