OpenGVLab/V2PE
Vedi su GitHub[ICCV2025] V2PE: Improving Multimodal Long-Context Capability of Vision-Language Models with Variable Visual Position Encoding
- Stelle
- 61
- Fork
- 2
- Issue aperte per principianti
- 0
- Issue indicizzate
- 2
- Lingua principale
- Python
- Licenza
- MIT
- Ultimo push su GitHub
- 4/4/2026
- Ultima indicizzazione
- 21/9/2026
- Guida per i contributori
- Nessuna guida per i contributori
- Codice di condotta
- Nessun codice di condotta
- Label per principianti
- Nessuna label per principianti indicizzata
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Caricamento delle issue
-
有关训练的设置 Aperta
Difficoltà 5/5 Più di una settimana Idoneità per principianti 10/100
-
About Batch size set Aperta
Difficoltà 3/5 1-2 giorni Idoneità per principianti 42/100