Taleef7/turboquant
Vedi su GitHubEvidence-first KV-cache compression for Qwen2.5: packed low-bit KV blocks, PyTorch references, Triton kernels, and reproducible GPU benchmarks.
- Stelle
- 0
- Fork
- 0
- Issue aperte per principianti
- 0
- Issue indicizzate
- 5
- Lingua principale
- Python
- Licenza
- MIT
- Ultimo push su GitHub
- 2/8/2026
- Ultima indicizzazione
- 20/9/2026
- Guida per i contributori
- Guida per i contributori
- Codice di condotta
- Nessun codice di condotta
- Label per principianti
- Nessuna label per principianti indicizzata
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
-
documentation
Difficoltà 4/5 3-5 giorni Idoneità per principianti 48/100
Taleef7/turboquant#5 · 2 commenti ·
-
enhancement testing
Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100
Taleef7/turboquant#1 · 1 commento ·
-
enhancement optimization
Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100
Taleef7/turboquant#2 ·
-
enhancement optimization
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
Taleef7/turboquant#3 ·
-
enhancement performance
Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100
Taleef7/turboquant#4 ·