[FEA] Add option to report hash collisions
I maintainer di solito rispondono entro 2 giorni
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 5/5
- Tempo stimato
- Più di una settimana
- Idoneità per principianti
- 35/100
- Tipo di issue
- Funzionalità
- Chiarezza
- Abbastanza chiara
- Stato di attività
- Ferma
- Stack tecnologico
- cpp
- Ambito
- performance
Direzione di ricerca
Inizia in include/cuco/detail/static_map.inl, intorno al percorso no-CG di static_map::find alla riga 252, quindi segui le altre funzioni device di inserimento e ricerca menzionate nell’issue. Definisci il comportamento opt-in per il conteggio delle collisioni in static_map e dynamic_map, assicurandoti che il conteggio sia accessibile sull’host e disabilitato per impostazione predefinita senza influire sulle prestazioni standard.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Is your feature request related to a problem? Please describe.
Hash collisions impact performance of hash map insert and probe. It will be useful to find a way to report the number of collisions for static_map and dynamic_map to help assess performance of insert or probe when developers are evaluating perf on their dataset. It would also allow developers to tune the hash function or occupancy to reduce collisions and find the right balance for their scenario.
Describe the solution you'd like
The map can have an optional template argument that specifies if we need to count collisions (disabled by default), so it's opt-in and doesn't impact perf for the standard case. The number of collisions would be stored in a class variable that's accessible with something like get_num_collisions(). Implementation: allocate memory for device variable uint64_t *d_num_collisions, update all insert and find device code to do atomicAdd(d_num_collisions, 1) to that variable, then copy the contents to the host variable after the kernel. Here is where we can count the collisions for no-CG static_map::find:
https://github.com/NVIDIA/cuCollections/blob/2196040f0562a0280292eebef5295d914f615e63/include/cuco/detail/static_map.inl#L252
The atomic will be guarded by the template argument check, so should only impact perf if we're asked to count collisions. Similarly, would have to update all other insert and find functions.
Describe alternatives you've considered
None.
Additional context
None.
- Lingua principale
- Cuda
- Stelle
- 671
- Fork
- 122
- Merge medio
- 4g 19h
- PR unite (30g)
- 10
Preparare l'ambiente
Avvia il container di sviluppo del progetto nel browser, con il tuo account GitHub.
- Nessun Dockerfile né file Docker Compose
- Ha un modello di pull request
- Leggi la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di NVIDIA/cuCollections
-
Add cuco::detail::stream_sync(cuda::stream_ref) to centralize CCCL version-specific API namingForse di nuovo libera @0z5a l’ha presa 23 giorni fa e non c’è nessuna pull request aperta. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 74/100
NVIDIA/cuCollections#840 · 1 commento ·
I maintainer di solito rispondono entro 2 giorni
-
nvidia-runners
Difficoltà 1/5 1-3 ore Idoneità per principianti 25/100
NVIDIA/cuCollections#853 ·
I maintainer di solito rispondono entro 2 giorni
-
topic: performance type: feature request
Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100
NVIDIA/cuCollections#817 · 7 commenti · 1 reazione ·
I maintainer di solito rispondono entro 2 giorni
-
good first issue P2: Nice to have type: improvement
Difficoltà 4/5 3-5 giorni Idoneità per principianti 38/100
NVIDIA/cuCollections#805 · 4 commenti ·
I maintainer di solito rispondono entro 2 giorni
-
[FEA] Add MPSC/MPMC concurrent queueForse di nuovo libera @sleeepyjack l’ha presa 262 giorni fa e non c’è nessuna pull request aperta. Apertatype: feature request
NVIDIA/cuCollections#791 · 1 assegnatario ·
I maintainer di solito rispondono entro 2 giorni
Tutte le issue di NVIDIA/cuCollections
Issue simili
-
type/automation type/performance
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 78/100
I maintainer di solito rispondono entro 1 giorno
-
CLI contributor: external
Difficoltà 2/5 1-3 ore Idoneità per principianti 66/100
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
FinanceFlash/unvibecode#226 · 2 commenti ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
ag-ui-protocol/ag-ui#3019 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
external feature request text-splitters
Difficoltà 2/5 1-3 ore Idoneità per principianti 60/100
langchain-ai/langchain#41191 ·
I maintainer di solito rispondono entro 1 giorno