Add non-baseline example submissions
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Idoneità per principianti
- 35/100
- Tipo di issue
- Funzionalità
- Chiarezza
- Abbastanza chiara
- Stato di attività
- Ferma
- Stack tecnologico
- python
- Ambito
- machine-learning
Direzione di ricerca
Inizia leggendo README.md e la baseline NAdamW esistente in reference_algorithms per capire come sono strutturati i contributi. Aggiungi diversi semplici esempi di contributi, che potrebbero riguardare l’accumulo dei gradienti, la selezione dei dati o tassi di apprendimento diversi per gli embeddings e i livelli di normalizzazione, in una nuova directory reference_algorithms/examples, e collega questa directory da README.md.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
We should demonstrate the capabilities that our API gives users, to give them examples of what they can explore when developing submissions. We should make some example submissions, probably in a new reference_algorithms/examples dir that we link to from README.md. These could include:
- gradient accumulation
- data selection
- different LRs on different layer types (embeddings and norm layers for example)
or whatever other creative ideas you can come up with. The examples can be simple forks of the NAdamW baseline.
- Lingua principale
- Python
- Stelle
- 425
- Fork
- 80
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Preparare l'ambiente
- Nessun Dockerfile né file Docker Compose
- Nessun modello di pull request
- Leggi la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di mlcommons/algorithmic-efficiency
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 30/100
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 38/100
mlcommons/algorithmic-efficiency#924 · 5 commenti ·
-
Anima: live PH monitoring in conversational agent — overfitting detection every 50 interactionsAperta
Difficoltà 5/5 Più di una settimana Idoneità per principianti 25/100
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100
-
Topological overfitting detection: H0 gap catches overfitting before accuracy diverges (r=0.998)Aperta
Difficoltà 5/5 Più di una settimana Idoneità per principianti 15/100
Tutte le issue di mlcommons/algorithmic-efficiency
Issue simili
-
[BUG] Container scenario crashes without expected_recovery_time, kube DNS example uses retry_waitApertaneeds-triage
Difficoltà 2/5 1-3 ore Idoneità per principianti 77/100
krkn-chaos/krkn#1627 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 72/100
NousResearch/hermes-agent#136483 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 88/100
I maintainer di solito rispondono entro 1 giorno
-
[BUG] LazyStackedTensorDictStore zeroes the last byte of a new key set on the last elementForse già presa @peterdsharpe l’ha presa oggi. Apertabug
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
pytorch/tensordict#2307 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
I maintainer di solito rispondono entro 1 giorno