Add Jigsaw Toxicity Classification to Full Benchmark
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 5/5
- Tempo stimato
- Più di una settimana
- Idoneità per principianti
- 20/100
- Tipo di issue
- Funzionalità
- Chiarezza
- Da chiarire
- Stato di attività
- Ferma
- Stack tecnologico
- python
- Ambito
- machine-learning, testing-qa
Direzione di ricerca
Il corpo della issue non indica file, test o punti di ingresso. Inizia individuando come vengono registrati i task esistenti nel benchmark completo e identifica il percorso di valutazione attuale per i task di classificazione. Il lavoro sarà considerato completato quando Jigsaw Toxicity Classification sarà incluso nel benchmark completo e i relativi risultati verranno prodotti in modo coerente insieme a quelli dei task esistenti.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Questa issue non ha una descrizione.
- Lingua principale
- Python
- Stelle
- 42
- Fork
- 24
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Preparare l'ambiente
- Nessun Dockerfile né file Docker Compose
- Nessun modello di pull request
- Leggi la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di bigscience-workshop/evaluation
-
Add MKQA to Full BenchmarkAperta
Difficoltà 4/5 3-5 giorni Idoneità per principianti 25/100
-
Refactor task template to merge multilingual.json and english.jsonForse di nuovo libera @wilsonyhlee l’ha presa 1863 giorni fa e non c’è nessuna pull request aperta. Aperta
bigscience-workshop/evaluation#64 · 1 assegnatario ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100
bigscience-workshop/evaluation#61 · 2 commenti · 3 reazioni ·
-
Setup testingForse di nuovo libera @tttyuntian l’ha presa 1879 giorni fa e non c’è nessuna pull request aperta. Apertaengineering
bigscience-workshop/evaluation#57 · 2 commenti · 3 assegnatari ·
-
Start overleaf for benchmark tech reportForse di nuovo libera @arunraja-hub l’ha presa 1874 giorni fa e non c’è nessuna pull request aperta. Apertadocumentation
bigscience-workshop/evaluation#54 · 1 commento · 3 reazioni · 2 assegnatari ·
Tutte le issue di bigscience-workshop/evaluation
Issue simili
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 72/100
NousResearch/hermes-agent#136483 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 88/100
I maintainer di solito rispondono entro 1 giorno
-
[BUG] LazyStackedTensorDictStore zeroes the last byte of a new key set on the last elementForse già presa @peterdsharpe l’ha presa oggi. Apertabug
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
pytorch/tensordict#2307 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
I maintainer di solito rispondono entro 1 giorno
-
GrokModel.generate/a_generate pass an OpenAI-style list-of-dicts to xai_sdk.chat.user(), so every call crashes with a protobuf TypeError before any network I/OForse già presa @Christian-Sidak l’ha presa oggi. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 70/100
confident-ai/deepeval#3436 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno