microsoft/STATE-Bench
Vedi su GitHubBenchmark AI Agents on Enterprise Workflows
- Stelle
- 91
- Fork
- 13
- Issue aperte per principianti
- 0
- Issue indicizzate
- 9
- Lingua principale
- Python
- Licenza
- MIT
- Ultimo push su GitHub
- 4/8/2026
- Ultima indicizzazione
- 19/9/2026
- Guida per i contributori
- Guida per i contributori
- Codice di condotta
- Codice di condotta
- Label per principianti
- Nessuna label per principianti indicizzata
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
-
Official Citation Format Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 58/100
microsoft/STATE-Bench#52 ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 20/100
microsoft/STATE-Bench#51 · 2 commenti ·
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 25/100
microsoft/STATE-Bench#50 ·
-
Difficoltà 3/5 1-2 giorni Idoneità per principianti 35/100
microsoft/STATE-Bench#48 · 2 commenti ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 30/100
microsoft/STATE-Bench#45 · 2 commenti ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100
microsoft/STATE-Bench#43 · 1 commento ·
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 74/100
microsoft/STATE-Bench#36 · 2 commenti ·
-
Agent Learning Track baseline run (GPT-5.1, OpenAI API judge+sim) — results + gap vs leaderboard Aperta
Difficoltà 4/5 3-5 giorni Idoneità per principianti 25/100
microsoft/STATE-Bench#33 · 2 commenti ·
-
Difficoltà 5/5 Più di una settimana Idoneità per principianti 35/100
microsoft/STATE-Bench#26 · 1 commento ·