microsoft/STATE-Bench
Ver en GitHubBenchmark AI Agents on Enterprise Workflows
- Estrellas
- 91
- Forks
- 13
- Issues abiertos para principiantes
- 0
- Issues indexados
- 9
- Lenguaje dominante
- Python
- Licencia
- MIT
- Último push a GitHub
- 4/8/2026
- Última indexación
- 19/9/2026
- Guía de contribución
- Guía de contribución
- Código de conducta
- Código de conducta
- Etiquetas para principiantes
- Sin etiquetas para principiantes indexadas
- Métricas de merge de PR
- Sin PR fusionados en 30 d
-
Official Citation Format Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 58/100
microsoft/STATE-Bench#52 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
microsoft/STATE-Bench#51 · 2 comentarios ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
microsoft/STATE-Bench#50 ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
microsoft/STATE-Bench#48 · 2 comentarios ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
microsoft/STATE-Bench#45 · 2 comentarios ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
microsoft/STATE-Bench#43 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 74/100
microsoft/STATE-Bench#36 · 2 comentarios ·
-
Agent Learning Track baseline run (GPT-5.1, OpenAI API judge+sim) — results + gap vs leaderboard Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
microsoft/STATE-Bench#33 · 2 comentarios ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
microsoft/STATE-Bench#26 · 1 comentario ·