microsoft/STATE-Bench
在 GitHub 查看Benchmark AI Agents on Enterprise Workflows
- 星标
- 91
- 派生
- 13
- 开放的新手 issue
- 0
- 已索引 issue
- 9
-
难度 2/5 1-3 小时 新手友好度 58/100
microsoft/STATE-Bench#52 ·
-
难度 5/5 一周以上 新手友好度 20/100
microsoft/STATE-Bench#51 · 2 条评论 ·
-
难度 4/5 3-5 天 新手友好度 25/100
microsoft/STATE-Bench#50 ·
-
难度 3/5 1-2 天 新手友好度 35/100
microsoft/STATE-Bench#48 · 2 条评论 ·
-
难度 5/5 一周以上 新手友好度 30/100
microsoft/STATE-Bench#45 · 2 条评论 ·
-
难度 5/5 一周以上 新手友好度 35/100
microsoft/STATE-Bench#43 · 1 条评论 ·
-
难度 2/5 1-3 小时 新手友好度 74/100
microsoft/STATE-Bench#36 · 2 条评论 ·
-
Agent Learning Track baseline run (GPT-5.1, OpenAI API judge+sim) — results + gap vs leaderboard 未关闭
难度 4/5 3-5 天 新手友好度 25/100
microsoft/STATE-Bench#33 · 2 条评论 ·
-
难度 5/5 一周以上 新手友好度 35/100
microsoft/STATE-Bench#26 · 1 条评论 ·