GLM-5.1 delivers a major leap in coding capability, with particularly significant gains in handling long-horizon tasks. Unlike previous models built around minute-level interactions, GLM-5.1 can work independently and continuously on...
| Benchmark | Score | Source |
|---|---|---|
| SWE-Bench Pro | 58.4 | verified |
| Benchmark | Score | Source |
|---|---|---|
| GPQA Diamond | 86.2 | verified |
| Humanity's Last Exam | 52.3 | verified |
| Benchmark | Score | Source |
|---|---|---|
| BrowseComp | 79.3 | verified |
| MCP Atlas | 71.8 | verified |
| Toolathlon | 40.7 | verified |
Z.ai