Neura Intelligence Index
Model Context Protocol benchmark — evaluating tool use via MCP servers.
| # | Model | Score | Provider | Source |
|---|---|---|---|---|
| 1 | M Muse Spark 1.1🇺🇸 | 88.1 | Meta | verified |
| 2 | M Kimi K3🇨🇳 | 84.2 | Moonshot AI | verified |
| 3 | B Seed 2.1 Pro🇨🇳 | 83.8 | ByteDance | verified |
| 4 | 83.6 | verified | ||
| 5 | 82.2 | Anthropic | verified | |
| 6 | B Seed 2.1 Turbo🇨🇳 | 80.3 | ByteDance | verified |
| 7 | T Hy3🇨🇳 | 79.1 | Tencent | verified |
| 8 | 77.3 | Anthropic | verified | |
| 9 | Z GLM-5.2🇨🇳 | 76.8 | Zhipu AI | verified |
| 10 | Q Qwen3.7 Max🇨🇳 | 76.4 | Alibaba Cloud / Qwen Team | verified |
| 11 | M Kimi K2.7 Code🇨🇳 | 76 | Moonshot AI | verified |
| 12 | 75.3 | OpenAI | verified | |
| 13 | 74.2 | MiniMax | verified | |
| 14 | Q Qwen3.6 Plus🇨🇳 | 74.1 | Alibaba Cloud / Qwen Team | verified |
| 15 | 73.6 | DeepSeek | verified | |
| 16 | Q Qwen3.7-Plus🇨🇳 | 73.2 | Alibaba Cloud / Qwen Team | verified |
| 17 | Z GLM-5.1🇨🇳 | 71.8 | Zhipu AI | verified |
| 18 | 69.2 | verified | ||
| 19 | 69 | DeepSeek | verified | |
| 20 | Z GLM-5🇨🇳 | 67.8 | Zhipu AI | verified |
| 21 | 67.2 | OpenAI | verified | |
| 22 | Q Qwen3.6-35B-A3B🇨🇳 | 62.8 | Alibaba Cloud / Qwen Team | verified |
| 23 | 62.7 | Anthropic | verified | |
| 24 | 62.3 | Anthropic | verified | |
| 25 | 61.3 | Anthropic | verified | |
| 26 | 60.6 | OpenAI | verified | |
| 27 | 57.7 | OpenAI | verified | |
| 28 | 57.4 | verified | ||
| 29 | 56.1 | OpenAI | verified | |
| 30 | 24.6 | Amazon | verified |