The Qwen3.5 122B-A10B native vision-language model is built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. In terms of...
| Benchmark | Score | Source |
|---|---|---|
| MMMLU | 86.7 | verified |
| Benchmark | Score | Source |
|---|---|---|
| SWE-bench Verified | 72 | verified |
| Benchmark | Score | Source |
|---|
| GPQA Diamond | 86.6 | verified |
| Humanity's Last Exam | 47.5 | verified |
| Benchmark | Score | Source |
|---|---|---|
| MMMU | 83.9 | verified |
| CharXiv Reasoning | 77.2 | verified |
| MMMU-Pro | 76.9 | verified |
| ScreenSpot Pro | 70.4 | verified |
| Benchmark | Score | Source |
|---|---|---|
| BrowseComp | 63.8 | verified |
Qwen