Категория «Рассуждение» оценивает способность современных языковых моделей решать сложные логические и аналитические задачи. Здесь проверяются навыки многоэтапной дедукции, анализа и проверки гипотез, решения научных задач, а также способность сохранять последовательность и логическую непротиворечивость в продолжительных многоэтапных диалогах.
Рейтинг формируется на основе результатов сложных популярных. Он позволяет определить модели, которые лучше всего справляются со сложным рассуждением, научным анализом и многоэтапным решением задач.
Ищете универсальную модель с сильными результатами в разных областях? Способность к рассуждению составляет 30% совокупного балла. Перейдите в общий рейтинг нейросетей, чтобы увидеть, как ведущие модели в этой категории справляются также с программированием, математикой и агентными задачами.
| Место | Название Модели | Относительное качество | Балл |
|---|---|---|---|
| 1 | Claude Opus 5.5 |
|
97,52 |
| 2 | GPT-6 Astra |
|
95,19 |
| 3 | Gemini 4 Argon |
|
94,96 |
| 4 | Claude Fable 5.1 |
|
93,63 |
| 5 | Claude Opus 5 |
|
93,59 |
| 6 | Claude Fable 5 |
|
93,25 |
| 7 | Claude Sonnet 5.5 |
|
92,89 |
| 8 | GPT-5.6 Sol |
|
91,86 |
| 9 | GPT-6.1 Sol |
|
91,83 |
| 10 | Kimi K3 |
|
91,03 |
| 11 | Muse Spark 1.3 |
|
90,66 |
| 12 | Claude Opus 4.8 |
|
90,23 |
| 13 | Gemini 3.8 Flash |
|
89,39 |
| 14 | Muse Spark 1.1 |
|
88,73 |
| 15 | GPT-5.5 |
|
88,64 |
| 16 | Qwen3.8 |
|
88,61 |
| 17 | Gemini 3.7 Flash |
|
88,46 |
| 18 | GLM-5.3 |
|
87,57 |
| 19 | GPT-5.6 Terra |
|
87,56 |
| 20 | Gemini 3.1 Pro |
|
87,26 |
| 21 | Hy4 |
|
87,15 |
| 22 | Grok 4.6 |
|
87,13 |
| 23 | Claude Opus 4.7 |
|
87,08 |
| 24 | Claude Opus 4.6 |
|
86,77 |
| 25 | DeepSeek-V4-Pro |
|
86,52 |
| 26 | Claude Sonnet 5 |
|
86,14 |
| 27 | GPT-5.4 |
|
86,04 |
| 28 | GPT-6 Sol |
|
85,91 |
| 29 | Qwen3.7 |
|
85,17 |
| 30 | Grok 4.5 |
|
85,14 |
| 31 | Qwen3.8-Flash-Next |
|
85,00 |
| 32 | Gemini 3.5 Flash |
|
84,27 |
| 33 | DeepSeek-V4.1-Flash |
|
83,93 |
| 34 | MiMo-V2.6-Pro |
|
83,89 |
| 35 | GLM-5.3-Flash |
|
83,80 |
| 36 | Gemini 3.6 Flash |
|
83,66 |
| 37 | Seed 2.1 Pro |
|
83,56 |
| 38 | Muse Spark 1.2 |
|
83,54 |
| 39 | GPT-5.6 Luna |
|
83,14 |
| 40 | GLM-5.2 |
|
82,82 |
| 41 | GPT-5.2 |
|
82,65 |
| 42 | DeepSeek-V4-Flash |
|
82,45 |
| 43 | Claude Haiku 5.5 |
|
81,99 |
| 44 | Kimi K2.6 |
|
81,55 |
| 45 | Step 5 |
|
81,51 |
| 46 | Muse Spark |
|
81,24 |
| 47 | Gemini 3 Pro |
|
80,86 |
| 48 | Grok 4.7 |
|
80,60 |
| 49 | Qwen3.8-27B |
|
80,48 |
| 50 | MiniMax M3 |
|
80,08 |
| 51 | Claude Sonnet 4.6 |
|
80,03 |
| 52 | Qwen3.7-Plus |
|
79,83 |
| 53 | Grok Build 0.1 |
|
79,02 |
| 54 | Claude Opus 4.5 |
|
78,89 |
| 55 | Gemini 3 Flash |
|
78,63 |
| 56 | Qwen3.6 |
|
78,58 |
| 57 | Mistral Large 4 |
|
78,54 |
| 58 | Seed 2.0 Pro |
|
78,54 |
| 59 | Hy3 |
|
78,22 |
| 60 | GPT-6 Luna |
|
78,21 |
| 61 | Ling 3.1 Flash |
|
76,32 |
| 62 | Inkling |
|
76,29 |
| 63 | Qwen3.6 Plus |
|
76,28 |
| 64 | GPT-5.3 Codex |
|
76,22 |
| 65 | MiMo-V2.6-Flash |
|
76,16 |
| 66 | GLM-5.1 |
|
76,13 |
| 67 | Kimi K2.5 |
|
75,43 |
| 68 | Kimi K2.7 Code |
|
75,40 |
| 69 | Qwen3.5-397B-A17B |
|
75,03 |
| 70 | MiMo-V2-Pro |
|
74,98 |
| 71 | LongCat-Flash |
|
74,95 |
| 72 | GPT-5.2 Codex |
|
74,63 |
| 73 | Inkling-Small |
|
74,29 |
| 74 | GPT-5.1 |
|
73,96 |
| 75 | GLM-5 |
|
73,80 |
| 76 | GPT-5.4 mini |
|
72,93 |
| 77 | MiMo-V2.5 |
|
72,14 |
| 78 | GLM-4.7 |
|
72,07 |
| 79 | MiniMax M2.7 |
|
71,99 |
| 80 | MiMo-V2.5-Pro |
|
71,84 |
| 81 | Qwen3 |
|
71,84 |
| 82 | GPT-5 |
|
71,80 |
| 83 | Grok 4.3 |
|
71,69 |
| 84 | Gemma 4 31B |
|
71,29 |
| 85 | KAT-Coder-Pro V2 |
|
71,10 |
| 86 | GPT-5.4 nano |
|
70,76 |
| 87 | Muse Glimmer |
|
70,38 |
| 88 | Qwen3.5-122B-A10B |
|
70,28 |
| 89 | GPT-5.5 Instant |
|
70,09 |
| 90 | Grok-4 |
|
69,94 |
| 91 | ChatGPT-4o |
|
69,85 |
| 92 | Kimi K2 |
|
69,83 |
| 93 | Qwen3.5-27B |
|
69,35 |
| 94 | DeepSeek-V3.2 |
|
69,26 |
| 95 | Step-3.5-Flash |
|
69,04 |
| 96 | Grok-4.20 |
|
68,47 |
| 97 | MiniMax M2.5 |
|
68,37 |
| 98 | Claude Sonnet 4.5 |
|
68,31 |
| 99 | Grok 4.1 Fast |
|
68,14 |
| 100 | Solar Pro 4 |
|
67,92 |