Категория «Рассуждение» оценивает способность современных языковых моделей решать сложные логические и аналитические задачи. Здесь проверяются навыки многоэтапной дедукции, анализа и проверки гипотез, решения научных задач, а также способность сохранять последовательность и логическую непротиворечивость в продолжительных многоэтапных диалогах.

Рейтинг формируется на основе результатов сложных популярных. Он позволяет определить модели, которые лучше всего справляются со сложным рассуждением, научным анализом и многоэтапным решением задач.

Ищете универсальную модель с сильными результатами в разных областях? Способность к рассуждению составляет 30% совокупного балла. Перейдите в общий рейтинг нейросетей, чтобы увидеть, как ведущие модели в этой категории справляются также с программированием, математикой и агентными задачами.

Последнее обновление: 9 октября 2026 г.
Место Название Модели Относительное качество Балл
1 Claude Opus 5.5
Качество рассуждения 97,52%

97,52
2 GPT-6 Astra
Качество рассуждения 95,19%

95,19
3 Gemini 4 Argon
Качество рассуждения 94,96%

94,96
4 Claude Fable 5.1
Качество рассуждения 93,63%

93,63
5 Claude Opus 5
Качество рассуждения 93,59%

93,59
6 Claude Fable 5
Качество рассуждения 93,25%

93,25
7 Claude Sonnet 5.5
Качество рассуждения 92,89%

92,89
8 GPT-5.6 Sol
Качество рассуждения 91,86%

91,86
9 GPT-6.1 Sol
Качество рассуждения 91,83%

91,83
10 Kimi K3
Качество рассуждения 91,03%

91,03
11 Muse Spark 1.3
Качество рассуждения 90,66%

90,66
12 Claude Opus 4.8
Качество рассуждения 90,23%

90,23
13 Gemini 3.8 Flash
Качество рассуждения 89,39%

89,39
14 Muse Spark 1.1
Качество рассуждения 88,73%

88,73
15 GPT-5.5
Качество рассуждения 88,64%

88,64
16 Qwen3.8
Качество рассуждения 88,61%

88,61
17 Gemini 3.7 Flash
Качество рассуждения 88,46%

88,46
18 GLM-5.3
Качество рассуждения 87,57%

87,57
19 GPT-5.6 Terra
Качество рассуждения 87,56%

87,56
20 Gemini 3.1 Pro
Качество рассуждения 87,26%

87,26
21 Hy4
Качество рассуждения 87,15%

87,15
22 Grok 4.6
Качество рассуждения 87,13%

87,13
23 Claude Opus 4.7
Качество рассуждения 87,08%

87,08
24 Claude Opus 4.6
Качество рассуждения 86,77%

86,77
25 DeepSeek-V4-Pro
Качество рассуждения 86,52%

86,52
26 Claude Sonnet 5
Качество рассуждения 86,14%

86,14
27 GPT-5.4
Качество рассуждения 86,04%

86,04
28 GPT-6 Sol
Качество рассуждения 85,91%

85,91
29 Qwen3.7
Качество рассуждения 85,17%

85,17
30 Grok 4.5
Качество рассуждения 85,14%

85,14
31 Qwen3.8-Flash-Next
Качество рассуждения 85,00%

85,00
32 Gemini 3.5 Flash
Качество рассуждения 84,27%

84,27
33 DeepSeek-V4.1-Flash
Качество рассуждения 83,93%

83,93
34 MiMo-V2.6-Pro
Качество рассуждения 83,89%

83,89
35 GLM-5.3-Flash
Качество рассуждения 83,80%

83,80
36 Gemini 3.6 Flash
Качество рассуждения 83,66%

83,66
37 Seed 2.1 Pro
Качество рассуждения 83,56%

83,56
38 Muse Spark 1.2
Качество рассуждения 83,54%

83,54
39 GPT-5.6 Luna
Качество рассуждения 83,14%

83,14
40 GLM-5.2
Качество рассуждения 82,82%

82,82
41 GPT-5.2
Качество рассуждения 82,65%

82,65
42 DeepSeek-V4-Flash
Качество рассуждения 82,45%

82,45
43 Claude Haiku 5.5
Качество рассуждения 81,99%

81,99
44 Kimi K2.6
Качество рассуждения 81,55%

81,55
45 Step 5
Качество рассуждения 81,51%

81,51
46 Muse Spark
Качество рассуждения 81,24%

81,24
47 Gemini 3 Pro
Качество рассуждения 80,86%

80,86
48 Grok 4.7
Качество рассуждения 80,60%

80,60
49 Qwen3.8-27B
Качество рассуждения 80,48%

80,48
50 MiniMax M3
Качество рассуждения 80,08%

80,08
51 Claude Sonnet 4.6
Качество рассуждения 80,03%

80,03
52 Qwen3.7-Plus
Качество рассуждения 79,83%

79,83
53 Grok Build 0.1
Качество рассуждения 79,02%

79,02
54 Claude Opus 4.5
Качество рассуждения 78,89%

78,89
55 Gemini 3 Flash
Качество рассуждения 78,63%

78,63
56 Qwen3.6
Качество рассуждения 78,58%

78,58
57 Mistral Large 4
Качество рассуждения 78,54%

78,54
58 Seed 2.0 Pro
Качество рассуждения 78,54%

78,54
59 Hy3
Качество рассуждения 78,22%

78,22
60 GPT-6 Luna
Качество рассуждения 78,21%

78,21
61 Ling 3.1 Flash
Качество рассуждения 76,32%

76,32
62 Inkling
Качество рассуждения 76,29%

76,29
63 Qwen3.6 Plus
Качество рассуждения 76,28%

76,28
64 GPT-5.3 Codex
Качество рассуждения 76,22%

76,22
65 MiMo-V2.6-Flash
Качество рассуждения 76,16%

76,16
66 GLM-5.1
Качество рассуждения 76,13%

76,13
67 Kimi K2.5
Качество рассуждения 75,43%

75,43
68 Kimi K2.7 Code
Качество рассуждения 75,40%

75,40
69 Qwen3.5-397B-A17B
Качество рассуждения 75,03%

75,03
70 MiMo-V2-Pro
Качество рассуждения 74,98%

74,98
71 LongCat-Flash
Качество рассуждения 74,95%

74,95
72 GPT-5.2 Codex
Качество рассуждения 74,63%

74,63
73 Inkling-Small
Качество рассуждения 74,29%

74,29
74 GPT-5.1
Качество рассуждения 73,96%

73,96
75 GLM-5
Качество рассуждения 73,80%

73,80
76 GPT-5.4 mini
Качество рассуждения 72,93%

72,93
77 MiMo-V2.5
Качество рассуждения 72,14%

72,14
78 GLM-4.7
Качество рассуждения 72,07%

72,07
79 MiniMax M2.7
Качество рассуждения 71,99%

71,99
80 MiMo-V2.5-Pro
Качество рассуждения 71,84%

71,84
81 Qwen3
Качество рассуждения 71,84%

71,84
82 GPT-5
Качество рассуждения 71,80%

71,80
83 Grok 4.3
Качество рассуждения 71,69%

71,69
84 Gemma 4 31B
Качество рассуждения 71,29%

71,29
85 KAT-Coder-Pro V2
Качество рассуждения 71,10%

71,10
86 GPT-5.4 nano
Качество рассуждения 70,76%

70,76
87 Muse Glimmer
Качество рассуждения 70,38%

70,38
88 Qwen3.5-122B-A10B
Качество рассуждения 70,28%

70,28
89 GPT-5.5 Instant
Качество рассуждения 70,09%

70,09
90 Grok-4
Качество рассуждения 69,94%

69,94
91 ChatGPT-4o
Качество рассуждения 69,85%

69,85
92 Kimi K2
Качество рассуждения 69,83%

69,83
93 Qwen3.5-27B
Качество рассуждения 69,35%

69,35
94 DeepSeek-V3.2
Качество рассуждения 69,26%

69,26
95 Step-3.5-Flash
Качество рассуждения 69,04%

69,04
96 Grok-4.20
Качество рассуждения 68,47%

68,47
97 MiniMax M2.5
Качество рассуждения 68,37%

68,37
98 Claude Sonnet 4.5
Качество рассуждения 68,31%

68,31
99 Grok 4.1 Fast
Качество рассуждения 68,14%

68,14
100 Solar Pro 4
Качество рассуждения 67,92%

67,92