Codesota · Models2,268 models indexed · 151 match filter
Editorial · Models
Models with recorded evidence.
Start with a research area, drill into a vendor, or page through the full index. Vendor aliases and legacy area IDs are grouped here; original model IDs and model links stay unchanged. Only models with at least one benchmark score appear — a model without a recorded score can’t be ranked.
Vendor:Areas overviewSpeakLeash · 263Alibaba · 104Google · 102OpenAI · 86Meta · 68Microsoft · 49Anthropic · 44DeepSeek · 34Mistral · 30mistralai · 19CYFRAGOVPL · 14NVIDIA · 14Zhipu AI · 13internlm · 10xAI · 10ByteDance · 9Baidu · 8ibm-granite · 8PLLuM · 8allenai · 7Amazon · 7MiniMax · 7Mistral AI · 7Remek · 7Shanghai AI Lab · 7utter-project · 7CohereForAI · 6Salesforce · 601-ai · 5Cohere · 5Moonshot AI · 5NousResearch · 5THUML · 5gguf-iq · 4IBM · 4Meituan · 4openchat · 4Stanford · 4THUDM · 4tiiuae · 4UC San Diego · 4VikParuchuri · 4Allen AI · 3BAAI · 3Du et al. · 3ForgeCode · 3Fudan University · 3gguf · 3gguf11bv30 · 3gguf7bv30 · 3IDEA Research · 3Liao et al. · 3Moonshot.AI · 3Nam Tuan Ly / NII · 3OpenDataLab · 3OPI-PG · 3upstage · 3ViCoS Lab Ljubljana · 3Xiaomi · 3Zhao et al. · 3+ 243 smaller vendors (288 models)
§ 01 · Reasoning models
151 models in Reasoning · page 3 of 4.
| # | Model | Vendor | Parameters | Architecture | Benchmarks | Results |
|---|---|---|---|---|---|---|
| 101 | Trinity Large Preview | Arcee AI | — | — | 4 | 4 |
| 102 | Apertus-70B | — | — | — | 3 | 3 |
| 103 | Claude 3.5 Sonnet | Anthropic | — | Transformer (LLM) | 3 | 3 |
| 104 | Gemini Ultra | Unknown | Transformer (decoder-only) | 3 | 3 | |
| 105 | GLM-5.1 | — | — | — | 3 | 3 |
| 106 | GPT-5 mini | OpenAI | — | — | 2 | 3 |
| 107 | Qwen3-Omni-30B-A3B-Base-202507 | — | — | — | 3 | 3 |
| 108 | Qwen3-Omni-Flash-Thinking | — | — | — | 3 | 3 |
| 109 | Step-3.5-Flash PaCoRe | — | — | — | 3 | 3 |
| 110 | Claude 3.7 Sonnet | Anthropic | — | — | 2 | 2 |
| 111 | Claude Opus 4.1 | Anthropic | — | — | 2 | 2 |
| 112 | Claude Opus 4.7 | Anthropic | — | — | 2 | 2 |
| 113 | DeepSeek-R1-Distill-Llama-70B | DeepSeek | — | — | 2 | 2 |
| 114 | DeepSeek-R1-Distill-Qwen-32B | DeepSeek | — | — | 2 | 2 |
| 115 | Gemini 3 Pro Preview | — | — | 2 | 2 | |
| 116 | GLM-4.5 | Zhipu AI | — | — | 2 | 2 |
| 117 | GLM-4.5-Air | Zhipu AI | — | — | 2 | 2 |
| 118 | Kimi k1.5 | Moonshot AI | — | — | 2 | 2 |
| 119 | Muse Spark | Meta | — | — | 2 | 2 |
| 120 | o3 (high) | OpenAI | — | — | 2 | 2 |
| 121 | Qwen 3 72B | Alibaba | 72B | — | 2 | 2 |
| 122 | Trinity Large Base (5-shot) | — | — | — | 2 | 2 |
| 123 | Claude 3.5 Opus | Anthropic | — | LLM | 1 | 1 |
| 124 | Claude 3 Haiku | Anthropic | — | — | 1 | 1 |
| 125 | Claude 4 | Anthropic | — | — | 1 | 1 |
| 126 | Claude 4.5 Sonnet | Anthropic | — | — | 1 | 1 |
| 127 | Code Llama - Python 34B | — | — | — | 1 | 1 |
| 128 | DeepSeek-R1-Zero | DeepSeek | — | — | 1 | 1 |
| 129 | DeepSeek V3.5 | DeepSeek | 685B MoE | — | 1 | 1 |
| 130 | ERNIE 5.0 | Baidu | — | — | 1 | 1 |
| 131 | Gemini 2.0 Flash Thinking | — | — | 1 | 1 | |
| 132 | Gemini 3.1 Flash-Lite | — | — | 1 | 1 | |
| 133 | GPT-3 (base) | OpenAI | — | — | 1 | 1 |
| 134 | GPT-5.4 Pro | OpenAI | — | — | 1 | 1 |
| 135 | GPT-5 Pro | OpenAI | — | — | 1 | 1 |
| 136 | Llama 4 405B | Meta | 405B | — | 1 | 1 |
| 137 | Llama 4 Behemoth 2T | Meta | — | — | 1 | 1 |
| 138 | MiniMax M2.5 | MiniMax | Unknown | — | 1 | 1 |
| 139 | Mistral Large 3 | Mistral | 123B | — | 1 | 1 |
| 140 | Moshi | Kyutai | — | — | 1 | 1 |
| 141 | Nova Lite | Amazon | — | — | 1 | 1 |
| 142 | Nova Pro | Amazon | — | — | 1 | 1 |
| 143 | o1 Pro | OpenAI | — | — | 1 | 1 |
| 144 | o4-mini (high) | OpenAI | — | — | 1 | 1 |
| 145 | PaLM 540B (CoT) | — | — | 1 | 1 | |
| 146 | PaLM 540B (Self-Consistency) | — | — | 1 | 1 | |
| 147 | Phi-4 14B | Microsoft | 14B | — | 1 | 1 |
| 148 | Qwen 3 14B | Alibaba | 14B | — | 1 | 1 |
| 149 | QwQ-32B | Alibaba/Qwen | — | — | 1 | 1 |
| 150 | SU-01 | — | — | — | 1 | 1 |