Leaderboard

    Best AI for Reasoning 2026.

    Find the best AI for reasoning. Ranked by Humanity's Last Exam, GPQA Diamond, ARC-AGI 2, SimpleQA, and more. Compare intelligence and reasoning across all major LLMs.

    Claude Opus 4.8
    Anthropic
    0.6%0.9%
    GLM-5.2OSS
    Z AI
    0.5%0.9%
    Claude Opus 4.7
    Anthropic
    0.5%0.9%
    Claude Opus 4.6
    Anthropic
    0.5%0.9%0.7%
    GLM-5.1OSS
    Z AI
    0.5%0.9%
    GPT-5.5
    OpenAI
    0.5%0.9%0.8%
    Gemini 3.1 Pro
    Google
    0.5%0.9%0.8%
    M
    Kimi K2-Thinking-0905OSS
    Moonshot AI
    0.5%0.8%
    M
    Kimi K2.5OSS
    Moonshot AI
    0.5%0.9%
    Claude Sonnet 4.6
    Anthropic
    0.5%0.9%0.6%
    Qwen3.5-27BOSS
    Qwen
    0.5%0.9%
    DeepSeek-V4-Pro-MaxOSS
    DeepSeek
    0.5%0.9%0.6%
    Qwen3.5-122B-A10BOSS
    Qwen
    0.5%0.9%
    Qwen3.5-35B-A3BOSS
    Qwen
    0.5%0.8%
    Gemini 3 Pro
    Google
    0.5%0.9%0.7%0.3%
    DeepSeek-V4-Flash-MaxOSS
    DeepSeek
    0.5%0.9%0.3%
    Gemini 3 Flash
    Google
    0.4%0.9%0.7%0.3%
    GLM-4.7OSS
    Z AI
    0.4%0.9%
    Qwen3.7 Max
    Qwen
    0.4%0.9%
    DeepSeek-V3.2OSS
    DeepSeek · via OpenRouter
    0.4%0.8%
    Gemini 3.5 Flash
    Google
    0.4%0.7%
    Grok-4
    xAI
    0.4%0.9%0.2%
    GPT-5.4
    OpenAI
    0.4%0.9%0.7%
    N
    Nemotron 3 Ultra (550B A55B)OSS
    NVIDIA · via OpenRouter
    0.4%0.9%
    GPT-5.2 Pro
    OpenAI
    0.4%0.9%0.5%
    M
    Kimi K2.6OSS
    Moonshot AI
    0.4%0.9%
    GPT-5.2
    OpenAI
    0.3%0.9%0.5%
    X
    MiMo-V2.5-ProOSS
    Xiaomi
    0.3%0.7%
    Qwen3.6 Plus
    Qwen
    0.3%0.9%
    Qwen3.5-397B-A17BOSS
    Qwen
    0.3%0.9%
    GPT-5.4 mini
    OpenAI
    0.3%0.9%
    Gemma 4 31BOSS
    Google
    0.3%0.8%
    M
    LongCat-Flash-Thinking-2601OSS
    Meituan
    0.3%0.8%
    GPT-5
    OpenAI
    0.2%0.9%
    GPT-5.4 nano
    OpenAI
    0.2%0.8%
    Qwen3.6-27BOSS
    Qwen
    0.2%0.9%
    N
    Nemotron 3 Super (120B A12B)OSS
    NVIDIA · via OpenRouter
    0.2%0.8%
    X
    MiMo-V2-FlashOSS
    Xiaomi
    0.2%0.8%
    M
    MiniMax M2.1OSS
    MiniMax
    0.2%0.8%
    Gemini 2.5 Pro Preview 06-05
    Google
    0.2%0.9%0.5%
    Qwen3.6-35B-A3BOSS
    Qwen · via OpenRouter
    0.2%0.9%
    Grok 4 Fast
    xAI
    0.2%0.9%0.9%
    DeepSeek-V3.2-ExpOSS
    DeepSeek
    0.2%0.8%1.0%
    Qwen3-235B-A22B-Thinking-2507OSS
    Qwen
    0.2%0.8%
    Gemini 2.5 Pro
    Google
    0.2%0.8%0.5%0.0%
    DeepSeek-R1-0528OSS
    DeepSeek
    0.2%0.8%0.9%
    GLM-4.6OSS
    Z AI
    0.2%0.8%
    Gemma 4 26B-A4BOSS
    Google
    0.2%0.8%
    GPT-5 mini
    OpenAI
    0.2%0.8%
    Gemini 3.1 Flash-Lite
    Google
    0.2%0.9%0.4%
    Showing 150 of 236 models

    Building with these APIs?

    Get 10+ Next.js AI templates with auth, payments, and more.

    Get Templates — $249

    All Large Language Models

    Baidu

    1 models

    Inception

    1 models

    LG AI Research

    1 models

    Nous Research

    1 models

    StepFun

    1 models

    Unisound

    1 models
    Best AI for Reasoning 2026 — LLM Reasoning Leaderboard | AnotherWrapper