AI Radar

模型榜

全球主流模型在不同维度上的排名。每个榜都注明数据来源和更新日期,名次变化与上一期对比。

数据来源:Artificial Analysis,通过其官方数据 API 获取,每日更新。分数与方法论以该站为准。

Agent

工具调用与长任务能力指数单位:
  1. 1
    Claude Fable 5.1Max Effort

    Anthropic · 海外 · 文本

    57.9
  2. 2
    Claude Opus 5Max Effort

    Anthropic · 海外 · 文本

    56.5
  3. 3
    Qwen3.8 Max0902

    Alibaba · 国内 · 文本

    56.0
  4. 4
    Muse Spark 1.3max

    Meta · 海外 · 文本

    55.5
  5. 5
    Qwen3.8-Flash-Next

    Alibaba · 国内 · 文本

    53.6
  6. 6
    Z
    GLM-5.3max

    Z AI · 国内 · 文本

    53.1
  7. 7
    S
    Grok 4.6high

    SpaceXAI · 海外 · 文本

    53.0
  8. 8
    O
    GPT-6 Astramax

    OpenAI · 海外 · 文本

    51.0
  9. 9
    Z
    GLM 5.3 Flash

    Z AI · 国内 · 文本

    50.9
  10. 10
    Claude Fable 5Max Effort, Opus 4.8 Fallback

    Anthropic · 海外 · 文本

    50.7
  11. 11
    O
    GPT-5.6 Solmax

    OpenAI · 海外 · 文本

    50.2
  12. 12
    Qwen3.8 2.4T A95B

    Alibaba · 国内 · 文本

    50.1
  13. 13
    K
    Kimi K3max

    Kimi · 国内 · 文本

    50.0
  14. 14
    47.5
  15. 15
    Qwen3.8 27Bxhigh

    Alibaba · 国内 · 文本

    45.8
  16. 16
    Claude Sonnet 5Max Effort

    Anthropic · 海外 · 文本

    43.6
  17. 17
    Muse Spark 1.2xhigh

    Meta · 海外 · 文本

    43.2
  18. 18
    O
    GPT-5.6 Terramax

    OpenAI · 海外 · 文本

    43.2
  19. 19
    O
    GPT-5.6 Lunamax

    OpenAI · 海外 · 文本

    42.1
  20. 20
    Claude Opus 4.8Max Effort

    Anthropic · 海外 · 文本

    41.9
  21. 21
    DeepSeek V4 Pro 0813Reasoning, Max Effort

    DeepSeek · 国内 · 文本

    41.3
  22. 22
    S
    Grok 4.5high

    SpaceXAI · 海外 · 文本

    41.2
  23. 23
    41.0
  24. 24
    Gemini 3.8 Flashhigh

    Google · 海外 · 文本

    40.2
  25. 25
    I
    K2 Horizon 375B A23B

    Institute of Foundation Models · 国内 · 文本

    40.0
  26. 26
    Claude Opus 4.7Max Effort

    Anthropic · 海外 · 文本

    38.6
  27. 27
    Z
    GLM-5.2max

    Z AI · 国内 · 文本

    38.4
  28. 28
    O
    GPT-5.5xhigh

    OpenAI · 海外 · 文本

    36.4
  29. 29
    Gemini 3.7 Flashhigh

    Google · 海外 · 文本

    35.2
  30. 30
    I
    K2 Horizon MoVA 36B A4B

    Institute of Foundation Models · 国内 · 文本

    33.5
  31. 31
    Claude Sonnet 4.6Max Effort

    Anthropic · 海外 · 文本

    31.8
  32. 32
    M
    Quasar 438Bmax, based on GLM-5.2

    Multiverse Computing · 海外 · 文本

    31.4
  33. 33
    M
    MiniMax-M3

    MiniMax · 国内 · 文本

    29.5
  34. 34
    Gemini 3.6 Flashhigh

    Google · 海外 · 文本

    29.0
  35. 35
    I
    Ling-3.0-flash-VL

    InclusionAI · 国内 · 文本

    28.7
  36. 36
    I
    Ling-3.0-flash-Fin

    InclusionAI · 国内 · 文本

    27.9
  37. 37
    DeepSeek V4 Pro 0424Reasoning, Max Effort

    DeepSeek · 国内 · 文本

    26.3
  38. 38
    I
    K2 Horizon 7B

    Institute of Foundation Models · 国内 · 文本

    26.1
  39. 39
    Gemini 3.5 Flashhigh

    Google · 海外 · 文本

    26.0
  40. 40
    Muse Spark 1.1xhigh

    Meta · 海外 · 文本

    25.8
  41. 41
    T
    Hy3

    Tencent · 国内 · 文本

    24.1
  42. 42
    Z
    GLM-5.1Reasoning

    Z AI · 国内 · 文本

    23.9
  43. 43
    N
    Nex-N2-Probased on Qwen3.5-397B-A17B

    Nex AGI · 国内 · 文本

    23.7
  44. 44
    T
    Inklingxhigh

    Thinking Machines · 海外 · 文本

    22.5
  45. 45
    Qwen3.7 Max

    Alibaba · 国内 · 文本

    22.5
  46. 46
    22.2
  47. 47
    MiMo-V2.5-Pro

    Xiaomi · 国内 · 文本

    21.3
  48. 48
    K
    Kimi K2.7 Code

    Kimi · 国内 · 文本

    21.0
  49. 49
    K
    Kimi K2.6

    Kimi · 国内 · 文本

    20.5
  50. 50
    Nemotron 3 Ultra 550B A55BReasoning

    NVIDIA · 海外 · 文本

    20.1

Artificial Analysis · 更新于 2026-09-24 · 名次变化与上一期相比,“新”为本期新上榜 · 仅收录每个维度前 50 名 · 在 Artificial Analysis 查看完整榜单