模型榜
全球主流模型在不同维度上的排名。每个榜都注明数据来源和更新日期,名次变化与上一期对比。
数据来源:Artificial Analysis,通过其官方数据 API 获取,每日更新。分数与方法论以该站为准。
Agent榜
工具调用与长任务能力指数单位:分- 1Qwen3.8 Max0902
Alibaba · 国内 · 文本
56.0 - 2Qwen3.8-Flash-Next
Alibaba · 国内 · 文本
53.6 - 3ZGLM-5.3max
Z AI · 国内 · 文本
53.1 - 4ZGLM 5.3 Flash
Z AI · 国内 · 文本
50.9 - 5Qwen3.8 2.4T A95B
Alibaba · 国内 · 文本
50.1 - 6KKimi K3max
Kimi · 国内 · 文本
50.0 - 7DeepSeek V4 Flash VisionReasoning, Max Effort
DeepSeek · 国内 · 文本
47.5 - 8Qwen3.8 27Bxhigh
Alibaba · 国内 · 文本
45.8 - 9DeepSeek V4 Pro 0813Reasoning, Max Effort
DeepSeek · 国内 · 文本
41.3 - 10DeepSeek V4 Flash 0731Reasoning, Max Effort
DeepSeek · 国内 · 文本
41.0 - 11IK2 Horizon 375B A23B
Institute of Foundation Models · 国内 · 文本
40.0 - 12ZGLM-5.2max
Z AI · 国内 · 文本
38.4 - 13IK2 Horizon MoVA 36B A4B
Institute of Foundation Models · 国内 · 文本
33.5 - 14MMiniMax-M3
MiniMax · 国内 · 文本
29.5 - 15ILing-3.0-flash-VL
InclusionAI · 国内 · 文本
28.7 - 16ILing-3.0-flash-Fin
InclusionAI · 国内 · 文本
27.9 - 17DeepSeek V4 Pro 0424Reasoning, Max Effort
DeepSeek · 国内 · 文本
26.3 - 18IK2 Horizon 7B
Institute of Foundation Models · 国内 · 文本
26.1 - 19THy3
Tencent · 国内 · 文本
24.1 - 20ZGLM-5.1Reasoning
Z AI · 国内 · 文本
23.9 - 21NNex-N2-Probased on Qwen3.5-397B-A17B
Nex AGI · 国内 · 文本
23.7 - 22Qwen3.7 Max
Alibaba · 国内 · 文本
22.5 - 23DeepSeek V4 Flash 0420Reasoning, Max Effort
DeepSeek · 国内 · 文本
22.2 - 24MiMo-V2.5-Pro
Xiaomi · 国内 · 文本
21.3 - 25KKimi K2.7 Code
Kimi · 国内 · 文本
21.0 - 26KKimi K2.6
Kimi · 国内 · 文本
20.5
Artificial Analysis · 更新于 2026-09-24 · 名次变化与上一期相比,“新”为本期新上榜 · 仅收录每个维度前 50 名 · 在 Artificial Analysis 查看完整榜单