模型榜
DANBO AI资讯 LEADERBOARD
AI 模型排行榜
在统一单型号口径下比较公开评测,展示 Danbo AI资讯 评分、参考位次与各项原始成绩。
14 项评测·6 家机构·10/07 23:33 更新
综合榜30 个模型
| 参考 位次 | 模型 | ||
|---|---|---|---|
| 01 | Claude Fable 5.1AnthropicAnthropic · 9月1日上线 | 12 项评测覆盖 58% | 85.1覆盖 58% |
| 02 | GPT-6 AstraOpenAIOpenAI · 9月3日上线 | 14 项评测覆盖 69% | 83.0覆盖 69% |
| 03 | Claude Opus 5.5AnthropicAnthropic · 9月22日上线 | 12 项评测覆盖 61% | 80.8覆盖 61% |
| 04 | GPT-6.1 SolOpenAIOpenAI · 9月29日上线 | 11 项评测覆盖 58% | 80.3覆盖 58% |
| 05 | Gemini 3.8 FlashGoogleGoogle · 9月2日上线 | 14 项评测覆盖 69% | 78.2覆盖 69% |
| 06 | Claude Fable 5AnthropicAnthropic · 6月9日上线 | 14 项评测覆盖 69% | 78.2覆盖 69% |
| 07 | Gemini 3.7 FlashGoogleGoogle · 8月13日上线 | 13 项评测覆盖 66% | 78.2覆盖 66% |
| 08 | Claude Opus 5AnthropicAnthropic · 7月24日上线 | 13 项评测覆盖 63% | 78.2覆盖 63% |
| 09 | Claude Sonnet 5.5AnthropicAnthropic · 9月28日上线 | 10 项评测覆盖 55% | 74.4覆盖 55% |
| 10 | GPT-5.6 SolOpenAIOpenAI · 7月9日上线 | 14 项评测覆盖 69% | 74.4覆盖 69% |
| 11 | Muse Spark 1.3MetaMeta · 9月2日上线 | 11 项评测覆盖 52% | 74.4覆盖 52% |
| 12 | GPT-6 SolOpenAIOpenAI · 9月22日上线 | 12 项评测覆盖 61% | 71.6覆盖 61% |
| 13 | GPT-5.5OpenAIOpenAI · 4月23日上线 | 14 项评测覆盖 69% | 69.0覆盖 69% |
| 14 | Grok 4.6xAIxAI · 8月12日上线 | 12 项评测覆盖 63% | 67.6覆盖 63% |
| 15 | Kimi K3开源权重 ↗Moonshot AIMoonshot AI · 7月16日上线 | 14 项评测覆盖 69% | 67.6覆盖 69% |
| 16 | Grok 4.7xAIxAI · 9月21日上线 | 13 项评测覆盖 65% | 64.8覆盖 65% |
| 17 | Muse Spark 1.2MetaMeta · 8月5日上线 | 9 项评测覆盖 53% | 64.8覆盖 53% |
| 18 | GPT-5.6 TerraOpenAIOpenAI · 7月9日上线 | 14 项评测覆盖 69% | 64.8覆盖 69% |
| 19 | Qwen3.8 MaxAlibabaAlibaba · 7月19日上线 | 12 项评测覆盖 63% | 62.5覆盖 63% |
| 20 | GLM-5.3开源权重 ↗Z.aiZ.ai · 8月18日上线 | 14 项评测覆盖 69% | 62.0覆盖 69% |
| 21 | Claude Opus 4.8AnthropicAnthropic · 5月28日上线 | 14 项评测覆盖 69% | 62.0覆盖 69% |
| 22 | GPT-5.4OpenAIOpenAI · 3月5日上线 | 7 项评测覆盖 41% | 62.0覆盖 41% |
| 23 | Gemini 3.6 FlashGoogleGoogle · 7月21日上线 | 13 项评测覆盖 66% | 62.0覆盖 66% |
| 24 | DeepSeek V4.1 Flash开源权重 ↗DeepSeekDeepSeek · 9月10日上线 | 7 项评测覆盖 43% | 60.4覆盖 43% |
| 25 | Gemini 3.5 FlashGoogleGoogle · 5月19日上线 | 13 项评测覆盖 66% | 60.4覆盖 66% |
| 26 | Grok 4.5xAIxAI · 7月8日上线 | 12 项评测覆盖 63% | 56.0覆盖 63% |
| 27 | Gemini 3.1 Pro PreviewGoogleGoogle · 2月19日上线 | 14 项评测覆盖 69% | 56.0覆盖 69% |
| 28 | DeepSeek V4 Pro 0813开源权重 ↗DeepSeekDeepSeek · 8月13日上线 | 11 项评测覆盖 58% | 56.0覆盖 58% |
| 29 | Qwen3.7 MaxAlibabaAlibaba · 5月19日上线 | 10 项评测覆盖 52% | 49.3覆盖 52% |
| 30 | Claude Opus 4.7AnthropicAnthropic · 4月16日上线 | 13 项评测覆盖 65% | 49.3覆盖 65% |
分类榜已有领先成绩,但综合证据尚不足:Gemini 4 Argon(已有 2 项可比评测)、MiMo-V2.6-Pro(已有 2 项可比评测)。尚无综合参考位次不等于能力较弱,仍可查看已有分类与原始成绩。
Danbo AI资讯 评分为 0–100 分,越高表示本榜综合表现越强。同分按参考位次排列;筛选后保留原榜评分与位次,每次最多展示 30 个模型。
评分用于同一榜单、同一轮内的比较,不是正确率。各项评测的原始成绩可在模型详情查看。
如何看这张榜
Danbo AI资讯 评分越高,表示本榜综合表现越强;评分不是正确率,具体能力可查看分项成绩。价格不参与排序,缺测不补分。能力表现请结合分项原始成绩与运行配置判断。
了解计算方法 →关于价格
API 价格来自厂商官网,按每百万 Token 展示。价格目录更新至 2026-09-30,具体以厂商当前报价为准。美元报价按 2026-10-07 汇率折算成人民币。缓存价格指命中后的输入价格,缓存写入、存储及订阅费用另计。