2026 年 9 月大模型排行榜

| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | claude-fable-5 | 1508 |
| 2 | claude-opus-4-6-high | 1505 |
| 3 | claude-opus-4-7-high | 1502 |
| 4 | muse-spark-1.2 (xHigh) | 1499 |
| 5 | claude-opus-4-6 | 1498 |
| 6 | claude-opus-4-7 | 1494 |
| 7 | claude-opus-5-high | 1492 |
| 8 | muse-spark-1.1 | 1491 |
| 9 | gemini-3.7-flash-high | 1491 |
| 10 | kimi-k3-max | 1489 |
| 11 | muse-spark | 1488 |
| 12 | claude-opus-5-max | 1488 |
| 13 | gemini-3.1-pro | 1487 |
| 14 | gemini-3-pro | 1486 |
| 15 | gpt-5.6-sol-xhigh | 1483 |
| 16 | gpt-5.5-high | 1482 |
| 17 | glm-5.3-max | 1482 |
| 18 | claude-opus-4-8-high | 1482 |
| 19 | gemini-3.6-flash-high | 1480 |
| 20 | qwen3.8-max | 1479 |
| 排名 | 模型 | 分数 | 机构 |
|---|---|---|---|
| 1 | claude-fable-5 | 1508 | Anthropic |
| 2 | claude-opus-4-6-high | 1505 | Anthropic |
| 3 | claude-opus-4-7-high | 1502 | Anthropic |
| 4 | muse-spark-1.2 (xHigh) | 1499 | Meta |
| 5 | claude-opus-4-6 | 1498 | Anthropic |
| 6 | claude-opus-4-7 | 1494 | Anthropic |
| 7 | claude-opus-5-high | 1492 | Anthropic |
| 8 | muse-spark-1.1 | 1491 | Meta |
| 9 | gemini-3.7-flash-high | 1491 | |
| 10 | kimi-k3-max | 1489 | Moonshot |
| 11 | muse-spark | 1488 | Meta |
| 12 | claude-opus-5-max | 1488 | Anthropic |
| 13 | gemini-3.1-pro | 1487 | |
| 14 | gemini-3-pro | 1486 | |
| 15 | gpt-5.6-sol-xhigh | 1483 | OpenAI |
| 16 | gpt-5.5-high | 1482 | OpenAI |
| 17 | glm-5.3-max | 1482 | Z.ai |
| 18 | claude-opus-4-8-high | 1482 | Anthropic |
| 19 | gemini-3.6-flash-high | 1480 | |
| 20 | qwen3.8-max | 1479 | Alibaba |
「LMArena 排名」是基于众包用户投票的大语言模型排行榜。通过让用户与两个匿名模型对话并选择更好的回答,使用 Elo 评分系统计算模型的相对实力。该排行榜覆盖文本、视觉、代码等多个能力维度,是目前最权威的 LLM 评测榜单之一,基于此榜单我们做了模型名称聚合和清理工作。