视觉榜单
本页展示 Arena AI 榜单前 30 名的每日快照,方便快速了解近期模型表现。完整榜单、筛选项和最新变化请到 Arena AI 官网查看。
本榜单评测多模态模型在图像理解类任务上的表现。
数据更新时间: 2026-09-19 12:14:58 UTC / 2026-09-19 20:14:58 CST (北京时间)
前 30 名
| 排名 | 排名区间 | 模型 | 分数 | 票数 | 价格 $/百万Token | 上下文 |
|---|---|---|---|---|---|---|
| 1 | 1-8 | claude-fable-5-high 1 | 1310 (±8) | 11,304 | $10 / $50 | 1M |
| 2 | 1-14 | qwen3.8-max 1 | 1302 (±8) | 8,665 | $2 / $6 | 1M |
| 3 | 1-14 | claude-opus-4-7-high 1 | 1301 (±7) | 21,092 | $5 / $25 | 1M |
| 4 | 1-15 | claude-opus-4-7 1 | 1300 (±7) | 21,450 | $5 / $25 | 1M |
| 5 | 1-16 | claude-opus-4-6-high 1 | 1299 (±7) | 20,835 | $5 / $25 | 1M |
| 6 | 1-30 | muse-spark-1.3-max 1 | 1294 (±15) | 1,804 | N/A | N/A |
| 7 | 1-28 | muse-spark 1 | 1294 (±9) | 5,572 | N/A | N/A |
| 8 | 2-26 | claude-opus-4-6 1 | 1293 (±7) | 25,140 | $5 / $25 | 1M |
| 9 | 1-31 | muse-spark-1.2 (xHigh) 1 | 1292 (±15) | 1,841 | $1.25 / $4.25 | N/A |
| 10 | 2-30 | claude-opus-5-high 1 | 1289 (±8) | 11,599 | $5 / $25 | 1M |
| 11 | 2-31 | claude-fable-5.1-max 1 | 1289 (±12) | 2,701 | $10 / $50 | 1M |
| 12 | 2-30 | gemini-3-pro 1 | 1289 (±8) | 12,995 | $2 / $12 | 1M |
| 13 | 4-30 | gpt-5.5 1 | 1287 (±6) | 23,423 | $5 / $30 | 1.1M |
| 14 | 2-31 | gpt-5.6-sol-xhigh 1 | 1286 (±8) | 7,729 | $4 / $20 | N/A |
| 15 | 6-30 | gpt-5.4-high 1 | 1285 (±6) | 25,357 | $2.50 / $15 | 1.1M |
| 16 | 2-38 | gpt-6-astra-max 1 | 1284 (±17) | 1,367 | N/A | N/A |
| 17 | 6-31 | gemini-3.5-flash-high 1 | 1284 (±8) | 9,579 | $0.75 / $4.50 | 1M |
| 18 | 6-31 | claude-opus-4-8-high 1 | 1283 (±7) | 15,274 | $5 / $25 | 1M |
| 19 | 6-31 | gpt-5.5-high 1 | 1283 (±6) | 21,960 | $5 / $30 | 1.1M |
| 20 | 6-32 | gemini-3.5-flash-medium 1 | 1283 (±8) | 9,618 | $0.75 / $4.50 | 1M |
| 21 | 5-35 | gemini-3.6-flash-high 1 | 1283 (±10) | 5,159 | $0.75 / $3.75 | 1M |
| 22 | 6-35 | muse-spark-1.1 1 | 1281 (±8) | 8,447 | $1.25 / $4.25 | 1M |
| 23 | 6-35 | gpt-5.4 1 | 1280 (±7) | 21,188 | $1.25 / $7.50 | 1.1M |
| 24 | 6-35 | grok-4.5 1 | 1279 (±8) | 8,355 | $2 / $6 | 500K |
| 25 | 7-35 | claude-opus-4-8 1 | 1279 (±7) | 15,801 | $5 / $25 | 1M |
| 26 | 8-35 | gemini-3.1-pro-preview 1 | 1279 (±5) | 40,691 | $1 / $6 | 1M |
| 27 | 7-35 | gpt-5.2-chat-latest-20260210 1 | 1278 (±7) | 15,432 | $1.75 / $14 | 128K |
| 28 | 6-37 | gpt-5.5-instant 1 | 1278 (±9) | 7,226 | $5 / $30 | 1.1M |
| 29 | 8-37 | claude-sonnet-4-6 1 | 1275 (±6) | 25,552 | $1.50 / $7.50 | 1M |
| 30 | 6-41 | glm-5.3-flash 1 | 1275 (±12) | 3,110 | $0.07 / $0.25 | 1M |
怎么看这张表
- 排名 / 排名区间:Arena AI 根据对战投票估算的相对名次;排名区间表示在置信范围内的名次波动。
- 分数:相对评分,适合比较同一时刻榜单中的模型。
- 票数 / 会话数:样本量参考;样本较少时,排名通常更容易波动。
- 价格 $/百万Token:输入 / 输出每百万 Token 的参考价格。
- 上下文:模型支持的最大上下文长度。
选模型时再确认三件事
- Provider 是否实际提供这个模型,以及你的地区和账户是否可用;
- API 价格、速率限制和上下文是否适合你的任务;
- 用 3~5 个真实任务做小规模测试,不要只看总榜名次。
数据来源
数据来自 Arena AI 官方 视觉榜单,由 GitHub Actions 每天更新。模型价格、许可证和能力请以模型服务商官方信息为准。
