AA Intelligence Index
Artificial Analysis 智能指数是第三方评测机构对多项基准的综合加权分,常被媒体用作「谁是当前最强模型」的单一数字。本页按时间汇总各前沿模型的公开指数。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。
模型 10 个成绩 11 条前沿刷新 3 次2026.04.08 → 2026.09.03
◈ 当前榜 CURRENT BOARD每个模型取最近一次公开成绩
| # | 模型 | 成绩 | 相对前沿 | 日期 | 口径 / 备注 |
|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 Anthropic |
66 分 | 100 | 2026-09 版指数 · 第一 原文 ↗ | |
| 2 | Claude Opus 5 Anthropic |
63 分 | 95.5 | 2026-09 版指数 原文 ↗ | |
| 3 | Claude Fable 5 Anthropic |
62 分 | 93.9 | 2026-09 版指数(发布时口径为 64.9,指数已重算) 原文 ↗ | |
| 4 | GPT-6 Astra OpenAI |
61.2 分 | 92.7 | 官方发布对照表 · Index v4.1.1 原文 ↗ | |
| 5 | GPT-5.6 Sol OpenAI |
61 分 | 92.4 | 2026-09 版指数 原文 ↗ | |
| 6 | Grok 4.6 xAI / SpaceXAI |
61 分 | 92.4 | 2026-09 版指数 原文 ↗ | |
| 7 | Muse Spark 1.3 Meta |
61 分 | 92.4 | 第三方 AA · xhigh 档;max 预览档报 62 原文 ↗ | |
| 8 | Gemini 3.8 Flash Google DeepMind |
59 分 | 89.4 | 2026-09 版指数 · 单任务成本 $0.58 原文 ↗ | |
| 9 | Meta Muse Spark Meta |
52 分 | 78.8 | 发布时口径(Llama 4 Maverick 为 18) 原文 ↗ | |
| 10 | GLM-5.2 智谱 · GLM |
51 分 | 77.3 | 发布时口径 · 开源 SOTA,与 Anthropic、OpenAI 同列前三 原文 ↗ |
◈ 能力曲线 CAPABILITY CURVE
● 公开成绩(悬停看读数,点击进档案)◆ 刷新纪录的成绩— 前沿线(历史最高分的阶梯)
◈ 前沿刷新记录 FRONTIER BREAKS榜首的保质期
| 日期 | 刷新者 | 分数 | 提升 | 在位 |
|---|---|---|---|---|
| Meta Muse Spark Meta | 52 分 | 首个记录 | 62 天 | |
| Claude Fable 5 Anthropic | 64.9 分 | +12.9 | 84 天 | |
| Claude Fable 5.1 Anthropic | 66 分 | +1.1 | 在位中 · 16 天 |