UMBRELLA 4365UMBRELLA 4365 · Cursor 战地纪实 CAPABILITY ASSAY · 能力评测

AA Intelligence Index

Artificial Analysis 智能指数是第三方评测机构对多项基准的综合加权分,常被媒体用作「谁是当前最强模型」的单一数字。本页按时间汇总各前沿模型的公开指数。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。

模型 10 个成绩 11 条前沿刷新 3 次2026.04.08 → 2026.09.03

◈ 当前榜 CURRENT BOARD每个模型取最近一次公开成绩

#模型成绩相对前沿日期口径 / 备注
1 Claude Fable 5.1
Anthropic
66 分 100 2026-09 版指数 · 第一 原文 ↗
2 Claude Opus 5
Anthropic
63 分 95.5 2026-09 版指数 原文 ↗
3 Claude Fable 5
Anthropic
62 分 93.9 2026-09 版指数(发布时口径为 64.9,指数已重算) 原文 ↗
4 GPT-6 Astra
OpenAI
61.2 分 92.7 官方发布对照表 · Index v4.1.1 原文 ↗
5 GPT-5.6 Sol
OpenAI
61 分 92.4 2026-09 版指数 原文 ↗
6 Grok 4.6
xAI / SpaceXAI
61 分 92.4 2026-09 版指数 原文 ↗
7 Muse Spark 1.3
Meta
61 分 92.4 第三方 AA · xhigh 档;max 预览档报 62 原文 ↗
8 Gemini 3.8 Flash
Google DeepMind
59 分 89.4 2026-09 版指数 · 单任务成本 $0.58 原文 ↗
9 Meta Muse Spark
Meta
52 分 78.8 发布时口径(Llama 4 Maverick 为 18) 原文 ↗
10 GLM-5.2
智谱 · GLM
51 分 77.3 发布时口径 · 开源 SOTA,与 Anthropic、OpenAI 同列前三 原文 ↗

◈ 能力曲线 CAPABILITY CURVE

◈ 前沿刷新记录 FRONTIER BREAKS榜首的保质期

日期刷新者分数提升在位
Meta Muse Spark Meta 52 分 首个记录 62 天
Claude Fable 5 Anthropic 64.9 分 +12.9 84 天
Claude Fable 5.1 Anthropic 66 分 +1.1 在位中 · 16 天
⇱ 返回完整时间树 UMBRELLA 4365 · 双线对照 · 由新到旧 · 全部档案