UMBRELLA 4365UMBRELLA 4365 · Cursor 战地纪实 STRAIN DOSSIER · 毒株档案 · Anthropic

Claude Fable 5

Anthropic · Claude 谱系 · 2026.06.09 发布 · 在 11 项基准上留有 14 条公开成绩。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。

Claude 5 世代第一枪,「做了安全处理的 Mythos 级模型」。智能指数断层登顶,领先最近的非 Anthropic 模型近 5 分。它的第一个完整月,一半时间在停机。

◈ 评分卡 SCORECARD

综合分 · 相对前沿82.4
总排名#9 / 27
已测维度6 / 6
综合分 = 各已测维度「相对前沿分」的平均:每个维度取该模型最近一次公开成绩,除以该维度当前最高分(最高 = 100)。至少两个维度有成绩才入总榜,覆盖维度数标在分数旁;未测不等于不行,只是没人公开考过。
维度基准成绩相对前沿该维度当前最高日期
编码 SWE-bench Verified 95.5% 98.5 Muse Spark 1.3 75.4% 2026.06.09
终端 Agent Terminal-Bench 4.0 44.5% 73.1 Claude Mythos 5.1 60.9% 2026.09.03
科研 Agent Terminal-Bench-Science 0.1 24.7% 38.2 GPT-6 Astra 64.6% 2026.09.01
Cursor 考卷 CursorBench 70.5% 96 Claude Fable 5.1 73.4% 2026.09.01
综合智能 AA Intelligence Index 62 分 93.9 Claude Fable 5.1 66 分 2026.09.01
前沿推理 HLE 57.8% 94.9 Claude Fable 5.1 60.9% 2026.09.01

◈ 身份卡 IDENTITY

实验室 LABAnthropic
谱系 FAMILYClaude
发布日 RELEASE
定位 TIER旗舰
上下文 CONTEXT1M
价格 PRICE$10 / $50 每百万 token 输入 / 输出
权重 WEIGHTS闭源 CLOSED
状态 STATUS在役 ACTIVE
信源 SOURCEwww.anthropic.com/news/claude-fable-5-mythos-5
站内档案 ARCHIVE档案 #52 »

◈ 全部公开成绩 ALL RESULTS14 条

基准分数日期口径 / 备注信源
AA Coding Agent Index 67.2 分 v1.4 版指数 · 据 GPT-6 Astra 发布对照表 原文 ↗
AA Intelligence Index 62 分 2026-09 版指数(发布时口径为 64.9,指数已重算) 原文 ↗
AA Intelligence Index 64.9 分 发布时口径:断层登顶,领先 GPT-5.5 近 5 分 原文 ↗
CursorBench 70.5% CursorBench 3.2 满力档 · 据 Fable 5.1 发布对照表 原文 ↗
DeepSWE v1.1 69.9% 据 GPT-6 Astra 发布对照表 · xhigh 档(Cognition 注:Max 档 69.7 反而更低) 原文 ↗
FrontierCode 1.1 Main 53.5% 据 GPT-6 Astra 发布对照表(Extended 64.9) 原文 ↗
HLE 57.8% 无工具 · 据 Fable 5.1 发布对照表(带工具 63.8;Kimi K3 报告对照为 53.3) 原文 ↗
HLE 53.3% 无工具 · 据 Kimi K3 技术报告对照表(带工具 63.0) 原文 ↗
SWE-bench Pro 80.3% 官方自报 原文 ↗
SWE-bench Verified 95.5% 官方自报 原文 ↗
Terminal-Bench 2.1 88% 官方自报 原文 ↗
Terminal-Bench 4.0 44.5% 据 GPT-6 Astra 发布对照表(Anthropic 自家表为 42.0) 原文 ↗
Terminal-Bench 4.0 42% 据 Fable 5.1 发布材料的对照数字 原文 ↗
Terminal-Bench-Science 0.1 24.7% 据 Fable 5.1 发布材料的对照数字 原文 ↗

◈ 同谱系 LINEAGEAnthropic · Claude · 由旧到新

◈ 相关档案 RELATED RECORDS按模型名在档案库检索 · 含正史与野史

正史登顶
Fable 5 登顶:断层近 5 分

Anthropic 打响 Claude 5 世代第一枪:Fable 5,「做了安全处理的 Mythos 级模型」。AA 智能指数 64.9 断层登顶,SWE-Bench Verified 95.5%,CursorBench 刷新纪录。它的第一个完整月,一半时间在停机。

正史军备⌖ DEVIN 战区
SWE-2:Kimi K3 底座,省 64%

Cognition 发布 SWE-2:在月之暗面 2.8 万亿参数的开源模型 Kimi K3 上再做强化学习,FrontierCode 1.1 Main 50.0%,距 Fable 5.1 一分,成本低 64%。不放权重、无 API,只在 Devin 内可用。

正史纪元
GPT-6 Astra 上线,官方不供

OpenAI 放出 GPT-6 Astra,总裁 Brockman 当众说「欢迎来到 AGI 纪元」。API 每百万 token 10 / 50 美元,对标 Fable 5.1。先给 Daybreak,再放 Plus 与 API。Cursor 官方渠道没有这一款。

正史登顶
Fable 5.1:CursorBench 73.4%

Anthropic 同日放出 Fable 5.1 与 Mythos 5.1:同一套权重,两道护栏。输入输出仍 10 / 50 美元每百万 token,缓存读取砍到四分之一。Cursor 当日上架,CursorBench 3.2 满力档 73.4%,自称测过最强。Mythos 仍只给受审通道。

正史平替
Opus 5:半价逼近 Fable

Anthropic 发布 Opus 5:接近 Fable 5 的智能,价格一半,CursorBench 满力档与 Fable 峰值只差 0.5%。发布前它已在 Cursor 里两度走光——代号 Honeycomb,连报错弹窗都提前泄了底。

正史夺榜
GPT-5.6 三连星夺回榜首

紧随 Grok 4.5 发布,OpenAI 甩出 GPT-5.6 家族:旗舰 Sol、均衡 Terra、走量 Luna。Coding Agent Index 80 分反超 Fable 5 近 3 分且便宜三成。数周之内,四张王牌全部亮出。

⇱ 返回完整时间树 UMBRELLA 4365 · 双线对照 · 由新到旧 · 全部档案