Claude Fable 5
Anthropic · Claude 谱系 · 2026.06.09 发布 · 在 11 项基准上留有 14 条公开成绩。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。
Claude 5 世代第一枪,「做了安全处理的 Mythos 级模型」。智能指数断层登顶,领先最近的非 Anthropic 模型近 5 分。它的第一个完整月,一半时间在停机。
◈ 评分卡 SCORECARD
| 维度 | 基准 | 成绩 | 相对前沿 | 该维度当前最高 | 日期 |
|---|---|---|---|---|---|
| 编码 | SWE-bench Verified | 95.5% | 98.5 | Muse Spark 1.3 75.4% | 2026.06.09 |
| 终端 Agent | Terminal-Bench 4.0 | 44.5% | 73.1 | Claude Mythos 5.1 60.9% | 2026.09.03 |
| 科研 Agent | Terminal-Bench-Science 0.1 | 24.7% | 38.2 | GPT-6 Astra 64.6% | 2026.09.01 |
| Cursor 考卷 | CursorBench | 70.5% | 96 | Claude Fable 5.1 73.4% | 2026.09.01 |
| 综合智能 | AA Intelligence Index | 62 分 | 93.9 | Claude Fable 5.1 66 分 | 2026.09.01 |
| 前沿推理 | HLE | 57.8% | 94.9 | Claude Fable 5.1 60.9% | 2026.09.01 |
◈ 身份卡 IDENTITY
| 实验室 LAB | Anthropic |
| 谱系 FAMILY | Claude |
| 发布日 RELEASE | |
| 定位 TIER | 旗舰 |
| 上下文 CONTEXT | 1M |
| 价格 PRICE | $10 / $50 每百万 token 输入 / 输出 |
| 权重 WEIGHTS | 闭源 CLOSED |
| 状态 STATUS | 在役 ACTIVE |
| 信源 SOURCE | www.anthropic.com/news/claude-fable-5-mythos-5 |
| 站内档案 ARCHIVE | 档案 #52 » |
◈ 全部公开成绩 ALL RESULTS14 条
| 基准 | 分数 | 日期 | 口径 / 备注 | 信源 |
|---|---|---|---|---|
| AA Coding Agent Index | 67.2 分 | v1.4 版指数 · 据 GPT-6 Astra 发布对照表 | 原文 ↗ | |
| AA Intelligence Index | 62 分 | 2026-09 版指数(发布时口径为 64.9,指数已重算) | 原文 ↗ | |
| AA Intelligence Index | 64.9 分 | 发布时口径:断层登顶,领先 GPT-5.5 近 5 分 | 原文 ↗ | |
| CursorBench | 70.5% | CursorBench 3.2 满力档 · 据 Fable 5.1 发布对照表 | 原文 ↗ | |
| DeepSWE v1.1 | 69.9% | 据 GPT-6 Astra 发布对照表 · xhigh 档(Cognition 注:Max 档 69.7 反而更低) | 原文 ↗ | |
| FrontierCode 1.1 Main | 53.5% | 据 GPT-6 Astra 发布对照表(Extended 64.9) | 原文 ↗ | |
| HLE | 57.8% | 无工具 · 据 Fable 5.1 发布对照表(带工具 63.8;Kimi K3 报告对照为 53.3) | 原文 ↗ | |
| HLE | 53.3% | 无工具 · 据 Kimi K3 技术报告对照表(带工具 63.0) | 原文 ↗ | |
| SWE-bench Pro | 80.3% | 官方自报 | 原文 ↗ | |
| SWE-bench Verified | 95.5% | 官方自报 | 原文 ↗ | |
| Terminal-Bench 2.1 | 88% | 官方自报 | 原文 ↗ | |
| Terminal-Bench 4.0 | 44.5% | 据 GPT-6 Astra 发布对照表(Anthropic 自家表为 42.0) | 原文 ↗ | |
| Terminal-Bench 4.0 | 42% | 据 Fable 5.1 发布材料的对照数字 | 原文 ↗ | |
| Terminal-Bench-Science 0.1 | 24.7% | 据 Fable 5.1 发布材料的对照数字 | 原文 ↗ |
◈ 同谱系 LINEAGEAnthropic · Claude · 由旧到新
◈ 相关档案 RELATED RECORDS按模型名在档案库检索 · 含正史与野史
Anthropic 打响 Claude 5 世代第一枪:Fable 5,「做了安全处理的 Mythos 级模型」。AA 智能指数 64.9 断层登顶,SWE-Bench Verified 95.5%,CursorBench 刷新纪录。它的第一个完整月,一半时间在停机。
Cognition 发布 SWE-2:在月之暗面 2.8 万亿参数的开源模型 Kimi K3 上再做强化学习,FrontierCode 1.1 Main 50.0%,距 Fable 5.1 一分,成本低 64%。不放权重、无 API,只在 Devin 内可用。
OpenAI 放出 GPT-6 Astra,总裁 Brockman 当众说「欢迎来到 AGI 纪元」。API 每百万 token 10 / 50 美元,对标 Fable 5.1。先给 Daybreak,再放 Plus 与 API。Cursor 官方渠道没有这一款。
Anthropic 同日放出 Fable 5.1 与 Mythos 5.1:同一套权重,两道护栏。输入输出仍 10 / 50 美元每百万 token,缓存读取砍到四分之一。Cursor 当日上架,CursorBench 3.2 满力档 73.4%,自称测过最强。Mythos 仍只给受审通道。
Anthropic 发布 Opus 5:接近 Fable 5 的智能,价格一半,CursorBench 满力档与 Fable 峰值只差 0.5%。发布前它已在 Cursor 里两度走光——代号 Honeycomb,连报错弹窗都提前泄了底。
紧随 Grok 4.5 发布,OpenAI 甩出 GPT-5.6 家族:旗舰 Sol、均衡 Terra、走量 Luna。Coding Agent Index 80 分反超 Fable 5 近 3 分且便宜三成。数周之内,四张王牌全部亮出。