Claude Fable 5.1
Anthropic · Claude 谱系 · 2026.09.01 发布 · 在 8 项基准上留有 8 条公开成绩。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。
与 Mythos 5.1 同一套权重、两道护栏。输入输出价格不动,缓存读取砍到四分之一;Cursor 当日上架,自家考卷上的最高分。使用须先签三十日留存条款。
◈ 评分卡 SCORECARD
综合分 · 相对前沿93.7
总排名#3 / 27
已测维度6 / 6
综合分 = 各已测维度「相对前沿分」的平均:每个维度取该模型最近一次公开成绩,除以该维度当前最高分(最高 = 100)。至少两个维度有成绩才入总榜,覆盖维度数标在分数旁;未测不等于不行,只是没人公开考过。
| 维度 | 基准 | 成绩 | 相对前沿 | 该维度当前最高 | 日期 |
|---|---|---|---|---|---|
| 编码 | DeepSWE v1.1 | 67.4% | 89.4 | Muse Spark 1.3 75.4% | 2026.09.03 |
| 终端 Agent | Terminal-Bench 4.0 | 55.8% | 91.6 | Claude Mythos 5.1 60.9% | 2026.09.01 |
| 科研 Agent | Terminal-Bench-Science 0.1 | 52.6% | 81.4 | GPT-6 Astra 64.6% | 2026.09.01 |
| Cursor 考卷 | CursorBench | 73.4% | 100 | 本模型 | 2026.09.01 |
| 综合智能 | AA Intelligence Index | 66 分 | 100 | 本模型 | 2026.09.01 |
| 前沿推理 | HLE | 60.9% | 100 | 本模型 | 2026.09.01 |
◈ 身份卡 IDENTITY
| 实验室 LAB | Anthropic |
| 谱系 FAMILY | Claude |
| 发布日 RELEASE | |
| 定位 TIER | 旗舰 |
| 上下文 CONTEXT | 1M |
| 价格 PRICE | $10 / $50 每百万 token 输入 / 输出 |
| 权重 WEIGHTS | 闭源 CLOSED |
| 状态 STATUS | 在役 ACTIVE |
| 信源 SOURCE | www.anthropic.com/claude-fable-and-mythos-5-1 |
| 站内档案 ARCHIVE | 档案 #111 » |
◈ 全部公开成绩 ALL RESULTS8 条
| 基准 | 分数 | 日期 | 口径 / 备注 | 信源 |
|---|---|---|---|---|
| AA Intelligence Index | 66 分 | 2026-09 版指数 · 第一 | 原文 ↗ | |
| CursorBench | 73.4% | CursorBench 3.2 满力档 · Cursor 员工论坛公告 | 原文 ↗ | |
| DeepSWE v1.1 | 67.4% | 据 GPT-6 Astra 发布对照表 · 最大努力档 | 原文 ↗ | |
| FrontierCode 1.1 Main | 50.9% | 据 GPT-6 Astra 发布对照表,与 Cognition SWE-2 表一致(Extended 63.6) | 原文 ↗ | |
| HLE | 60.9% | 无工具 · 官方自报(带工具 65.0) | 原文 ↗ | |
| Terminal-Bench 2.1 | 91.4% | 据 Cognition SWE-2 发布对照表 · Claude Code harness | 原文 ↗ | |
| Terminal-Bench 4.0 | 55.8% | 官方自报 | 原文 ↗ | |
| Terminal-Bench-Science 0.1 | 52.6% | 官方自报 | 原文 ↗ |
◈ 同谱系 LINEAGEAnthropic · Claude · 由旧到新
Claude 2→Claude 3→Claude 3.5 Sonnet→Claude 3.7 Sonnet→Claude Opus 4→Claude Sonnet 4→Claude Opus 4.1→Claude Sonnet 4.5→Claude Haiku 4.5→Claude Opus 4.5→Claude Opus 4.6→Claude Mythos Preview→Claude Opus 4.7→Claude Opus 4.8→Claude Fable 5→Claude Mythos 5→Claude Sonnet 5→Claude Opus 5→Claude Fable 5.1→Claude Mythos 5.1
◈ 相关档案 RELATED RECORDS按模型名在档案库检索 · 含正史与野史
正史登顶
Fable 5.1:CursorBench 73.4%
Anthropic 同日放出 Fable 5.1 与 Mythos 5.1:同一套权重,两道护栏。输入输出仍 10 / 50 美元每百万 token,缓存读取砍到四分之一。Cursor 当日上架,CursorBench 3.2 满力档 73.4%,自称测过最强。Mythos 仍只给受审通道。
正史军备⌖ DEVIN 战区
SWE-2:Kimi K3 底座,省 64%
Cognition 发布 SWE-2:在月之暗面 2.8 万亿参数的开源模型 Kimi K3 上再做强化学习,FrontierCode 1.1 Main 50.0%,距 Fable 5.1 一分,成本低 64%。不放权重、无 API,只在 Devin 内可用。
正史纪元
GPT-6 Astra 上线,官方不供
OpenAI 放出 GPT-6 Astra,总裁 Brockman 当众说「欢迎来到 AGI 纪元」。API 每百万 token 10 / 50 美元,对标 Fable 5.1。先给 Daybreak,再放 Plus 与 API。Cursor 官方渠道没有这一款。