UMBRELLA 4365UMBRELLA 4365 · Cursor 战地纪实 ARCHIVE A-144
ARCHIVE ACCESS · A-144 · CLEARANCE LV.4⇱ 在时间树中定位
正史 · 官方档案 军备 ⌖ 模型厂商战区

Sonnet 5.5:同价,快三成

Anthropic 发布 Claude Sonnet 5.5:价格与 Sonnet 5 完全一致(2 / 10 美元),官方口径是同任务成本最多降三成、输出快三成以上。Terminal-Bench 4.0 从 Sonnet 5 的 10.3% 抬到 70.6%,六天后 Copilot 把 Sonnet 5.5 定为退役 Opus 4.7 的替代品。

9 月 28 日 18:03 UTC,Anthropic 发布 Claude Sonnet 5.5,自称 5.5 家族第二款,定位「相对 Sonnet 5 的明确升级,运行快 30% 以上,多数工作成本最多降 30%」。成绩表里最刺眼的一行是 Terminal-Bench 4.0:Sonnet 5 为 10.3%,Sonnet 5.5 为 70.6%,同门 Opus 5.5 为 66.4%——一个季度之内,终端 agent 基准的读数涨了六十个百分点。CursorBench 4.0 为 55.5%(Sonnet 5 为 34.1%),FrontierCode 1.1 Main 在 xhigh 档 52.1%、max 档 46.2%;系统卡另给 SWE-bench Pro 81.3%、SWE-bench Multilingual 90.3%、DeepSWE v1.1 71.0%、HLE 无工具 56.9%。第三方独立读数随后出现:Vals AI 以统一 harness 测得 Terminal-Bench 4.0 为 64.14%,位列第 2,以 Sonnet 5 作为服务端拒答回退。

价格表是这张公告里最不显眼的一段,因为它等于没变:输入每百万 token 2 美元、输出 10 美元、缓存读 0.20、五分钟缓存写 2.50,与 Sonnet 5 逐项相同。降本来自别处——官方称同样任务所需 token 更少。规格上:原生 1M 上下文、128K 最大输出(Batch API beta 下 300K)、知识截止 2026 年 6 月、自适应思考常开、五档 effort,最低可缓存提示从 1024 token 降到 512。API 侧模型 id 为 claude-sonnet-5-5,AWS / Google Cloud / Microsoft Foundry 同步可用;Claude Code 自 2.1.284 起 sonnet 别名即解析到 Sonnet 5.5,默认 medium 档。

四天后,GitHub 的动作把这条公告的余波定了下来:10 月 2 日,Copilot 全线下架四个模型,其中 Claude Opus 4.7 的建议替代品正是 Claude Opus 5.5——而 9 月 3 日预告时,那一栏写的还是 Claude Opus 5。

◈ 事件线索 · 模型军备(25 个节点)
2026.09.28Sonnet 5.5:同价,快三成(本条)
◷ 窗口跨度 834 天(2024.06.20 → 2026.10.02)· 线索专页 »
◐ 同日另一线 · 双线对照
野史换防观测:新模型进主菜单,进不了子代理
◈ 同类档案 · 军备
正史Astra 进 Copilot 全线,Cursor 无正史Astra 定级 Critical:先设卡再发布
UMBRELLA 4365 ARCHIVE · 正史档案 · 仅作记录 · 不构成立场
⇱ 返回完整时间树 UMBRELLA 4365 · 正史 87 条 × 野史 60 条 · 双线对照阅读