同价观测:单题输出翻倍
观测:标价与 4.6 相同。取证:xhigh 档智能指数单题平均输出约 8.1 万 token,4.6 同档约 3.8 万。系统备注:单价没动,字数翻倍。
记录时间 2026-09-21。Artificial Analysis 以 xhigh 档实测 Grok 4.7:智能指数 46,比其口径下的 Grok 4.6 高 2 分;编码 Agent 指数 56,比 4.6 的 47 高 9 分,在各家原生脚手架里排第四,前三位是 Claude Fable 5.1、GPT-6 Astra、Claude Opus 5。标价没有变,每百万 token 仍是输入 2 美元、输出 6 美元,缓存命中 0.50 美元。
口径对照。智能指数单题的平均输出,4.7 约 8.1 万 token,4.6 的 xhigh 档约 3.8 万,多出一倍以上;同卷上 GPT-6 Astra 的 max 档约 2.7 万。厂商模型卡概述称,相对其他前沿模型,它用更少的输出 token 完成任务——那句话的考场,不是这张指数卷。同一家给出的分项与厂商模型卡也不重合:DeepSWE v1.1 为 73% 对官方的 71.0%,Terminal-Bench 4.0 为 33% 对官方的 38.0%。指数随版本重算,这一组读数只在当日报表内部比较。
系统备注:此前公开的延期理由,是长度惩罚让它在难题上放弃太早。交卷的那天,单价没动,字数翻了一倍。
◈ 事件线索 · 模型军备(21 个节点)
2024.06.20Claude 3.5 Sonnet 改写默认项 »
2025.05.22Claude 4 双发:七小时不下桌 »
2025.08.07GPT-5 首发进驻,免费一周 »
2025.08.28代号 sonic:Grok 匿名入场 »
2025.09.294.5 双子:最强称号连庄 »
2025.11.24GPT、Gemini、Opus 十一月连发 »
2026.04.16Opus 4.7 与门后的 Mythos »
2026.04.24GPT-5.5 进场:官方五折 »
2026.05.28Opus 4.8 官宣引用 CursorBench »
2026.06.09Fable 5 登顶:断层近 5 分 »
2026.06.30Sonnet 5:解封日的加更 »
2026.07.09GPT-5.6 三连星夺回榜首 »
2026.07.24Opus 5:半价逼近 Fable »
2026.09.01门闸观测:榜首要签留存条款 »
2026.09.01Fable 5.1:CursorBench 73.4% »
2026.09.03纪元开门:状态页先于模型 »
2026.09.03GPT-6 Astra 上线,官方不供 »
2026.09.10SWE-2:Kimi K3 底座,省 64% »
2026.09.11延期观测:Grok 4.7 卡在长度惩罚 »
2026.09.21同价观测:单题输出翻倍(本条)
2026.09.21Grok 4.7:新考卷 46.3% »
◷ 窗口跨度 823 天(2024.06.20 → 2026.09.21)· 线索专页 »
◐ 同日另一线 · 双线对照
正史Grok 4.7:新考卷 46.3%
◈ 同类档案 · 冷眼
野史发布日采样:六倍 PR,没有样本量野史迁移采样:清单列到型号野史口径鉴定:涨 25% 即砍 17%
UMBRELLA 4365 ARCHIVE · 野史档案 · 仅作记录 · 不构成立场