UMBRELLA 4365UMBRELLA 4365 · Cursor 战地纪实 ARCHIVE A-138
ARCHIVE ACCESS · A-138 · CLEARANCE LV.4⇱ 在时间树中定位
正史 · 官方档案 发布

Grok 4.7:新考卷 46.3%

Grok 4.7 当日进入 Cursor 与 Grok Build,标价与 4.6 相同。CursorBench 4.0 报 46.3%,同表 Fable 5.1 为 51.8%。模型卡写明,补充训练用了匿名化的 Cursor 工作流数据。

SpaceXAI 于 2026 年 9 月 21 日放出 Grok 4.7,称为目前最强的编码与知识工作模型。当日进入 Cursor——员工 Colin 在论坛写明全档位可用——以及 Grok Build;API 模型名 grok-4.7 同步开放。标价与 4.6 相同:每百万 token 输入 2 美元、输出 6 美元,提示超过 20 万 token 时两边都翻倍。另有 Fast 变体,输出速度与 token 价格均为两倍,发布说明写明只在 Cursor 与 Grok Build 提供,不进公开 API。上下文窗口 50 万 token。

发布页标题写着「可比模型的两倍速度、一半价格」,正文又写「与 4.6 同价同速」。对照表的价格列是 Grok 2/6 美元、GPT-5.6 Sol 4/20 美元、Fable 5.1 10/50 美元。CursorBench 4.0 因加长了任务,模型卡注明与 3.2 不可比:xhigh 档 46.3%,high 档 43.9%;同表 Grok 4.6 为 40.4%,Sol 为 41.7%,Fable 5.1 为 51.8%。Terminal-Bench 4.0 在 Grok Build 上为 38.0%,4.6 为 20.3%。DeepSWE v1.1 在 high 档、统一的 mini-SWE-agent 下为 71.0%,同表 Sol 72.7%、Fable 5.1 70.0%。性价比的前沿和能力的前沿,印在同一张表的两列里。

模型卡脚注写明,为抬升编码与 agent 表现,补充训练使用了匿名化的 Cursor 工作流数据。底座被称作比 4.6 更大,参数量没有写进模型卡。预训练数据截止 2026 年 6 月,补充训练用到 8 月生成的数据。概述里还有一句:相对其他前沿模型,它用更少的步骤、更少的输出 token 到达结果。网页、移动应用和 X 里的 Grok,模型卡写的是稍后才上。同一天 GitHub 宣布 Copilot 开始铺开这只模型,并注明铺开是渐进的。创始人此前把延期归因于强化学习里对回答长度罚得太重,模型在难题上放弃太早;发布说明改写成:它会把自己的工作查得更仔细。

◈ 事件线索 · 模型军备(21 个节点)
2026.09.21Grok 4.7:新考卷 46.3%(本条)
◷ 窗口跨度 823 天(2024.06.20 → 2026.09.21)· 线索专页 »
◐ 同日另一线 · 双线对照
野史同价观测:单题输出翻倍
◈ 同类档案 · 发布
正史Projects:一个协调者,千个子代理正史自托管执行机:推理仍在云端正史Grok Bot 下放付费全线
UMBRELLA 4365 ARCHIVE · 正史档案 · 仅作记录 · 不构成立场
⇱ 返回完整时间树 UMBRELLA 4365 · 正史 83 条 × 野史 56 条 · 双线对照阅读