Grok 4.7:新考卷 46.3%
Grok 4.7 当日进入 Cursor 与 Grok Build,标价与 4.6 相同。CursorBench 4.0 报 46.3%,同表 Fable 5.1 为 51.8%。模型卡写明,补充训练用了匿名化的 Cursor 工作流数据。
SpaceXAI 于 2026 年 9 月 21 日放出 Grok 4.7,称为目前最强的编码与知识工作模型。当日进入 Cursor——员工 Colin 在论坛写明全档位可用——以及 Grok Build;API 模型名 grok-4.7 同步开放。标价与 4.6 相同:每百万 token 输入 2 美元、输出 6 美元,提示超过 20 万 token 时两边都翻倍。另有 Fast 变体,输出速度与 token 价格均为两倍,发布说明写明只在 Cursor 与 Grok Build 提供,不进公开 API。上下文窗口 50 万 token。
发布页标题写着「可比模型的两倍速度、一半价格」,正文又写「与 4.6 同价同速」。对照表的价格列是 Grok 2/6 美元、GPT-5.6 Sol 4/20 美元、Fable 5.1 10/50 美元。CursorBench 4.0 因加长了任务,模型卡注明与 3.2 不可比:xhigh 档 46.3%,high 档 43.9%;同表 Grok 4.6 为 40.4%,Sol 为 41.7%,Fable 5.1 为 51.8%。Terminal-Bench 4.0 在 Grok Build 上为 38.0%,4.6 为 20.3%。DeepSWE v1.1 在 high 档、统一的 mini-SWE-agent 下为 71.0%,同表 Sol 72.7%、Fable 5.1 70.0%。性价比的前沿和能力的前沿,印在同一张表的两列里。
模型卡脚注写明,为抬升编码与 agent 表现,补充训练使用了匿名化的 Cursor 工作流数据。底座被称作比 4.6 更大,参数量没有写进模型卡。预训练数据截止 2026 年 6 月,补充训练用到 8 月生成的数据。概述里还有一句:相对其他前沿模型,它用更少的步骤、更少的输出 token 到达结果。网页、移动应用和 X 里的 Grok,模型卡写的是稍后才上。同一天 GitHub 宣布 Copilot 开始铺开这只模型,并注明铺开是渐进的。创始人此前把延期归因于强化学习里对回答长度罚得太重,模型在难题上放弃太早;发布说明改写成:它会把自己的工作查得更仔细。