UMBRELLA 4365UMBRELLA 4365 · Cursor 战地纪实 ARCHIVE A-121
ARCHIVE ACCESS · A-121 · CLEARANCE LV.4⇱ 在时间树中定位
正史 · 官方档案 变阵 ⌖ 模型厂商战区

Gemini 3.8 Flash:六周三发

Google 六周内第三次发 Flash:3.8 Flash 售价不变,Terminal-Bench 2.1 以 89.4% 压过 Opus 5,单价只有后者的 15%。被反复推迟的旗舰 3.5 Pro 据报已在内部叫停,下一款 Pro 要等 Gemini 4。小杯当家,大杯缺席。

2026 年 9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber——距 3.7 Flash 仅三周,六周内第三次 Flash 发布。官方称其为「迄今最强的推理与编码模型」,速度与价格与 3.7 持平:介绍价每百万 token 0.75 / 3.75 美元至 12 月 31 日,2027 年 1 月 1 日起翻倍为 1.50 / 7.50 美元;1M 上下文、最长 65K 输出,知识截止 2026 年 3 月。Antigravity 的默认模型当日切为 3.8 Flash;Cyber 版只经新设的 Fairwind 计划向受信任的政府机构、关键基础设施运营方与软件维护者开放。

Google 自家 14 组对照里它拿下 8 组第一。DeepSWE v1.1 长程软件工程 73.7%(3.7 Flash 为 65.3%),距 Opus 5 的 74.0% 一步;Terminal-Bench 2.1 89.4%,高出 Opus 5 的 89.1% 与 GPT-5.6 Sol 的 88.8%;HLE-Verified 54.9%。短板同样写在表上:Terminal-Bench 4.0 只有 19.1%,Fable 5.1 是 55.8%、Opus 5 是 51.8%;OSWorld-2.0 59.0% 对 Opus 5 的 75.4%。Artificial Analysis 给出智能指数 59、单任务成本 0.58 美元——按 token 计比旗舰便宜一个量级,按任务计却比 3.7 Flash 贵了约四成,Google 自己建议效率优先的负载留在 3.7。

缺席的是旗舰。5 月 I/O 上 Google 说 3.5 Pro「下个月推出」,此后连续跳票,被称为「2026 年等得最久的模型」;《华尔街日报》据报称该项目已在内部叫停,理由是相对 Flash 线提升不足,下一款 Pro 或直接以 Gemini 4 之名出现。DeepMind 同期换帅——据报道 Hassabis 转任首席科学家,Koray Kavukcuoglu 接掌——新掌门表态仍要在原始能力上争第一。放回本站的坐标:Cursor 的补给表上 Google 从来不在头排,发布首日论坛公告区也未见 3.8 Flash 的名字,开发者要用得经 OpenRouter 或 Vercel AI Gateway 等第三方网关接入。断供通牒在菜单一侧空出的位置,Google 递来的是一只小杯。

◐ 同日另一线 · 双线对照
野史二次回血:全员周池静默归零
◈ 同类档案 · 变阵
正史续订失败:权益回收窗口收紧正史2.0 当天,联创 CTO 离席正史Ultra 上线:200 刀换 20 倍
UMBRELLA 4365 ARCHIVE · 正史档案 · 仅作记录 · 不构成立场
⇱ 返回完整时间树 UMBRELLA 4365 · 正史 82 条 × 野史 55 条 · 双线对照阅读