GLM-5
智谱 · GLM · GLM 谱系 · 2026.02.12 发布 · 在 2 项基准上留有 2 条公开成绩。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。
从 355B 放大到 744B-A40B、预训练 28.5T token,集成 DeepSeek 稀疏注意力,MIT 开放权重;面向复杂系统工程与长程 agent 任务——「从 Vibe Coding 到 Agentic Engineering」。
◈ 评分卡 SCORECARD
综合分 · 相对前沿65.1
总排名#22 / 27
已测维度2 / 6
综合分 = 各已测维度「相对前沿分」的平均:每个维度取该模型最近一次公开成绩,除以该维度当前最高分(最高 = 100)。至少两个维度有成绩才入总榜,覆盖维度数标在分数旁;未测不等于不行,只是没人公开考过。
| 维度 | 基准 | 成绩 | 相对前沿 | 该维度当前最高 | 日期 |
|---|---|---|---|---|---|
| 编码 | SWE-bench Verified | 77.8% | 80.2 | Muse Spark 1.3 75.4% | 2026.02.12 |
| 前沿推理 | HLE | 30.5% | 50.1 | Claude Fable 5.1 60.9% | 2026.02.12 |
◈ 身份卡 IDENTITY
| 实验室 LAB | 智谱 · GLM |
| 谱系 FAMILY | GLM |
| 发布日 RELEASE | |
| 定位 TIER | 开源旗舰 |
| 上下文 CONTEXT | 200K |
| 价格 PRICE | — |
| 权重 WEIGHTS | 开放权重 OPEN |
| 状态 STATUS | 在役 ACTIVE |
| 信源 SOURCE | z.ai/blog/glm-5 |
| 站内档案 ARCHIVE | — |
◈ 全部公开成绩 ALL RESULTS2 条
| 基准 | 分数 | 日期 | 口径 / 备注 | 信源 |
|---|---|---|---|---|
| HLE | 30.5% | 无工具 · 官方自报 | 原文 ↗ | |
| SWE-bench Verified | 77.8% | 官方自报 · OpenHands 口径(Thinking) | 原文 ↗ |