Qwen3-Coder
阿里 · Qwen · Qwen 谱系 · 2025.07.22 发布 · 在 1 项基准上留有 1 条公开成绩。数字全部取自官方发布材料、第三方评测机构与站内已查证档案,评测口径(版本 / 算力档 / 脚手架)标在备注里;因训练数据污染撤榜的成绩不收录。仅作记录,不构成选型建议。
480B-A35B 的编码专用 MoE,靠 2 万个并行环境做长程 Agent RL;官方称开源模型在 agentic 编码上的新 SOTA,可与 Claude Sonnet 4 比肩。国产开源第一次把 SWE-bench Verified 推近 70。
◈ 评分卡 SCORECARD
综合分 · 相对前沿—
总排名未入榜
已测维度1 / 6
仅一个维度有公开成绩,不计综合分。综合分 = 各已测维度「相对前沿分」的平均:每个维度取该模型最近一次公开成绩,除以该维度当前最高分(最高 = 100)。至少两个维度有成绩才入总榜,覆盖维度数标在分数旁;未测不等于不行,只是没人公开考过。
| 维度 | 基准 | 成绩 | 相对前沿 | 该维度当前最高 | 日期 |
|---|---|---|---|---|---|
| 编码 | SWE-bench Verified | 69.6% | 71.8 | Muse Spark 1.3 75.4% | 2025.07.22 |
◈ 身份卡 IDENTITY
| 实验室 LAB | 阿里 · Qwen |
| 谱系 FAMILY | Qwen |
| 发布日 RELEASE | |
| 定位 TIER | 编码专用 · 开源 |
| 上下文 CONTEXT | 256K |
| 价格 PRICE | — |
| 权重 WEIGHTS | 开放权重 OPEN |
| 状态 STATUS | 在役 ACTIVE |
| 信源 SOURCE | qwenlm.github.io/blog/qwen3-coder/ |
| 站内档案 ARCHIVE | — |
◈ 全部公开成绩 ALL RESULTS1 条
| 基准 | 分数 | 日期 | 口径 / 备注 | 信源 |
|---|---|---|---|---|
| SWE-bench Verified | 69.6% | 480B-A35B-Instruct · 官方发布图表 · 无测试时扩展 | 原文 ↗ |