9 月 24 日智谱 GLM-5.3
GLM-5.3 早期访问实测接近 Opus 5,部分场景更优
早期测试者 ivanfioravanti 用 GLM 5.3 从零编译出驱动,称效果令人惊叹
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
模型
若现在用 GPT-5.6 Sol 当默认档,GLM-5.3 综合分与之持平、价格据转述约为其三分之一,可切档试一轮账单
GLM-5.3 开放权重发布,744B MoE 激活 40B,权重仓库约 756GB,支持 vLLM/SGLang 本地部署
早期测试者 ivanfioravanti 用 GLM 5.3 从零编译出驱动,称效果令人惊叹
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 独立榜 | Artificial Analysis Intelligence Index 60 分,与 GPT-5.6 Sol 持平 | |
| 性价比 | DeepSWE v1.1 独立评测 69%±3,约 3.99 美元/任务 | |
| 便宜档 | 无法比较 | 价格据社区转述约为 GPT-5.6 Sol 的三分之一,但有用户反馈速度偏慢 |
| 任务成本 | 强 | DeepSWE v1.1 独立评测 69%±3,约 3.99 美元/任务 |
| 可靠性 | 无法比较 | Together 称其幻觉率明显低于 Fable 5 和 GPT-5.6 Luna,另有独立评测者指其 WeirdML 成绩存在高估 |
| 中文 | 强 | 智谱开发的国产模型,中文场景为原生主场 |
| 写仓库 | 强 | Terminal-Bench 4.0 解题率 41.8% 反超 GPT-5.6 Sol Max 的 37.3%,早期用户用其从零编译出驱动 |
| 办公活 | 强 | Vals Index 57.0 分,开放权重第 2、总榜第 13,法律研究基准第 1 |
| 攻防 | 强 | 去审查衍生版被指可执行攻击性网络操作,已有团队用其并行审计代码库漏洞 |
关注后可跟此人更新与他说过的话,需用手机号登录