9 月 24 日智谱 GLM-5.3

已见于 9 月 2 日午间

先看结论

GLM-5.3 早期访问实测接近 Opus 5,部分场景更优

早期测试者 ivanfioravanti 用 GLM 5.3 从零编译出驱动,称效果令人惊叹

这些标记是什么意思

疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话

当前状态进行中 · 转述

模型

智谱 GLM-5.3

若现在用 GPT-5.6 Sol 当默认档,GLM-5.3 综合分与之持平、价格据转述约为其三分之一,可切档试一轮账单

GLM-5.3 开放权重发布,744B MoE 激活 40B,权重仓库约 756GB,支持 vLLM/SGLang 本地部署

早期测试者 ivanfioravanti 用 GLM 5.3 从零编译出驱动,称效果令人惊叹

看什么现在的情况依据
独立榜Artificial Analysis Intelligence Index 60 分,与 GPT-5.6 Sol 持平
性价比DeepSWE v1.1 独立评测 69%±3,约 3.99 美元/任务
便宜档无法比较价格据社区转述约为 GPT-5.6 Sol 的三分之一,但有用户反馈速度偏慢
任务成本DeepSWE v1.1 独立评测 69%±3,约 3.99 美元/任务
可靠性无法比较Together 称其幻觉率明显低于 Fable 5 和 GPT-5.6 Luna,另有独立评测者指其 WeirdML 成绩存在高估
中文智谱开发的国产模型,中文场景为原生主场
写仓库Terminal-Bench 4.0 解题率 41.8% 反超 GPT-5.6 Sol Max 的 37.3%,早期用户用其从零编译出驱动
办公活Vals Index 57.0 分,开放权重第 2、总榜第 13,法律研究基准第 1
攻防去审查衍生版被指可执行攻击性网络操作,已有团队用其并行审计代码库漏洞

各方3 人

Greg_GL_87实测TokenGremlin 称这是他第一次测试开放模型的早期访问版,几个点位上比他预期更接近 Opus,表现让他改观𝕏

MTSlive转述Dragonfly 的 hosseeb 称,GLM 5.3 Abliterated 通过训练消除模型的拒答行为,可能开启 AI 网络攻击的新时代𝕏

johnennis转述johnennis 质疑把「移除安全限制」直接等同于「为了发动攻击」的动机推断,认为需要更中立的说法𝕏

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 11:15