9 月 24 日智谱 GLM-5.3-Flash
GLM-5.3-Flash 3-bit 量化权重约 156GB,128GB Mac Studio 跑不动
官方 100M 免费 token 已到账,实测用户反映模型可用但速度很慢
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
模型
本地部署按 166GB 级内存门槛备机,走 API 且在意服务成本的团队可把它列入默认档候选
GLM-5.3-Flash 发布:MIT 许可,320B 总参 / 18B 激活 MoE,原生多模态、1M 上下文,输入 15c、输出 50c 每百万 token
官方 100M 免费 token 已到账,实测用户反映模型可用但速度很慢
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 独立榜 | Artificial Analysis 智能指数 57 | |
| 性价比 | Agent Arena 每任务 $0.12,站上 Pareto 前沿 | |
| 便宜档 | 强 | 输入 15c、输出 50c 每百万 token,Agent Arena 每任务 $0.12 |
| 任务成本 | 强 | Together 级联实测 $1.70/任务、80.9% 准确率,比 GLM-5.3 便宜 17 倍 |
| 可靠性 | 无法比较 | DeepSWE 初报 80 终值 63,噪声偏大;多名用户反映速度慢 |
| 中文 | 强 | 智谱 GLM 系列,中文社区大规模实测与讨论 |
| 写仓库 | 强 | 用户实测连续运行 9 至 64 小时改进应用,并自主 12 小时搭出 Blender 演示 |
| 办公活 | 强 | GDPval-AA v2 得分 1770,与 GLM-5.3 (max) 的 1766 持平 |
| 攻防 |
关注后可跟此人更新与他说过的话,需用手机号登录