有变化账上0.1时百万token混合价是否还在降
何时见分晓:本月混合价与指数
智谱 Z.ai 与 TestingCatalog 说法不一
智谱 Z.ai · 8月26日
GLM-5.3-Flash输入$0.15、输出$0.50/百万
TestingCatalog · 9月5日
转述:GPT-6 Astra输入$10/百万、输出$50/百万
9 月 24 日推理成本
环节
推理成本
| 关键数字 | |
|---|---|
| 推理成本GLM-5.3-Flash;AA 公示官方 API 输入 0.15 / 输出 0.50 美元每百万 token,7:2:1 混合 0.10。河级口径取独立评测站混合价,不替代 zhipu_flagship_aa。上一行 note 被 shell 把美元符展开,以本行为准。 | 0.1$/百万 token2026-09-10 |
比上次:多了 2 件,有变化 1,2 件没人再提
| 在跟的事 · 3 件 | 最新说法 |
|---|---|
| 有变化账上0.1时百万token混合价是否还在降 | |
| 新增token降价是否已让agent进得了生产 | |
| 新增DeepSeek级缓存命中是否仍压着别人报价 |
Machine Learning Street Talk · 9月18日 Machine Learning Street Talk:agentic software 因 token 成本过高尚未进入生产环境𝕏
Fireworks · 9月15日 Fireworks 称帮 juicebox_work 将推理延迟降 80%、年成本从 $4M 降至 $800K𝕏
Nathan Labenz · 9月11日 Nathan Labenz 访谈 Baseten CTO Amir Haghighat,讨论 GPT-6 Astra 后大规模 agent 推理成本与利润归属𝕏
Teortaxes · 9月20日 Teortaxes:DeepSeek 推理成本优势来自已开源的缓存机制,其他厂商宣称 99% 缓存命中率实为套壳 DeepSeek𝕏
这页的完整内容订阅后可见。去订阅
关注后可跟此人更新与他说过的话,需用手机号登录