9 月 24 日DeepSeek V4.1 Flash

已见于 9 月 11 日午间

先看结论

DeepSeek V4.1-Flash 登陆 Artificial Analysis 对比页,AutomationBench 第一与 CritPt 回退遭质疑

Ollama 云正分批推送该模型:Max 和 Team 账户先行,Pro 订阅用户随后开放,官方称正加紧扩容覆盖全部订阅者

这些标记是什么意思

疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话

当前状态进行中 · 转述
还没解决的开源与闭源前沿的差距在扩大还是收敛?开源的护城河是权重本身还是生态?下一波开源标杆会从哪家出来?

模型

DeepSeek V4.1 Flash

换档前先在 AA 对比页核对 AutomationBench 与 CritPt 两项,用到子代理编排的场景先小样自测再改默认档

原生视觉理解,主打更聪明、更快、更省

Ollama 云正分批推送该模型:Max 和 Team 账户先行,Pro 订阅用户随后开放,官方称正加紧扩容覆盖全部订阅者

看什么现在的情况依据
独立榜Artificial Analysis 对比页已上线但未给出综合分;独立研究者指出 AutomationBench 单项第一异常、CritPt 退回 V4-Pro-Preview 水平
性价比
便宜档无法比较官方口径为新架构家族最小型号、推理更快吞吐更高,第三方实测未到
任务成本无法比较独立研究者实测其子代理在缺乏模块化的项目里把任务做砸,提醒暂勿用于此类项目
可靠性无法比较独立研究者称其 CritPt 表现退回 V4-Pro-Preview 水平,并质疑 AutomationBench 单项第一
中文
写仓库
办公活
攻防

各方3 人

Ollama正按 Max、Team、Pro 的顺序分批推送,称在快速增加容量𝕏

Artificial Analysis实测已上线 V4.1 Flash 与其他模型的完整对比结果页,可逐项对照𝕏

Teortaxes实测提醒不要在缺乏清晰模块化的项目里使用 V4.1 的子代理团队,称审计结果严厉、本不难的任务被做砸𝕏

产业解读

关键数字无新综合分;相对位置为 AutomationBench 单项第一、CritPt 退回 V4-Pro-Preview 水平
时间点发布当日:AA 对比页约 8 小时前上线,Ollama 约 2 小时前开始推送
谁会受影响把 V4 Pro 当默认档的开发者账单,以及 Ollama 各档订阅用户的可用模型清单

这不是投资建议。

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 11:15