9 月 24 日DeepSeek V4.1 Flash
DeepSeek V4.1-Flash 登陆 Artificial Analysis 对比页,AutomationBench 第一与 CritPt 回退遭质疑
Ollama 云正分批推送该模型:Max 和 Team 账户先行,Pro 订阅用户随后开放,官方称正加紧扩容覆盖全部订阅者
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
模型
换档前先在 AA 对比页核对 AutomationBench 与 CritPt 两项,用到子代理编排的场景先小样自测再改默认档
原生视觉理解,主打更聪明、更快、更省
Ollama 云正分批推送该模型:Max 和 Team 账户先行,Pro 订阅用户随后开放,官方称正加紧扩容覆盖全部订阅者
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 独立榜 | Artificial Analysis 对比页已上线但未给出综合分;独立研究者指出 AutomationBench 单项第一异常、CritPt 退回 V4-Pro-Preview 水平 | |
| 性价比 | ||
| 便宜档 | 无法比较 | 官方口径为新架构家族最小型号、推理更快吞吐更高,第三方实测未到 |
| 任务成本 | 无法比较 | 独立研究者实测其子代理在缺乏模块化的项目里把任务做砸,提醒暂勿用于此类项目 |
| 可靠性 | 无法比较 | 独立研究者称其 CritPt 表现退回 V4-Pro-Preview 水平,并质疑 AutomationBench 单项第一 |
| 中文 | ||
| 写仓库 | ||
| 办公活 | ||
| 攻防 |
Ollama正按 Max、Team、Pro 的顺序分批推送,称在快速增加容量𝕏
Artificial Analysis实测已上线 V4.1 Flash 与其他模型的完整对比结果页,可逐项对照𝕏
Teortaxes实测提醒不要在缺乏清晰模块化的项目里使用 V4.1 的子代理团队,称审计结果严厉、本不难的任务被做砸𝕏
产业解读
这不是投资建议。
关注后可跟此人更新与他说过的话,需用手机号登录