新当事方Ollama 云开始向 Max 和 Team 账户推送 DeepSeek-V4.1-Flash𝕏
Ollama9 月 24 日Teortaxes:V4.1 Flash 是过度思考者,50 秒内修完并验证错误后仍纠结视觉测试
Teortaxes:V4.1 Flash 是过度思考者,50 秒内修完并验证错误后仍纠结视觉测试
转述报告称经果蝇连接组优化的 V4.1 Flash 在 2 台 NVIDIA GB300 DGX Station 上达 56k tok/s prefill、201.7 tok/s 单并发 decode
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
供给
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 事实 | 转述报告称经果蝇连接组优化的 V4.1 Flash 在 2 台 NVIDIA GB300 DGX Station 上达 56k tok/s prefill、201.7 tok/s 单并发 decode | |
| 官方 | 尚未表态 |
产业解读
这不是投资建议。
更早
新当事方Ollama 云开始向 Max 和 Team 账户推送 DeepSeek-V4.1-Flash𝕏
Ollama改口Teortaxes 称 DeepSeek 承认 V4-Pro 预训练失误,V4.1-Flash 将于 9 月 10 日发布𝕏
Teortaxes更早
SemiAnalysis 指出 AMD 在 DeepSeek V4.1 Flash 发布 23 小时后仍未公开 vllm-openai-rocm:deepseekv41-flash-0909 镜像𝕏
SemiAnalysisSemiAnalysis:DeepSeek v4.1 Flash 首发日 NVIDIA vLLM 在 H100/H200/B200/B300/GB200/GB300 六款 SKU 上开箱即用,AMD vLLM 仍不支持𝕏
SemiAnalysisTeortaxes 称 DeepSeek V4.1 Flash 是 overthinker,50 秒内修完并验证错误后仍纠结视觉测试𝕏
TeortaxesTeortaxes 转述果蝇连接组优化 DeepSeek-V4.1-Flash 在 2× NVIDIA GB300 DGX Station 上达 56k tok/s prefill、201.7 tok/s c1 decode𝕏
TeortaxesDeepSeek V4.1 Flash 发布一天后,NVIDIA-NeMo 出现巨型 PR 加入完整训练与微调支持,含 Causal Encoder/Decoder、CSA2、mHC、Engram、MoE、视觉输入与 Checkpoint𝕏
Max For AIOllama 云上线 DeepSeek-V4.1-Flash,美欧托管、零数据保留、按 token 计价与 DeepSeek API 一致𝕏
OllamaOllama 向 Pro 订阅用户推送 DeepSeek-V4.1-Flash𝕏
OllamaPatrick Moorhead 称 DeepSeek-V4.1-Flash 有真正的架构进步,该模型为原生视觉理解的最小架构家族成员𝕏
Patrick MoorheadTeortaxes 称 DeepSeek V4.1 solo 在 Nacre 任务上最好最便宜,GLM 5.3 Flash 与 V4.1 Agent Teams 多花 token 且互相干扰𝕏
TeortaxesOllama 云开始向 Max 和 Team 账户推送 DeepSeek-V4.1-Flash𝕏
OllamaTeortaxes 质疑 DeepSeek V4.1 Flash 在 Artificial Analysis 上 AutomationBenchAA 第一、CritPt 退回 V4-Pro-Preview 水平𝕏
TeortaxesArtificial Analysis 上线 DeepSeek V4.1 Flash 对比结果𝕏
Artificial AnalysisArtificial Analysis 测得 DeepSeek V4.1 Flash 的 AA-Omniscience 提升 9 分至 -5.3,准确率从 40% 升至 46%,非幻觉率从 8% 降至 4%𝕏
Artificial AnalysisArtificial Analysis:DeepSeek V4.1 Flash 以 40 分超越 V4 Pro 0813 成为新旗舰,552B 参数成本约低 4 倍𝕏
Artificial AnalysisTeortaxes 称 DeepSeek v4.1 Flash 可在 128GB M5 Max 上主要靠 SSD 流式运行前沿模型𝕏
TeortaxesTeortaxes 反驳 DeepSeek 人才被挖空说法,称 V4.1 数小时内将碾压竞争对手𝕏
TeortaxesTeortaxes 称 V4.1 在 HLE 上接近 Fable,并自主下载 180 MB PDF 研究珍珠层材质𝕏
TeortaxesTeortaxes 指出某模型 TerminalBench 4.0 与 DeepSWE 分数低于 DeepSeek V4.1𝕏
TeortaxesTeortaxes 称 DeepSeek V4.1 的最佳解释是 OpenAI/Anthropic 早前小版本模型自动研究后泄露𝕏
TeortaxesTeortaxes 判断 Kimi K3 经严肃后训练后在多数评测上优于 V4.1,且 token 效率更高𝕏
TeortaxesTeortaxes 称 DeepSeek V4.1 Flash 与 Kimi K3、GLM-5.3 Flash 建模风格差异巨大,疑似训练数据路径完全不同𝕏
TeortaxesTeortaxes:DeepSeek V4.1 设计令团队满意,V5 可能类似 V2 到 V3 的跃迁𝕏
TeortaxesTeortaxes:DeepSeek 论文给出 Agent Swarm RL 初步配方,V4.1 团队在 ProgramBench 达 30%,官方 20.3% 非上限,约为 Kimi K3 两倍𝕏
TeortaxesSemiAnalysis 转述 DeepSeek-V4.1-Flash 发布:552B 骨干、prefill 激活 8B、decode 激活 16B、196B Engram 稀疏查表、持久 KV 比 V4-Flash 少约 8 倍𝕏
SemiAnalysisTeortaxes 称 DeepSeek V4.1 是首个游戏型模型,对做出真正好玩的东西有异常兴趣𝕏
TeortaxesTeortaxes 判断 DeepSeek 已进入数据驱动 RSI 第一阶段,V4.1 Flash 集群正合成下一代模型数据𝕏
TeortaxesTeortaxes 称 DeepSeek V4.1 无法通过 cuckold joke 测试𝕏
TeortaxesTeortaxes 预测 V4.1-Flash 在新 AA 指数上为 36-38,若达 42-45 则 AA 需重做𝕏
TeortaxesDeepSeek 正式发布 DeepSeek V4.1 Flash,552B 参数 MoE 架构并具备原生多模态视觉理解𝕏
科技新报Teortaxes 推测 DeepSeek V4.1 Pro 为 3.1T 总参数 30/60B 激活 MoE 加 1.1T Engram,磁盘占用 2.6TB𝕏
TeortaxesTeortaxes 指出 V4.1 Flash 实为约 718B 模型,与 GLM 5.3 体量相当但更稀疏𝕏
TeortaxesTeortaxes 判断 DeepSeek V4.1 是首个以 .1 版本号标注的全新基座模型,与 V4 差异大于 LLaMA 1 到 LLaMA 3,但未到 V5 程度𝕏
TeortaxesAravind Srinivas 转发 DeepSeek-V4.1-Flash 发布,该模型为架构家族最小型号并原生支持视觉理解𝕏
Aravind SrinivasDeepSeek V4.1 Flash 上架 Hugging Face,552B MoE 采用新 Encoder-Decoder 结构并原生支持视觉理解𝕏
TestingCatalogDeepSeek 发布 DeepSeek-V4.1-Flash,原生视觉理解、推理更快吞吐更高𝕏
DeepSeek关注后可跟此人更新与他说过的话,需用手机号登录