9 月 24 日Teortaxes:DeepSeek 论文给出 Agent Swarm RL 初步配方,V4.1 团队 ProgramBench 达 30%,官方 20.3% 非上限

已见于 9 月 10 日晚间

先看结论

Teortaxes:DeepSeek 论文给出 Agent Swarm RL 初步配方,V4.1 团队 ProgramBench 达 30%,官方 20.3% 非上限

其称该成绩约为 Kimi K3 的两倍

这些标记是什么意思

疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话

当前状态已结束 · 转述

观点

Teortaxes:DeepSeek 论文给出 Agent Swarm RL 初步配方,V4.1 团队 ProgramBench 达 30%,官方 20.3% 非上限

看什么现在的情况依据
谁说的Teortaxes
判断其称该成绩约为 Kimi K3 的两倍
其他信源无 · 本人原话
官方尚未表态

产业解读

关键数字ProgramBench:V4.1 团队 30% 对官方 20.3%,约为 Kimi K3 两倍
时间点论文随 V4.1-Flash 发布释出,判断在发布后数小时内作出
谁会受影响跟踪 agent 训练方法与多智能体 RL 配方的研究团队

这不是投资建议。

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 13:39