9 月 24 日Teortaxes:DeepSeek V4.1 Flash 是最被评测社区忽视的模型,ARC-AGI、math-arena、WeirdML 均无数据

已见于 9 月 16 日晚间

话题 · 模型产品

先看结论

Teortaxes:DeepSeek V4.1 Flash 是最被评测社区忽视的模型,ARC-AGI、math-arena、WeirdML 均无数据

他此前称其为首个可称 proto-AGI 的开源模型,依据是近乎 100% 命中率的廉价缓存

这些标记是什么意思

疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话

最新进展Teortaxes 认为 DeepSeek V4.1 Flash 意义与评测社区关注度落差最大,缺 ARC-AGI、math-arena、WeirdML 评测
当前状态已结束 · 转述

观点

Teortaxes:DeepSeek V4.1 Flash 是最被评测社区忽视的模型,ARC-AGI、math-arena、WeirdML 均无数据

看什么现在的情况依据
谁说的Teortaxes
判断他此前称其为首个可称 proto-AGI 的开源模型,依据是近乎 100% 命中率的廉价缓存
其他信源无 · 本人原话
官方尚未表态

产业解读

关键数字本版无新数字,全部为定性判断;可对照的仍是上一版 $0.43/task 对 $6.52/task 的单任务成本。
时间点判断发于 V4.1 Flash 发布之后、ARC-AGI 等公开评测仍缺席的当下。
谁会受影响把 DeepSeek V4.1 Flash 当编码默认档的开发者与按 token 计费的 API 采购方。

这不是投资建议。

转折更早 1

更早

新当事方Fireworks 实测 DeepSWE 在 Astra 与 DeepSeek V4.1-Flash 上输入 token 为输出 174 倍,99.6% 命中缓存,成本 $0.43/task 对 $6.52𝕏

Fireworks

这件事更早 9

更早

Teortaxes 称 V4.1 Flash 是首个可称 proto-AGI 的开源模型,近乎 100% 命中的廉价缓存是关键𝕏

Teortaxes

Teortaxes 称 DeepSeek V4.1 与 Astra 属同类实体,Astra 更强更大但无本质差异𝕏

Teortaxes

Fireworks 实测 DeepSWE 在 Astra 与 DeepSeek V4.1-Flash 上输入 token 为输出 174 倍,99.6% 命中缓存,成本 $0.43/task 对 $6.52𝕏

Fireworks

Max For AI 转述 DeepSeek kernel 工程师 shengyu Liu 长文:他称正把 kernel 优化这门手艺做成过时工作,其参与 DeepSeek V4.1 Main Attention kernel𝕏

Max For AI

Teortaxes 转述 Astra-xhigh 译文:DeepSeek v4.1 发布,再次抬高小模型能力上限𝕏

Teortaxes
每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 13:39