新当事方Fireworks 实测 DeepSWE 在 Astra 与 DeepSeek V4.1-Flash 上输入 token 为输出 174 倍,99.6% 命中缓存,成本 $0.43/task 对 $6.52𝕏
Fireworks9 月 24 日Teortaxes:DeepSeek V4.1 Flash 是最被评测社区忽视的模型,ARC-AGI、math-arena、WeirdML 均无数据
Teortaxes:DeepSeek V4.1 Flash 是最被评测社区忽视的模型,ARC-AGI、math-arena、WeirdML 均无数据
他此前称其为首个可称 proto-AGI 的开源模型,依据是近乎 100% 命中率的廉价缓存
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
观点
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 谁说的 | Teortaxes | |
| 判断 | 他此前称其为首个可称 proto-AGI 的开源模型,依据是近乎 100% 命中率的廉价缓存 | |
| 其他信源 | 无 · 本人原话 | |
| 官方 | 尚未表态 |
产业解读
这不是投资建议。
更早
新当事方Fireworks 实测 DeepSWE 在 Astra 与 DeepSeek V4.1-Flash 上输入 token 为输出 174 倍,99.6% 命中缓存,成本 $0.43/task 对 $6.52𝕏
Fireworks更早
Teortaxes 称 V4.1 Flash 是首个可称 proto-AGI 的开源模型,近乎 100% 命中的廉价缓存是关键𝕏
TeortaxesTeortaxes 称 DeepSeek V4.1 与 Astra 属同类实体,Astra 更强更大但无本质差异𝕏
TeortaxesTeortaxes 称 DeepSeek V4.1 Flash 与 Astra 属同类实体,Astra 更强更大更明智但不多一分魔力𝕏
TeortaxesTeortaxes 称 V4.1 Flash 的原始设计将走向俗套但有趣𝕏
TeortaxesFireworks 实测 DeepSWE 在 Astra 与 DeepSeek V4.1-Flash 上输入 token 为输出 174 倍,99.6% 命中缓存,成本 $0.43/task 对 $6.52𝕏
FireworksTeortaxes 认为 DeepSeek V4.1 Flash 在 agentic coding 与 Catan 表现介于 GPT 5.6 Terra 和 Sol 之间且成本远低于 Terra𝕏
TeortaxesMax For AI 转述 DeepSeek kernel 工程师 shengyu Liu 长文:他称正把 kernel 优化这门手艺做成过时工作,其参与 DeepSeek V4.1 Main Attention kernel𝕏
Max For AITeortaxes 称 DeepSeek-V4.1-Flash (Max) 表现接近真实,与 GLM 5.3 Flash 不在同一档且比 5.3 Flash 更便宜𝕏
TeortaxesTeortaxes 转述 Astra-xhigh 译文:DeepSeek v4.1 发布,再次抬高小模型能力上限𝕏
Teortaxes关注后可跟此人更新与他说过的话,需用手机号登录