9 月 12 日午间版

今日要闻

SemiAnalysis:AMDDeepSeek V4.1 Flash 镜像每美元性能比 H200 差 14.8 至 42 倍

SemiAnalysis:AMD 的 DeepSeek V4.1 Flash 镜像每美元性能比 H200 差 14.8 至 42 倍

SemiAnalysis 实测: CUDA vLLM 两天前已支持 V4.1 Flash,AMD 的镜像才刚公开,功能上开箱即用𝕏

Teortaxes 实测: V4.1 Flash 在 kernel engineering 上大幅进步,GLM-5.3 Flash 远不及𝕏

Codex 下 V4.1 在 Terminal-Bench-Science 得 11/70,物理科学方向明显强于 Luna 与 Terra,Terminus 2 可能更拖累它𝕏

Sakana AI 公布 Fugu Max 与 Fugu Ultra v2 发布说明,编排引擎按任务路由开源权重与专用模型

Sakana AI 公布 Fugu Max 与 Fugu Ultra v2 发布说明,编排引擎按任务路由开源权重与专用模型

Sakana AI: Fugu Max 已在 OpenRouter 上线,多智能体编排引擎把任务路由到开源权重和专用模型,定价 $2/$6 每 1M tokens𝕏

Elvis Saravia 解读: 他极度看好集体智能的 Pareto 前沿,认为在单模型前沿曲线之上正长出一个复合系统层𝕏

Artificial Analysis:Devin Fusion CLI 搭配 Claude Fable 5.1(xhigh)加 SWE-2(medium)在 Coding Agent Index 得 61.7

Artificial Analysis:Devin Fusion CLI 搭配 Claude Fable 5.1(xhigh)加 SWE-2(medium)在 Coding Agent Index 得 61.7

Artificial Analysis 实测: 两套配置都落在 Coding Agent Index 分数对单任务成本的 Pareto 前沿上𝕏

Teortaxes 实测: V4.1 在 JS 上达 81.8%,TypeScript 上与 Fable 5.1、Muse Spark 1.3 并列 60%,他判断 TS 分数已经饱和𝕏

Jerry Liu 解读: 他判断 Astra 与 Fable 5.1 的输出要么太冗长、要么堆砌信息密度,瓶颈在读者自己消化信息的能力𝕏

华为 7.2Tbps NPO 方案目标 2027 上半年规模商用

华为 7.2Tbps NPO 方案目标 2027 上半年规模商用

TrendForce 转述: 原帖称该方案面向 CPO/NPO 光互联路线,华为着眼未来两年推动更广泛采用𝕏

Teortaxes 转述: 原帖称 CXMT 到 2028 年下半年新开 4 座晶圆厂,Teortaxes 提示该消息源一向带乐观解读𝕏

Teortaxes:V4.1 Flash 是过度思考者,50 秒内修完并验证错误后仍纠结视觉测试

Teortaxes:V4.1 Flash 是过度思考者,50 秒内修完并验证错误后仍纠结视觉测试

Teortaxes 实测: 训练区间为 1-100,他怀疑 1 档精度低、但可能存在不过度思考的甜点𝕏

原帖称同样用 V4.1 Flash 只换 DSH 新版:多轮对话中途改 System Prompt 不再导致 cache 失效,总 Token 多 2.4%、费用少 36.6%𝕏

HOURAHEAD关于 · 往期 · 2026-09-12 04:27