8 月 26 日晚间版

今日要闻

Dario Amodei:多数任务上有意义的比较不是模型对最强人类,而是对原本做该任务的人类

Dario Amodei:多数任务上有意义的比较不是模型对最强人类,而是对原本做该任务的人类

Gavin Baker 分析: 他称 Jalapeño 是 TPU/Trainium 之外第一个像样的 ASIC,但可能明显逊于 GPU/Trainium 加 SRAM 加速器的解耦方案𝕏

他认为首秀虽令人印象深刻,但现阶段只能算首秀,结论要等下一代对手上市后再下𝕏

JustAnAlgorithm 转述: 这是 Dario 在回应 WSJ 相关讨论时给出的比较标准𝕏

OpenAI Jalapeño 第三方实测每千瓦 12258 token,为 GB300 的 104 倍

OpenAI Jalapeño 第三方实测每千瓦 12258 token,为 GB300 的 104 倍

ByteBandiit 实测: 同样推到单用户最快速度时,GB300 在 DeepSeek R1 上每千瓦只能跑出 118 token𝕏

SemiAnalysis 实测: 未启用投机解码就已超越 Rubin NVL72,且整个 Pareto 前沿优于 7 月 Rubin𝕏

AlphawalkAi 转述: 其日报判断 Jalapeño 赢了基准,但还不是英伟达杀手𝕏

DeepSeek V4 Flash Vision Exp 在 OpenRouter 半价上线

DeepSeek V4 Flash Vision Exp 在 OpenRouter 半价上线

KinoshitaTsks 实测: cache miss 输入低谷 $0.22/M、高峰 $0.44/M,他建议 PoC 阶段连同输入上限与机密图片处理一起测𝕏

teortaxes 分析: 他同时指出该演示的其余部分是无法与内核交互的混乱内容𝕏

MonRivalAlert 转述: 同批 OpenRouter 下架 Fusion、GLM 5.2 与 Kimi K2.7 Code,新增 4 款 Recraft V4𝕏

SemiAnalysis InferenceX 实测:峰值每千瓦混合 TPS 高 1.5–1.9 倍,端到端延迟低 1.7–3.6 倍

SemiAnalysis InferenceX 实测:峰值每千瓦混合 TPS 高 1.5–1.9 倍,端到端延迟低 1.7–3.6 倍

R_Patote 实测: 数据标注为 SemiAnalysis 现场核实(on-site verified)𝕏

InferenceX 对比 GB300DeepSeek R1 端到端延迟 1.65 秒对 5.99 秒

InferenceX 对比 GB300:DeepSeek R1 端到端延迟 1.65 秒对 5.99 秒

aijustdidit 实测: 对照的是 700W 对 1400W 功耗的 GB300 配置𝕏

DeepSeek Harness 发布

DeepSeek Harness 发布

Elvis Saravia 分析: 他指出 harness 决定模型看到的上下文与工具调用方式,因此智能体排行榜的横向对比难信𝕏

Harrison Chase 分析: 他认为 Deepagents 正变成多人协作 harness:同一线程多用户,带认证与记忆𝕏

Garry Tan 分析: 他主张跨 harness 记忆最大化,把自己的 gbrain 接进 Claude Code CLI、Grok 等所有在用的 harness𝕏

HOURAHEAD关于 · 往期 · 2026-08-26 12:21