8 月 26 日晚间版
今日要闻
Dario Amodei:多数任务上有意义的比较不是模型对最强人类,而是对原本做该任务的人类
Gavin Baker 分析: 他称 Jalapeño 是 TPU/Trainium 之外第一个像样的 ASIC,但可能明显逊于 GPU/Trainium 加 SRAM 加速器的解耦方案𝕏
他认为首秀虽令人印象深刻,但现阶段只能算首秀,结论要等下一代对手上市后再下𝕏
JustAnAlgorithm 转述: 这是 Dario 在回应 WSJ 相关讨论时给出的比较标准𝕏
OpenAI Jalapeño 第三方实测每千瓦 12258 token,为 GB300 的 104 倍
ByteBandiit 实测: 同样推到单用户最快速度时,GB300 在 DeepSeek R1 上每千瓦只能跑出 118 token𝕏
SemiAnalysis 实测: 未启用投机解码就已超越 Rubin NVL72,且整个 Pareto 前沿优于 7 月 Rubin𝕏
AlphawalkAi 转述: 其日报判断 Jalapeño 赢了基准,但还不是英伟达杀手𝕏
SemiAnalysis InferenceX 实测:峰值每千瓦混合 TPS 高 1.5–1.9 倍,端到端延迟低 1.7–3.6 倍
R_Patote 实测: 数据标注为 SemiAnalysis 现场核实(on-site verified)𝕏
InferenceX 对比 GB300:DeepSeek R1 端到端延迟 1.65 秒对 5.99 秒
aijustdidit 实测: 对照的是 700W 对 1400W 功耗的 GB300 配置𝕏
DeepSeek Harness 发布
Elvis Saravia 分析: 他指出 harness 决定模型看到的上下文与工具调用方式,因此智能体排行榜的横向对比难信𝕏
Harrison Chase 分析: 他认为 Deepagents 正变成多人协作 harness:同一线程多用户,带认证与记忆𝕏
Garry Tan 分析: 他主张跨 harness 记忆最大化,把自己的 gbrain 接进 Claude Code CLI、Grok 等所有在用的 harness𝕏
关注后可跟此人更新与他说过的话,需用手机号登录