8 月 25 日晚间版

今日要闻

Grok 4.6 在 Artificial Analysis 指数获 61 分,与 GPT-5.6 Sol 并列前沿

Grok 4.6 在 Artificial Analysis 指数获 61 分,与 GPT-5.6 Sol 并列前沿

Elon Musk: 他引用一名前苹果工程师的测试:在 Cursor 里给 Grok 4.6 布置两项任务后去睡觉,次日早上直播查看结果,全程无需照看𝕏

他建议通过 Grok Build harness 或 Cursor 应用使用 Grok 4.6,称这样才能发挥最大效用𝕏

DeepSeek 上线 V4-Flash-Vision-Exp:支持图像输入、1M 上下文,API 输入 $0.22/M

DeepSeek 上线 V4-Flash-Vision-Exp:支持图像输入、1M 上下文,API 输入 $0.22/M

KinoshitaTsks 实测: 他提醒选型重点已不是「能不能看图」:单请求最多 600 张图、图像按 token 计费,峰时输入价 $0.44 是谷时的两倍,PoC 还要核算总成本、API 兼容与机密图像处理𝕏

WhinyPuppy98 实测: 文本侧的 Agent、推理、世界知识与 V4-Flash 持平,新增视觉后在多模态智能体基准上接近 Claude Opus 4.8𝕏

teortaxes 解读: 据他转述,梁文锋明确表示先解决持续学习等 AGI 相关难题、暂不做具身智能,但多模态会先行𝕏

Nvidia Rubin Ultra 疑似配备 192GB HBM4,较最初预览 1TB 大幅下调

Nvidia Rubin Ultra 疑似配备 192GB HBM4,较最初预览 1TB 大幅下调

SemiAnalysis 分析: 这一容量甚至低于标准版 Rubin 的 288GB𝕏

P Equity Research 解读: 他认为 AMD MI555X 将以 432-576GB HBM 碾压 192GB 的 Rubin Ultra,并称 AMD 自己同样可能下调规格𝕏

elainenc2005 转述: 后续可能推出 8-hi HBM4E 的升级版本𝕏

Gavin Baker:前沿实验室的 token 比开源 token 算力消耗更低、智能密度更高

Gavin Baker:前沿实验室的 token 比开源 token 算力消耗更低、智能密度更高

Gavin Baker 解读: 他承认这种说法违反直觉,但坚持前沿实验室的智能密度确定更高𝕏

被问记忆架构与短期业务如何取舍时,他回应两者处于不同时间框架,且会相互强化𝕏

Gary Marcus 解读: 他转引 Sam Altman「即便实现超级智能世界也不会大变」的说法,讽其急于找一条卖得动的叙事,并认为人们不会主动逐步交出控制权𝕏

SK海力士HBM3E 16层产品量产,NVIDIA Rubin供应启动

SK海力士HBM3E 16层产品量产,NVIDIA Rubin供应启动

Dan Nystedt 转述: 媒体将这笔订单称为 Intel 先进封装业务的一次重要胜利𝕏

P Equity Research 转述: SK 海力士前一天已在 Hot Chips 的幻灯片中展示过 EMIB 封装方案𝕏

MuriloMoitinho 转述:𝕏

DeepSeekagent harness 跑同一任务成本 $2Claude Code 为 $150

DeepSeek 新 agent harness 跑同一任务成本 $2,Claude Code 为 $150

Elvis Saravia 实测: 他同场还表示喜欢 Agent Playground 的创意,认为对用 agent 做开发的工程师非常实用𝕏

他分享一篇终端代理综述,梳理 terminal agent 的定义,并解释各家 harness 的对比结果为何总是互相矛盾𝕏

Nathan Lambert 转述: 与多数被动响应式的 harness 不同,Headlong 的自引导代理能持续思考𝕏

HOURAHEAD关于 · 往期 · 2026-08-25 12:25