9 月 1 日晚间版

今日要闻

GLM-5.3 的探索-评分异常仅波及 17 项任务中的 2 项

GLM-5.3 的探索-评分异常仅波及 17 项任务中的 2 项

pallu_yadav645 实测: 实测 Hy4 preview 处理长文档、多源、编码、研究与多步指令任务,基准成绩超过 GLM 5.2、接近 GLM 5.3𝕏

infomiho 分析: 判断本地算力还没到值得投资的成熟度,DeepSeek v4 或 GLM 5.3 这类云端模型是现实选择𝕏

fifi__ssjr 分析: 把 GLM 5.3 和 Codex 搭配做 fuzzing:Codex 在网络安全任务上会卡住,两者互补,另用 Kimi 和 DeepSeek 做挑战𝕏

Gavin Baker:未来五年 AI 芯片的赢家与输家仍被市场误解,点名 NvidiaAMD、Google TPU、Amazon Trainium、Cerebras、GroqHBM 三巨头

Gavin Baker:未来五年 AI 芯片的赢家与输家仍被市场误解,点名 Nvidia、AMD、Google TPU、Amazon Trainium、Cerebras、Groq 和 HBM 三巨头

AntreevB 转述: Gavin Baker 的这场五年 AI 芯片赢家输家分析还覆盖 Intel 与初创公司,并解释市场误解具体在哪𝕏

DeepSeek Harness 技能库跨尺寸迁移实测:Qwen-27B 的技能让 Qwen-9B 的 SpreadSheet 从 24.3% 升到 50.5%

DeepSeek Harness 技能库跨尺寸迁移实测:Qwen-27B 的技能让 Qwen-9B 的 SpreadSheet 从 24.3% 升到 50.5%

G_ameman 实测: 方法贡献之一是让技能库与持久化 wiki 共同进化,实测阵容含 Qwen-3.5-4B/9B、Qwen-3.6-27B、Gemma-4-31B 与 Gemini-3.5-Flash𝕏

HOURAHEAD关于 · 往期 · 2026-09-01 12:30