8 月 27 日晚间版

今日要闻

GLM-5.3 官方按内存分档部署:满血版需 512GB,256GB 用 GLM-5.3-Flash

GLM-5.3 官方按内存分档部署:满血版需 512GB,256GB 用 GLM-5.3-Flash

Protonnd: 满血版面向 4xDGX Spark 或 512GB 内存的 Mac,再低的配置直接用更小的 Qwen 型号𝕏

MdeZwart 解读: 批评智谱借发布公开披露 269 个开源项目的 2436 个漏洞做营销,却无视自家平台 P1 漏洞的研究者报告𝕏

GLM-5.3-Flash 规格公布:成本为 GLM-5.3 十分之一,320B MoE 激活 18B、1M 上下文

GLM-5.3-Flash 规格公布:成本为 GLM-5.3 十分之一,320B MoE 激活 18B、1M 上下文

sailabshq 实测: 已上线其免费 Arena,并观察到 DeepSeek-V4-Pro 不适合做 AI 评审𝕏

InsomniaLK 转述: 本地运行教程已出,配套 DeepSWE 被拿来对标 Claude Opus 4.8𝕏

filicroval 转述: 单次迭代让它用 three.js 从零构建《匹诺曹的谎言》标题画面的金色时钟机制,自评不完美𝕏

Qwen3.8-4B-Distill 实测上 RTX 5060 Ti:8K 约 73 tok/s、峰值显存约 5GB

Qwen3.8-4B-Distill 实测上 RTX 5060 Ti:8K 约 73 tok/s、峰值显存约 5GB

murasametech 实测: 16K 设置下输入 1.2 万 token 长文仍维持约 71.6 tok/s𝕏

yamuradotdev 解读: 认为 27B 能在 8GB VRAM 上跑就算端侧,以此回应 DGX Spark 五千美元定价的质疑𝕏

TonySh1ps 转述: 27B 本地运行需 RTX 3090 以上 32GB 显存或 DGX Spark,任务默认设备端执行,上云需用户授权𝕏

Nous Portal 支持多模型混合,被推荐为编码 harness 替代 Claude 订阅

Nous Portal 支持多模型混合,被推荐为编码 harness 替代 Claude 订阅

Prime Intellect: Prime Agent 内置三项机制支持长时程评测,可设定目标、时间与令牌预算𝕏

teortaxes 解读: 认为 DSH 论文《时空可组合的编程范式》只是早期探索,短期不太可能有后续𝕏

Martin Casado 解读: 他用过的 harness 都会随时间腐坏出 bug、云托管不稳,只有 Grok bot 一直能用𝕏

HOURAHEAD关于 · 往期 · 2026-08-27 15:13