9 月 24 日GPU

环节

GPU

货架加速卡,算力供给的默认单元

带到 ChatGPT带走
更多

比上次:有变化 2

在跟的事 · 3 件最新说法
有变化加速卡交期是否已让位给基板与MLCC
证据范围不同(定量 / 定性)· 无法比较
白毛 Serenity9/17
云厂报GPU租金+17–21%,旧卡续约溢价20%,卡侧仍紧𝕏
有变化推理加速卡空转是卡在CPU还是KV溢出
证据范围不同(定量 / 定性)· 无法比较
无变化货架通用加速卡会被自研芯片替掉多少外卡
科技新报9/21 转述:自研芯片当道,比拼改为按自身AI工作量定制𝕏

另有 1 件未展开

有变化加速卡交期是否已让位给基板与MLCC

何时见分晓:本周零组件交期雷达
Jukan白毛 Serenity 说法不一
Jukan · 9月9日
即使再拿到GPU或内存,基板、MLCC与晶圆测试短缺时系统产出也上不去
白毛 Serenity · 9月17日
云厂报GPU租金+17–21%,旧卡续约溢价20%,卡侧仍紧

Jukan · 9月9日 Jukan:系统产出受基板、MLCC、晶圆测试等瓶颈限制,即使增加GPU或内存也无法提升𝕏

白毛 Serenity · 9月17日 白毛 Serenity 称 legacy memory 涨价幅度远超 $NBIS GPU 租赁与 Taiyo-Murata MLCC,H2 SLC NAND 预计涨 120-170%𝕏

a16z · 8月27日 a16z Anish Acharya:旧代GPU每小时价格不降反升,指向AI算力需求近乎无限𝕏

科技新报 · 9月18日 Nebius 自 10 月 1 日起上调 H100/H200/B200/B300 随需租金 17%–21%,B300 达每小时 9.50 美元𝕏

白毛 Serenity · 9月13日 白毛 Serenity 判断 Oracle 旧 GPU 续约溢价 20% 对 NBIS 至 IREN 偏正面𝕏

Ben Bajarin · 9月22日 Ben Bajarin:AI 供应链出现 PCB 供需分化,继 GPU、内存之后成新瓶颈𝕏

科技新报 · 9月23日 TrendForce 第二期供应链雷达:DRAM、eSSD、HDD、ABF 载板、MLCC 五项服务器零组件交期全超标,ABF 最长 56 周、HDD 50 周𝕏

有变化推理加速卡空转是卡在CPU还是KV溢出

何时见分晓:本季推理机柜利用率
Ben BajarinAstera Labs 说法不一
Ben Bajarin · 9月4日
推理时CPU会卡住GPU,缺口不只加速卡、还要更多CPU
Astera Labs · 9月17日
KV溢出进CPU内存时GPU空转;Leo称首token快62%、吞吐+22%

Ben Bajarin · 9月4日 Ben Bajarin:推理场景 CPU 瓶颈被低估,需更多 CPU𝕏

Astera Labs · 9月17日 Astera Labs 称 Leo X-Series + Scorpio 为 KV cache 提供独立通道,首 token 时间快 62%、每秒 token 数多 22%𝕏

Ben Bajarin · 9月16日 Ben Bajarin:Leo X-series 让 GPU 绕过 CPU 内存子系统直连更多内存,PCIe 可选性成设计变量𝕏

Ben Bajarin · 9月23日 Ben Bajarin 在 CS Atlas 发布新笔记,详述 CPU+GPU+内存+互连(scale up 域)服务大规模推理所需的工作流示例及各自对执行负载的限制𝕏

无变化货架通用加速卡会被自研芯片替掉多少外卡

何时见分晓:本季外卡替换观测
只有 科技新报 一方说法
科技新报 · 9月21日
转述:自研芯片当道,比拼改为按自身AI工作量定制

科技新报 · 9月21日 科技新报称 Hot Chips 2026 呈现自研晶片当道趋势,比拼转向按自身 AI 工作量定制专用晶片𝕏

Ben Bajarin · 9月21日 Ben Bajarin 认为需要写一篇教育性文章,讲清 scale up 域内 CPU/GPU/高端加速器的配比逻辑𝕏

我们只标出对不上的地方,不下结论。出处是中文摘要。由模型梳理后经引用校验,未逐条人工复核。

这页的完整内容订阅后可见。去订阅

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 11:13