有变化MI355X软件质量能否支撑替下货架GB300
SemiAnalysis · 9月18日 SemiAnalysis 称 AMD 未向 vLLM 提供足够稳定 QA 集群,AMD 软件质量比 CUDA 差一个数量级𝕏
AMD · 9月16日 AMD 在 MLPerf 以 512-GPU 规模实现 5.75M tokens/sec 推理新纪录𝕏
AMD · 8月28日 AMD发布ROCm 10,宣称推理性能提升3.3倍、训练提升2.4倍𝕏
SemiAnalysis · 9月12日 SemiAnalysis 指出 AMD 在 DeepSeek V4.1 Flash 发布 23 小时后仍未公开 vllm-openai-rocm:deepseekv41-flash-0909 镜像𝕏
SemiAnalysis · 9月12日 SemiAnalysis:AMD 的 DeepSeek v4.1 Flash 镜像比 H200 每美元性能差最多 14.8 倍、最高 42 倍𝕏