对昇腾而言,这是首次把训练与推理路线正式拆开来卖:960DT 保留了 9.6TB/s 的高访存带宽,对应训练阶段大批量梯度同步的刚需。960PR 反而把 FP4 算力堆到 8 PFLOPS(4 倍于前代),访存带宽却砍到只有 2.4TB/s。这是典型的"推理侧压显存带宽、堆低精度算力"打法。这种分型号取舍,很可能是国产 HBM 产能仍偏紧张这个现实约束下的产物,与其让一颗芯片同时兼顾两种负载、两头受限,不如拆成两款各自优化。
原本外界预期昇腾走的是"一年一代"的稳健节奏,这次却在 2027 年一年内塞进两颗型号,960DT(Q1)和 960PR(Q3),间隔只有两个季度。这种"同代拆两款"的打法在数据中心芯片里不算新鲜(英伟达也长期区分训练卡和推理卡)。
不过,所有芯片厂商路线图都……怎么说呢?还是要等流片、量产数据说话。








