AI 基础设施的重心正从峰值浮点运算能力转向每机架的持续吞吐量。在 AAI 2026 上,AMD 将 Helios 定位为机架级系统,协同优化 MI400 加速器、第六代 EPYC 主机节点、Pensando 网络和 ROCm 软件,以最大化推理和智能代理任务的吞吐量。战略赌注是客户将购买整机架而非单个部件,并且更看重开放软件和更高的每美元令牌数,而非专有锁定。
为何此刻尤为重要:部署模式正倾向于多租户推理、检索增强生成和具有更严格延迟预算及更高并发的智能代理流水线。这对内存带宽、互连拓扑和主机 CPU 调度的压力与 GPU 原始计算能力同等重要。通过在机架级别整合架构决策——GPU 数量、主机平衡、内存容量和网络结构——Helios 旨在保持加速器供给充足,并在峰值交互式工作负载中保持高利用率。
AMD 还推动了广度:第六代 EPYC 用于密集主机计算,MI400 系列针对前沿和高精度任务,以及扩展的 ROCm 软件栈和 ROCm.ai 加速软件使能。路线图显示至 2030 年的年度节奏,并意图在系统经济性而非仅芯片上竞争。对运营者而言,直接结论是务实的——围绕每美元令牌数、软件可移植性、功率密度和机架级交付周期重新基准总拥有成本模型。


