AI 基礎設施的重心正從峰值浮點運算能力轉向每機架的持續吞吐量。在 AAI 2026,AMD 將 Helios 定位為機架規模系統,協同優化 MI400 加速器、第六代 EPYC 主機節點、Pensando 網路及 ROCm 軟體,以最大化推論與代理任務的吞吐量。戰略押注在於客戶會購買整機架而非零件,並且會重視開放軟體與更高的每美元令牌數,而非專有鎖定。
此刻重要的原因:部署模式正傾向於多租戶推論、檢索增強生成與具有更嚴格延遲預算及更高併發的代理流程。這對記憶體頻寬、互連拓撲與主機 CPU 排程的壓力與純 GPU 運算能力同等。透過在機架層級整合架構決策——GPU 數量、主機平衡、記憶體容量與網路結構——Helios 旨在保持加速器供應充足並在尖峰互動工作負載中維持高利用率。
AMD 也擴展了產品線:第六代 EPYC 用於密集主機運算,MI400 系列針對前沿及高精度工作,並擴充 ROCm 軟體堆疊及 ROCm.ai 以加速軟體啟用。路線圖顯示至 2030 年的年度節奏,並意圖在系統經濟性而非僅晶片上競爭。對營運者而言,立即的結論是實用的——圍繞每美元令牌數、軟體可攜性、功率密度及機架規模交付時間重新基準總擁有成本模型。


