AI 算力正式跨入千卡时代。当全球最先进的 AI 工厂把数十万颗 GPU 与 CPU 汇聚到一起,网络已经从辅助管道升级为决定算力发挥的关键倍增器。
7 月 21 日,NVIDIA 宣布新一代 Spectrum-6 以太网交换系统正陆续部署到全球千卡级 AI 工厂,为这一代超大规模集群补齐网络底座。
Spectrum-6 是一颗 102.4 Tbps 的以太网交换芯片系统,容量达到上一代的两倍,并作为 NVIDIA Vera Rubin 平台的核心组成部分之一被原生设计。
为什么 AI 性能是网络问题
大规模训练与推理依赖成千上万加速器持续交换数据,集合通信会产生密集的东西向流量。
传统以太网并不擅长强同步、强集合的通信模式,Spectrum-X 以太网正是为 AI 而生,把以太网改造成能持续喂饱 GPU 的高性能扩展全网。
Spectrum-6 与 ConnectX-9 SuperNIC 协同构成下一代 Spectrum-X 以太网平台,让整座 AI 工厂像一台机器一样运转。
面向 AI 工厂的网络规划
下一代集群的竞争焦点,正在从堆 GPU 数量转向让 GPU 真正协同跑起来。
在超大规模场景下,网络拓扑、网卡选型与全栈软件调优,往往比单点硬件更能决定最终交付效率与每 Token 成本。