Meta与甲骨文引领AI工厂网络升级,采用英伟达Spectrum交换机
在人工智能大规模模型训练与推理需求爆发的当下,底层网络基础设施正成为决定AI工厂效率的关键瓶颈。Meta与甲骨文宣布在其新一代AI数据中心网络中采用英伟达Spectrum系列以太网交换机,以实现更高带宽、更低延迟和更优的能效比,此举标志着AI工厂网络正式进入新一轮升级周期。
传统数据中心网络多基于通用以太网架构,但在AI训练场景中,GPU集群之间需要频繁同步梯度参数、交换海量中间数据,对网络的无丢包、低时延和动态负载均衡提出了极端要求。Meta与甲骨文此次选择的英伟达Spectrum交换机,支持400G/800G高速端口,并集成了NVIDIA Spectrum-X以太网平台的关键特性,包括自适应路由、拥塞控制以及基于遥测的实时性能调优,能够有效将AI训练任务的通信时间缩短数十个百分点。
Meta方面表示,其 upcoming AI工厂将大规模部署基于Spectrum的以太网方案,并配合英伟达BlueField DPU和DOCA软件框架,形成从网卡到交换机的端到端可编程网络。这一架构不仅服务于Meta自身的Llama系列大模型训练,也为未来多租户AI云服务提供基础。甲骨文则计划在其云基础设施(OCI)中引入Spectrum交换机,用于构建面向企业客户的超大规模GPU集群,以支撑生成式AI、科学计算等密集型工作负载。分析认为,两家巨头的选择表明,以太网凭借其开放生态和持续演进,正逐渐缩小与InfiniBand在AI网络中的性能差距,而英伟达通过收购Mellanox后整合的Spectrum产品线,正在从单一GPU供应商成长为AI工厂全栈方案的核心玩家。
这一升级潮也反映出AI工厂“网络定义性能”的趋势——当算力芯片制程红利放缓,通过网络卸载、在网计算和光电共封装等技术优化分布式训练效率,成为更务实的路径。随着Meta、甲骨文等头部厂商的规模化落地,预计2025年将有更多AI数据中心跟进部署800G以太网,进而带动光模块、高速线缆和下一代交换芯片的产业链变革。对于英伟达而言,Spectrum交换机的加速渗透不仅巩固了其在AI基础设施中的地位,也不可避免地与博通、思科等传统网络厂商展开正面竞争。AI工厂的网络战场,才刚刚拉开帷幕。
如若转载,请注明出处:http://www.shangdeng8.com/product/46.html
更新时间:2026-10-03 04:34:44