微软将亚特兰大与威斯康星连成首个「AI超级工厂」
两处Fairwater站点由专用AI广域网缝合,并行训练同一模型,数十万块Nvidia GB200/GB300 GPU,140kW机柜,无UPS无发电机组
加入列表
还没有列表。
摘要
Microsoft已将其在威斯康星和亚特兰大的Fairwater站点接入其所称的首个「AI超级工厂」,两处设施由一张光纤专用AI广域网连接,让多栋建筑并行训练同一模型,而非各自运行独立作业。自2025年10月上线的Atlanta Fairwater采用两层设计,承载数十万块Nvidia GB200和GB300 GPU,每机柜约140kW、每列约1,360kW,且不同寻常地没有UPS或备用发电机组。微软将这些广域网连接的集群定位为把模型训练时间「从数月缩短到数周」。此项建设属于微软2026年约1,900亿美元的资本支出计划。
数据一览
- 2,接入同一训练结构的Fairwater站点(威斯康星+亚特兰大)。
- 约140kW/约1,360kW,亚特兰大每机柜/每列的功率。
- 数十万块,全网的Nvidia GB200/GB300 GPU。
- 2025年10月,Atlanta Fairwater开始运行。
为何重要
「超级工厂」是一次结构性转变:AI训练正走向多站点化,成为约束条件的是电网与光纤,而非单栋建筑。舍弃UPS和发电机组是以传统可靠性换取密度与速度,一套他人将会效仿的范式。
观察要点
- 是否有更多Fairwater站点接入广域网结构,以及选址何处(以电力为导向)。
- 无UPS/无发电机组设计在真实负载下的可靠性结果。
- 各Fairwater园区的本地电网与用水许可。