SpaceX重整AI数据中心建设:补强供电和冷却冗余 扩张速度或放缓

📅 2026-09-10

摘要:

SpaceX正在调整旗下AI数据中心的建设方式,将供电、冷却系统的可靠性和投运前测试置于更优先位置。新方案可能延长数据中心的建设周期,反映公司在xAI并入后开始修正此前以速度和算力为核心的扩张模式。


从快速投运转向可靠性建设

SpaceX计划在数据中心启用前完成更多备用供电和冷却系统,并进行更全面的测试,同时减少临时电源及制冷设备的使用。部分既有设施也可能重新设计。

这一调整与xAI建设孟菲斯Colossus数据中心时的模式存在差异。该项目曾在122天内安装并启用10万枚GPU。为压缩工期,施工团队同步推进冷却管道、电力和网络工程,数据中心在部分备用系统完工前便已运行,并长期使用燃气轮机等临时电源。

快速建设带来了运行风险。早期频繁断电曾迫使AI研究人员暂停项目,并损失部分模型训练进度。9月3日,施工活动影响孟菲斯一处数据中心的电力线路,导致部分Grok模型离线,并波及部分外部算力客户。马斯克随后表示,公司正在采取纠正措施,防止类似事件再次发生。

火箭工程师接管,原数据中心团队多人离职

此次策略转变发生在管理层改组之后。SpaceX今年2月完成对xAI的收购,6月底开始由火箭制造和运营团队接管数据中心业务。拥有七年以上SpaceX经历、曾负责猎鹰火箭和龙飞船生产的Wesley Salandro,接替Dan Rowland领导相关团队。

SpaceX还从火箭及星链部门招募人员轮岗支援。在超过1300名志愿者中,已有300多名工程师于过去一个月加入数据中心项目。与此同时,项目近期有十多名负责人离职,涉及基础设施、安全、采购和财务等部门。

新管理层增加了中层管理岗位,并收紧现场人员采购设备和变更施工方案的权限。这些措施可能降低建设速度,但有助于统一设备规格、控制成本并减少单点故障。随着SpaceX开始向Anthropic和Google等外部客户出租计算能力,数据中心停机造成的影响已超出Grok自身业务,可靠性的重要性随之上升。

关联标签

相似文章

评论

0/500
验证码(点击图片刷新)
暂无评论