ニュース本文
馬斯克的人工智慧(AI)算力布局持續擴張。馬斯克近日在X平台公布,SpaceX( SPCX-US ) 旗下AI事業SpaceXAI今年內將新增66萬顆輝達( NVDA-US ) GB300 GPU,使GPU總持有量逼近144萬顆,甚至超過其兩年前提出的「百萬GPU」目標。
根據馬斯克公布的數據,SpaceXAI目前旗下Colossus 1配備15萬顆H100、5萬顆H200及3萬顆GB200;Colossus 2則配置11萬顆GB200及44萬顆GB300。
馬斯克表示,另有22萬顆GB300將於下周全面投入運作,另外22萬顆預計11月上線,若進度順利,12月底前還將再增加22萬顆GB300。
屆時,SpaceXAI的GB300總數將達110萬顆,GPU總持有量則達144萬顆。
Colossus 2 全面採用 Blackwell 架構
隨著算力持續擴充,SpaceXAI在成立僅3年後,已建立大規模AI算力集群。相較之下,upstream成立約6年、OpenAI則成立約10年。
馬斯克透露,Colossus 1混用Hopper與Blackwell兩種架構,導致Grok模型訓練效率不佳,因此目前已出租給Anthropic執行推理任務。
至於Colossus 2則全面採用Blackwell架構,馬斯克表示,這樣的配置可避免訓練過程出現瓶頸。
不過,對SpaceXAI而言,持續取得GPU並非擴建資料中心面臨的最大限制,電力供應才是另一項關鍵問題。
SpaceXAI目前正建設一座1.2吉瓦(GW)的自有發電廠,為大規模AI算力集群提供電力。透過自建發電設施,公司可避開電網接入所需的長時間審批流程。
但這項做法也引發當地爭議。SpaceXAI因使用未取得許可的燃氣渦輪發電設備而面臨訴訟,並已承諾在一年內逐步拆除這些臨時發電設備,同時等待自有電廠完工啟用。
百萬 GPU 不是終點
大規模部署百萬顆GPU並非業界唯一案例。博通( AVGO-US ) 2024年曾透露,旗下有3家超大規模客戶計劃在2027年前達成類似規模。
但對馬斯克而言,百萬顆GPU只是更大規模擴張的起點。他表示,SpaceXAI計劃在2027年將資料中心容量擴大7倍,並設定2030年達到5000萬顆H100等效GPU的長期目標。
SpaceXAI的算力布局也不局限於地面資料中心。SpaceX另計劃發射由100萬顆衛星組成的軌道資料中心系統,不過輝達執行長黃仁勳對此表示,目前仍只是「一個夢想」。
SpaceXAI快速擴大算力規模,顯示AI基礎設施競爭已不只是GPU採購的較量。從自建發電設施、出租既有算力,到規劃軌道資料中心,馬斯克正同步擴大在能源與資料中心基礎設施方面的布局。