蘇姿豐、奧特曼與阿莫迪。圖片經由AI生成。
文|蘇揚
編輯|徐青陽
硅谷新一輪基礎設施投資熱潮啓動了。
7月22日消息,OpenAI宣佈啓動其首個自主主導建設的200億美元數據中心項目,並將到2030年的預計算力支出上調至7500億美元;同日,AMD宣佈將向Anthropic投資高達50億美元,而Anthropic則承諾採購高達2GW的AMD最新一代AI芯片。
兩項交易表明,科技巨頭們的競爭已不再侷限於單純的芯片採購,而是全面延伸到了數據中心自建、能源保障以及底層基礎設施的直接控制中。
01
OpenAI算力預算飆至7500億
爲了確保獲得開發和運行AI模型所需的龐大算力,OpenAI進一步擴大了其數據中心規劃與預算。
知情人士透露,受與雲服務提供商達成的新協議推動,OpenAI已將其到2030年的預計算力支出從今年年初約6000億美元上調至7500億美元。
不過,隨着OpenAI推進IPO進程,如何平衡計算成本與財務健康成爲了管理層討論的焦點。首席執行官山姆·奧特曼大力推動的算力擴張計劃,讓首席財務官薩拉·弗萊爾對公司的資金鍊狀況保持審慎態度。
據悉,弗萊爾向管理層表達了隱憂,即如果業務收入的增長不及預期,公司可能會在未來履行龐大的算力採購協議時面臨資金缺口。
在具體項目推進上,OpenAI宣佈投資200億美元,在佐治亞州埃芬漢姆縣啓動名爲“Project Camellia”的數據中心項目。
在電力保障方面,OpenAI已與佐治亞電力公司達成協議,將在2028年至2032年之間分階段獲得3.2GW的電力供應。
據瞭解,該項目是OpenAI首次作爲首席設計和開發方自主推進的數據中心。在此之前,OpenAI主要是向甲骨文、亞馬遜AWS等雲服務提供商租用算力。
爲此,OpenAI聘請了此前在馬斯克旗下xAI負責孟菲斯超級計算機數據中心建設的布倫特·梅奧(Brent Mayo),擔任數據中心建設與交付負責人。梅奧將向本月晉升爲算力首席技術官的烏代·魯德拉拉朱(Uday Ruddarraju)彙報。
爲了緩解公衆對數據中心建設日益高漲的反思與牴觸,OpenAI承諾在項目生命週期內提供8000萬美元社區福利資金,用於學校、公共安全、醫療等領域。同時,向佐治亞州高校學生提供高達7100萬美元的Codex代金券。並且採用閉環水循環冷卻技術以極小化用水量。以及在用電高峯期主動自願減少功耗,確保不推高當地居民電費。
除了佐治亞州的項目外,OpenAI還在推進多項算力協議:此前與甲骨文簽約了6GW的數據中心容量;並在2月底將其與亞馬遜AWS的雲計算協議擴大至8年138億美元(包含2GWTrainium芯片算力);去年還承諾向微軟Azure追加2500億美元的雲支出。
02
AMD與Anthropic“股權換訂單”
和OpenAI一樣,Anthropic也面臨着極高的算力需求壓力。此前強勁的需求曾迫使Anthropic限制用戶使用頻次,部分客戶還報告了服務宕機問題。
爲了緩解算力瓶頸並實現供應鏈多元化,AMD與Anthropic在同一日宣佈達成重大戰略合作。根據協議條款,Anthropic將從2027年上半年開始部署高達2GW的AMD最新一代Instinct MI450系列GPU。這些芯片將集成於包含EPYC“Venice”CPU、Pensando網絡及ROCm軟件的AMD Helios機架級解決方案中。
與此同時,隨着特定部署里程碑的達成,AMD將向Anthropic進行高達50億美元的戰略股權投資。
雙方還達成了工程合作協議,將利用Anthropic的Claude模型來優化針對AMD芯片的工作負載,並加速AMD ROCm軟件的開發。AMD自身的工程和產品開發團隊也將全面採用Claude。
AMD首席執行官蘇姿豐表示,兩家公司的工程團隊已經合作了一段時間,大規模AI算力的部署需要提前12、18或24個月進行長期規劃。據知情人士透露,AMD 目前還在洽談爲Anthropic未來的數據中心租賃債務提供財務擔保。
根據《華爾街日報》報道,Anthropic在該交易中的算力策略涵蓋了直接購買與租賃:既爲自身設施直接採購部分AMD芯片,也通過其他雲服務商或新雲服務商租用部分算力。
此前,Anthropic已與谷歌、亞馬遜及SpaceX簽署了相關算力或數據中心容量協議,其工作負載同時運行在谷歌TPU、亞馬遜Trainium及英偉達GPU等多種芯片之上。
推薦閱讀