觀點網訊:9月22日,阿里CEO吳泳銘在雲棲大會上披露,阿里正準備訓練參數規模介於5萬億至10萬億之間的新一代人工智能模型。阿里ATH事業羣Token Foundry Qwen LLM項目負責人劉大一恆在現場提到,未來Qwen4.5、Qwen5的參數規模計劃邁向5萬億到10萬億。

同一天,據The Information報道,DeepSeek目前正在訓練一個約2萬億參數的新模型。DeepSeek創始人梁文鋒在近期一場投資者會議上表示,公司下一步計劃繼續把模型推到8萬億參數。

更早的8月,英國《金融時報》援引知情人士稱,字節跳動正在訓練一個最高可達10萬億參數的大模型。

在已發佈的模型裏,國產陣營的頂點是月之暗面7月推出的Kimi K3,總參數2.8萬億,是全球首個開源的3萬億級別模型。阿里當前旗艦Qwen3.8-Max約2.4萬億,DeepSeek現役V4-Pro為1.6萬億;2025年DeepSeek-R1的參數量僅6710億。

資本投入方面,阿里2026年Q2單季資本開支677億元,同比增長75%,自由現金流由正738億元轉為負466億元。阿里賬上約4745億元現金及流動投資,上月通過港股配售募資約800億港元用於AI基礎設施。

字節2026年資本開支上限最高可達700億美元,約為上一年三倍,2027年還可能再衝1000億美元;其2025年AI相關投入達1500億元,2026年進一步增至2000億元。字節近期完成約300億美元的銀團貸款,部分資金預計將投入持續擴大的AI基礎設施。

數據中心方面,吳泳銘在雲棲大會上宣佈,阿里雲到2032年運營的全球數據中心規模將超過20GW。高盛此前估算,阿里目前已上線容量約3—4GW,未來六年將新增約16—17GW,規模擴大到目前的5倍以上。參照英偉達黃仁勳在財報電話會中透露的信息,建設1GW算力的成本約為500億—600億美元,按此推算,阿里未來六年新增的16—17GW總建設投入可能達8000億至1萬億美元量級。