中国 AI 基础设施大跃进
⚠️ 说明:SemiAnalysis 该报告为付费订阅内容,此处仅翻译其公开发布的引言与摘要部分,不含付费正文。数据与结论版权归 SemiAnalysis 所有,完整报告请支持原文订阅。
中国正处于全球模型竞赛的前沿。GLM 5.3 和 Kimi K3 是一系列亮眼的开源权重发布中最新的两作;字节跳动的豆包服务着 3.45 亿月活用户,是中国的 ChatGPT;Seedance 则是最先进(SOTA)的视频生成模型。
这些模型每一代都跑在数据中心上,而中国建设数据中心的速度,在境外基本无人测量过。最大的租户不发 10-K 年报,几家最大的业主从未上市,绝大多数一手材料都是中文的。于是市场形成了两个偷懒的假设:中国很大,中国是空的。已发表的中国数据中心容量估算彼此相差 15 倍,各类报告还在不断引用高空置率。
正如我们的旗舰产品 SemiAnalysis 数据中心模型所做的那样,本文用建筑级(building-level)数据来检验流传最广的几个叙事,先从市场规模开始。
全球模型跟踪四个区域的 5000+ 设施:美国以 56GW(截至 2026 年底)领跑全球,其次是非中国亚太约 15GW、EMEA 约 14GW、拉美约 2GW。直到今天,这个模型在中国的国境线前停了下来。现在,我们跨过它。
我们对 60 多个玩家、1000 多座数据中心设施的跟踪显示:仅中国一国的在运机队就超过 24GW——比 EMEA 大,比亚洲其他地区加起来还大。这还不含约 20GW 已过期未交付的管线,和另外约 30GW 已官宣的项目。
增长正处在拐点上。2026 年二季度,阿里、腾讯、百度("BAT")合计资本开支达到 200 亿美元,同比翻倍有余,且有记录以来首次三家自由现金流全部转负。这是该行业历史上最大的一次资本开支跃升。
这个总数还没有算上最大的支出方——仍未上市的字节跳动。根据我们的中国数据中心模型,字节跳动一家就占据中国已交付数据中心容量的约五分之一,且几乎全部是租的,这使它成为全中国批发型托管(wholesale colo)玩家最重要的单一客户。
上市公司拿到了所有注意力,但它们只是冰山可见的一角。数据中心业主侧同样如此:GDS 和 VNET 是仅有的两家在美上市的中国数据中心业主,2026 上半年签下 1.3GW 批发订单——但按我们的模型,2024 到 2026 年至今,字节跳动和阿里的订单里这两家只拿到勉强三分之一。
这场建设是全国性的行动,国有运营商也是其中一部分。中国数据中心市场历史上由电信主导:国有运营商在 2010 年代占据大部分市场份额,今天仍持有全国容量的三分之一。国家电网系公司的投资同样激进,其资本开支从 2024 年起加速,"十四五"最终超额原规划 24% 完成;"十五五"(2026–2030)再叠加 40%,总额超过 7460 亿美元(5 万亿元人民币)。
基本不受电力约束、用工短缺和公众抗议的困扰,中国 routinely 在 12 个月内交付 100MW 级数据中心设施。模块化数据中心是标准打法——腾讯 2014 年就部署了第三代模块化设计。在中国已是旧闻的东西,在美国才刚开始规模化采用(参见我们另一篇《LEGO 数据中心的狂野西部》)。
增长并不止步于中国国境。中国超大规模厂商的海外租赁容量预计从 2026 到 2029 年翻倍,在我们数据中心模型中接近约 4GW。这个数字仍然低估了它们的离岸算力——因为不含它们从西方云厂商那里租用的数十万张 GPU(详见《Oracle 如何赢下 AI 算力市场》)。
当然,市场也有乌云:空置率高企,数据中心开发商在价格上激烈内卷;受出口管制影响,芯片供给受限。但正如下文将解释的,这两件事都没有阻止 AI 数据中心以惊人的速度建成并填满。
完整报告目录(付费部分)
- 中国数据中心产业导论:全球第二大市场,零售先行的发展史——为什么这段历史同时造成了过度建设/高空置与 AI 容量短缺
- 西进建设:"东数西算"政策与超大规模 AI 需求如何把产业推向内陆,以及西方无法匹敌的建设速度和单位成本
- 玩家拆解、供需模型等(付费订阅解锁)
译注:本文为 SemiAnalysis 报告免费公开部分的中文翻译,数据图表请见原文。术语对照:wholesale colocation=批发型托管;Eastern Data, Western Compute=东数西算;open-weights=开源权重。