2026 OCP China Day开放计算技术大会于北京重磅举办,这是OCP深耕中国市场的第七届行业盛会,由OCP开放计算社区与OCTC开放计算标准工作委员会联合主办,汇聚全球头部云厂商、芯片企业、算力基础设施服务商及行业技术专家齐聚一堂。

大会聚焦AI数据中心、全域算力互联、绿色数据中心、边缘连续计算等前沿赛道,深度分享开放计算全栈技术标准、生态共建成果与规模化落地实践。

此次大会字节跳动服务器架构师高晓军登台分享,围绕大模型爆发下算力基础设施现存痛点,完整拆解 AI Rack 2.0 量产落地成果,并推出面向超高功耗、超大集群的兆瓦级 AI Rack 3.0 整机柜架构。

此外讲解铜互联、NPO 光互联两条超节点扩展路线,最后从部件、互联、供电、散热四大维度阐述兆瓦级算力生态共建思路。

此次演讲聚焦下一代兆瓦级 AI 算力系统落地实践。当下大模型训练、推理需求持续爆发,传统算力集群存在交付慢、密度不足、功耗管控难、硬件生态割裂等短板。

字节跳动以弹性、高效、极速交付、开放协同四大核心思路,迭代两代整机柜超节点方案,最终落地兆瓦级高密度算力底座。

面向全球化、全场景 AI 业务,算力底座需要补齐四项核心能力:弹性层面基于业务灵活调配资源,降低整体 TCO,实现集群弹性扩容;稳定高效依靠全链路高可用设计,规模化部署液冷数据中心;极速交付采用整机柜一体化模式,大幅缩短上线周期,适配全球多地同步建设;开放多元兼容各类异构 XPU 算力,模块化标准化硬件搭建开放共生产业生态。

整体目标实现算力更高密度、更快上线、更低成本、更开放兼容。

字节跳动上一代量产 AI Rack 2.0 超节点完成规模化商用,两台机柜组成单 Pod 最高可搭载 256 张 XPU,单机柜供电功率达 240kW。

整套硬件采用模块化灵活设计,支持整机柜统一交付,开放架构兼容多样算力;依托机柜内交换组网,可灵活完成单柜小规模部署或多柜集成超大规模集群,适配训练、推理多类业务场景。

针对 P3E 加速卡推出超高密整机柜方案,相较传统 8 卡机箱算力密度提升 4 至 8 倍。机柜内部采用 K-Blade 铜互联替代传统光互联方案,在降低组网成本的同时提升系统运行可靠性。

通过 XPU 一卡双芯、原生液冷优化硬件散热,充分释放单卡算力,32 组计算托盘统一接入交换网络,缩短链路时延、减少布线故障,运维复杂度大幅下降。

未来两年 AI 模型参数量、算力互联带宽将持续成倍增长,XPU 芯片工艺、功耗同步迎来跃升:芯片采用 2.5D/3D 堆叠 Chiplet 封装,单卡功耗将达到 2000 至 3000W;单机柜算力数量、整机柜总功耗同步翻倍,集群互联带宽提升 4 倍以上。

硬件物理约束倒逼基础设施升级,行业正式迈入兆瓦级算力时代,高带宽光互联成为必然选择。

新一代 AI Rack 3.0 相较 2.0 实现规格翻倍,双机柜 Pod 最大支持 576 张 XPU,Scale-up 双向互联带宽提升至 460TB/s;单机柜采用 800V 高压直流供电,单机柜功率 500kW,单 Pod 总功率突破 1 兆瓦。

硬件取消机柜内置风扇,实现 100% 全液冷散热,彻底解决风冷混合架构散热瓶颈;延续整机柜标准化交付模式,适配全球大规模算力中心建设。

机柜内部前置 36 组计算托盘、后置 16 组交换托盘,通过四组线缆托盘完成互联,交换、计算单元数量可随业务带宽需求灵活调配。

整机保持行业通用 600mm 标准机柜宽度,供电、液冷、网络全部采用三盲插设计,简化现场运维部署。

硬件分层清晰:800V 高压直流电源架位于机柜两侧,中部为 54V 液冷汇流排,前置横向插拔计算托盘,后置竖向插拔交换托盘,多组独立线缆托盘分区布线,可根据集群规模扩展四倍互联布线单元,液冷管路统一集成便于维护检修。

为突破铜互联带宽与距离限制,字节研发配套 NPO 近封装光互联超节点方案。单套集群由 8 台计算机柜搭配 2 台独立网络交换柜组成,最高支持 1024 张 XPU 全互联。

每一组计算托盘内置光交换模块,GPU 与交换机实现全交叉互联,光互联独立走线从机柜后侧引出,分摊 600mm 机柜布线压力,硬件底座与铜互联机柜完全兼容复用。

NPO 光互联机柜供电、液冷架构与 AI Rack 3.0 铜互联版本保持统一,单机柜依旧支持 500kW 功率与 800V 高压输入。

2U 规格计算托盘内置独立光交换单元,Scale-up 互联光纤统一后置出线,机柜、管路、供电等基础组件完全通用,企业可根据带宽需求灵活切换铜、光两种互联方案,硬件改造成本极低。

想要落地成熟兆瓦级算力系统,产业需要同步推进四大维度标准化:算力部件层面统一新一代 XPU 外形规格,推动 SSD、网卡、光模块原生液冷标准化;互联体系升级 224G 高速铜互联,落地 NPO 光互联突破物理带宽上限。

供电系统普及 800V 高压直流,板级垂直供电缩小电源体积、提升能效;散热实现整机 100% 液冷覆盖,完善多芯片流量匹配散热方案,配套全流程液冷在线监测保障长期稳定运行。

字节跳动将持续深耕整机柜、液冷、高速互联全栈算力硬件研发,坚持开放共建路线,联合上下游伙伴落地标准化兆瓦级算力基础设施,依托高密度、高带宽、低功耗整机柜方案,支撑全行业 AI 业务持续规模化增长。