当前位置:首页 > 嵌入式 > 嵌入式分享
[导读]当72块GPU被塞进同一个机柜、当256节点超节点的功率逼近1兆瓦、当每颗GPU需要2TBps的IO频宽却被铜缆死死按在15W功耗红线之下——Scale-up的互联痛点,已不是"能不能跑"的问题,而是"还能撑多久"的生死命题。共封装光学(CPO)正以毫米级光引擎贴身芯片的姿态,撕开这道铜墙铁壁。

当72块GPU被塞进同一个机柜、当256节点超节点的功率逼近1兆瓦、当每颗GPU需要2TBps的IO频宽却被铜缆死死按在15W功耗红线之下——Scale-up的互联痛点,已不是"能不能跑"的问题,而是"还能撑多久"的生死命题。共封装光学(CPO)正以毫米级光引擎贴身芯片的姿态,撕开这道铜墙铁壁。

铜缆锁死的世界:Scale-up的三重窒息

Scale-up,即纵向扩展,是将同一机柜内数十、数百甚至上千个AI加速器通过高速互连捆绑成逻辑统一的超节点,让大模型训练的张量并行、专家并行不再被通信延迟拖成"并行的串行"。英伟达GB200 NVL72机柜将72块GPU以NVLink互联,便是这一思路的极致体现。

然而铜缆的物理宿命从一开始就写好了天花板。NVLink单向带宽虽达7.2Tbit/s,但有效传输距离仅约2米——这意味着"超节点的世界大小"被锁死在一到两个机柜之内。更致命的是功耗:以每条800G链路15W计算,仅网络部分就吞噬40kW以上,一个256节点未来架构单机架网络功耗将突破百千瓦级。铜线上高速电信号随速率提升呈指数衰减,800G时眼图已严重闭合,不得不堆叠DSP补偿,功耗与延迟双双失控。

三重窒息——距离锁死、功耗爆炸、信号劣化——让Scale-up在万卡时代沦为"戴着镣铐跳舞"。

CPO破壁:把光引擎焊进芯片旁的毫米革命

CPO的本质不是更快的光模块,而是一次封装形态的基因突变。它通过2.5D硅中介层或3D混合键合,将激光器、调制器、光电探测器组成的光引擎与交换ASIC或GPU封在同一基板上,电信号传输距离从传统可插拔方案的15至30厘米骤降至毫米级——根据信号衰减公式Loss=α·L,当L从1米压缩到10毫米,衰减直接降低两个数量级。

台积电CoWoS封装方案中,硅中介层以约150W/m·K的高导热性承担三重使命:重布线层实现光电芯片互联、硅基光波导传输光信号、低热膨胀系数缓解封装热应力。信号在封装内部即完成电光转换,无需外部连接器和长铜线迂回,DSP环节被大幅削弱甚至消除。

这带来的数据冲击是直接的:800G可插拔光模块功耗14至16W,CPO方案可压至4至5W,降幅高达65%至73%;单通道功耗降至1W左右,端到端延迟从纳秒级压缩至5至10ns;带宽密度则以三倍速度跃升,单芯片交换容量从51.2T直指102.4T乃至409.6T。

Scale-up才是真战场:SemiAnalysis的判断与Meta的验证

SemiAnalysis在其深度报告中抛出一个反直觉结论:Scale-out只是"练兵",Scale-up才是CPO的killer app。理由掷地有声——Scale-up对带宽和延迟的需求远超后端网络,Blackwell NVLink的7.2Tbit/s单向带宽是800G后端的九倍;而铜缆距离限制把Scale-up domain锁死,CPO一旦上车,这个"世界大小"将被彻底打开。Yole数据印证了这一判断:到2030年,Scale-up场景将占据CPO市场近七成份额。

Meta的实践为这一理论提供了最硬的实证。其评估了博通Bailly 51.2Tbps CPO交换器系统,8个6.4Tbps硅光引擎集成于Tomahawk 5基板,提供128埠400Gbps FR4连接。Meta在40°C高温环境下连续运行超过9个月,128埠全部以400Gbps模式满载,累积超过3600万埠元件小时的可靠性数据。结果令行业振奋:CPO光学元件功耗较retimed可插拔模块减少65%,折合单机架节省超500W;75%的埠在全部量测窗口内FEC bin保持在4以下,链路稳健性无明显退化。更巧妙的是,其采用可现场更换激光源设计,激光接面温度低于50°C,远优于可插拔收发器80°C的工作温度,从根本上改善了激光器寿命。

终极密码:从Scale-out练兵到Scale-up破局

英伟达已明确2026年Q4量产CPO交换器,博通51.2T Bailly完成认证,产业链从Lumentum到Coherent、从Tower Semiconductor到台积电全面提速。但Scale-up场景的CPO渗透可能要推迟到2028年下半年——行业需要在交换机侧充分验证长期可靠性,需要解决局部温升超85℃的液冷刚需,需要统一电光接口标准。

当光引擎不再是机柜前面板上的独立模块,而是与GPU并肩封在同一块硅中介层上;当电信号不再穿越30厘米铜线而是在毫米间完成交接;当功耗从每比特十几皮焦耳跌向1皮焦耳以下——铜缆的物理极限终将被光学穿透。万卡协同的传输密码,就藏在这毫米级的光与电之间。Scale-up的镣铐,正在一片一片碎落。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除( 邮箱:macysun@21ic.com )。
换一批
延伸阅读

2026年6月2日,英伟达在Computex期间正式宣布,其Spectrum-X以太网硅光技术全面进入量产阶段。这是全球首款采用光电一体封装(CPO)技术构建并实现量产的以太网交换机,标志着CPO技术正式跨越“概念验证”...

关键字: 英伟达 Spectrum-X CPO

共封装光学(CPO)正推动数据中心光互联从传统的"盒到盒"连接迈向"芯片到芯片"直连。在这一架构下,光引擎(Optical Engine)与交换ASIC集成于同一基板,电信号路径从...

关键字: CPO 光引擎

数据中心的光互连技术正面临一个日益迫近的物理极限。当交换芯片容量跃升至51.2T乃至102.4T,电信号传输速率达到每通道200Gbps以上时,传统有机基板在高频下的信号损耗已难以容忍,而硅基板的高介电常数则带来了严重的...

关键字: 玻璃基板 CPO

GPT模型参数以万亿计、当AI训练集群的功耗逼近一座中型城市的用电量,一个残酷的事实浮出水面:算力芯片跑得越快,光互联却拖得越狠。传统可插拔光模块如同一条"拥堵的高速公路"——电信号从交换ASIC出发...

关键字: AI算力 CPO

AI数据中心机柜密度突破百万GPU规模,互联环节的功耗已不再是次要的技术细节,而是制约集群规模扩张的核心瓶颈。传统可插拔光模块方案中,电信号从交换芯片出发到光模块的传输距离长达几十厘米,信号严重失真,迫使DSP以5-10...

关键字: CPO 电信号

2026年8月,英伟达网络事业部资深副总裁Gilad Shainer在行业技术论坛上正式宣告:共封装光学(CPO)技术已迈入量产阶段,搭载CPO方案的Spectrum-X交换机已开始向核心合作伙伴交付。这一声明确认了此前...

关键字: CPO 英伟达

2025年,全球CPO/NPO市场规模仅约1亿美元;而花旗银行在2026年3月发布的最新测算中预测,到2028年,仅FAU/连接器、ELSFP、光纤互连模组和光纤托盘四大核心组件的市场规模合计就将突破1850亿元人民币,...

关键字: 硅光设计 CPO

AI算力集群的规模正从千卡级迈向十万卡级,数据在GPU之间流动的速度已成为训练效率的关键瓶颈。传统铜缆的物理规律决定了带宽与传输距离不可兼得——在50GHz频率下,仅2米的高品质铜缆就会消耗掉90%以上的信号功率预算。C...

关键字: CPO 波分复用

AI集群机架功耗突破100kW并向吉瓦级演进,传统风冷方案在CPO架构面前已彻底失效。共封装光学(CPO)将光引擎与交换芯片封装在同一基板上,将电信号传输距离从数十厘米压缩至数毫米,但这一集成化带来的副作用是功率密度的指...

关键字: CPO 数据中心

在2026年慕尼黑上海电子展上,高性能计算与高速数据传输技术再次成为行业关注的焦点。随着人工智能大模型规模的持续增长,底层集群通信网络对性能的要求已经达到了新的高度。在展会现场,Samtec展示了针对224Gbps以及更...

关键字: CPO CPC Samtec 224Gbps 448Gbps
关闭