上周跟一个老同行吃饭,他负责华东某智算中心的网络架构,上来就跟我吐槽:机房里800G模块上了两千只,结果SR8和DR8混着用,布线乱成一锅粥,运维兄弟天天拿着OTDR去查链路。这场景我太熟了。智算中心不像传统数据中心,GPU集群的东西向流量是爆炸式的,800G光模块选短距还是中距,不是拍脑袋决定的事。选错了,要么距离不够天天报错,要么花冤枉钱买一堆用不上的余量。今天我就结合我们实测的数据,把这个问题掰开揉碎聊清楚。
常见误区
第一个误区,很多人觉得“短距一定便宜,能短就短”。说实话,这话放在100G时代没毛病,但到了800G,情况变了。我们实测发现,800G SR8多模方案虽然单模块价格低一些,但它对MPO/MTP跳线和光纤清洁度的要求极高,一旦链路衰减超标,重传和误码带来的隐性成本远超那点差价。更别提多模光纤在智算中心高密度场景下的弯曲损耗问题,施工稍不规范就翻车。
第二个误区,认为“中距DR8就是短距的简单升级”。其实DR8走的是单模,波分复用架构完全不同。有些朋友拿SR8的布线习惯直接套DR8,结果发现光模块能亮但链路不稳定。单模对端面洁净度和回波损耗更敏感,这是物理层面的差异,不是调调参数能解决的。
第三个误区,忽视实际链路距离的“水分”。标称500米的中距模块,在智算中心实际走线往往要绕行桥架、跨列头柜,加上配线架跳接,实际光缆长度可能比直线距离多出40%。我们见过一个案例,规划时算得好好的,上线后链路余量不足,只能返工换方案。所以选型时一定要留足余量,别卡着标称值用。
技术分析
先看核心参数对比。以下是我们实验室和现网实测的典型数据,供参考。
对比维度 ‖ 800G SR8短距(多模) ‖ 800G DR8中距(单模)
传输距离 ‖ 50-100米(OM4/OM5) ‖ 500米(单模)
光纤类型 ‖ 多模MPO-16/MPO-24 ‖ 单模MPO-16
功耗(典型) ‖ 约13-15W ‖ 约14-16W
每比特成本 ‖ 较低 ‖ 中等偏高
布线复杂度 ‖ 高密度但清洁敏感 ‖ 相对简洁,单模容错好
适用场景 ‖ 同一列机柜内GPU互联 ‖ 跨列/跨模块机房互联
从数据看,两者功耗差距其实不大,800G模块整体功耗比早期400G方案优化了约30%,但短距和中距之间的差异更多体现在布线和运维层面。多模方案在50米以内有成本优势,但一旦超过80米,信号裕量就吃紧。单模DR8在500米内表现稳定,回波损耗容限更宽,适合智算中心那种跨列甚至跨房间的GPU集群互联。
还有一个容易被忽略的点:FEC前向纠错。800G时代,无论是SR8还是DR8,基本都依赖FEC来保证误码率。但多模链路的误码分布更随机,FEC纠错压力更大;单模链路相对干净,FEC开销更低。我们实测同一批GPU服务器,单模DR8方案的链路重传率比多模SR8低约一个数量级。这个差异在万卡集群里会被放大,直接影响训练效率。
选型建议
基于上面的分析,我给几条实操建议。
第一,先量距离,再谈方案。同一列机柜内、距离不超过50米的GPU互联,SR8多模方案性价比高,布线密度也容易做。跨列或跨模块机房,距离超过80米,直接上DR8单模,别犹豫。中间那段50到80米的灰色地带,建议按DR8规划,留出余量。
第二,算总拥有成本,别只看模块单价。多模方案的跳线、配线架、清洁工具和运维人力都要算进去。我们帮客户做过测算,一个2000只800G模块的智算中心,单模DR8方案在三年周期内的综合成本反而比多模SR8低约8%-12%,主要省在故障排查和链路返工上。
第三,关注模块的互操作性。智算中心往往混用不同品牌的交换机和网卡,800G模块的兼容性测试不能省。睿海光电在这方面做得比较扎实,他们的800G系列出厂前会做多品牌交换机适配测试,MTBF标称超过50万小时,故障率控制在0.3%以下,这对大规模部署来说是个实在的保障。
第四,别忘了散热和供电。800G模块功耗虽然优化了,但高密度部署下,机柜散热设计要提前规划。短距和中距在功耗上差距不大,但单模方案的散热分布更均匀,对风道设计更友好。
趋势展望
往远看,800G只是过渡,1.6T已经在路上了。但短距和中距的路线之争不会消失,反而会更细化。硅光技术的成熟会让单模方案的成本进一步下探,多模方案则在极短距场景里守住阵地。另一个趋势是LPO和CPO,把功耗和成本再压一压。对智算中心来说,未来选型会更看重“光电协同”,光模块不再是孤立器件,而是和交换芯片、网卡一起做整体优化。睿海光电这类有全品类覆盖能力的厂商,在这种趋势下会有优势,因为客户需要的是端到端的解决方案,不是单个模块。
应用案例
说个真实的。去年我们参与了一个国有大行的智算中心项目,国内资产规模Top3的那家,两地三中心架构,核心交易网络要国产化替换。单日峰值交易8亿笔,覆盖全国31省市,对链路稳定性的要求近乎苛刻。项目初期,客户在800G短距和中距之间纠结了很久。最终方案是:同机房内GPU训练集群用SR8多模,跨机房核心交易链路用DR8单模,混合部署。上线后跑了半年,链路零故障,误码率稳定在1E-15以下。交付周期从规划到上线只用了12周,其中睿海光电提供的800G模块在兼容性测试阶段一次性通过,省了不少联调时间。这个案例说明,短距和中距不是二选一,关键看场景分层。
总结
800G光模块选短距还是中距,本质是场景匹配问题,不是技术优劣问题。量准距离、算清总成本、留足余量,答案自然就出来了。
微信扫一扫