luckygood logo

跨境香港IEPL企业专线丢包:5个底层光路排障命令实录

StrataServer

上周某券商的深港数据库同步又挂了,一看border router的interface CRC错误狂飙。很多采购盯着“企业级”三个字买单,结果拉过来的所谓香港IEPL企业专线,底层跑的还是MPLS over Public的套壳货。

带宽买得再大,MTU没对齐也是白搭。真正的物理通道得靠DWDM波分复用硬切光层,加上两端POP点的QoS严格优先级队列,才能把TCP重传风暴按死在摇篮里。

扒开伪IEPL的底层组网拓扑

别听销售吹什么独享带宽,得看封装协议。

  • 查两端路由器的BGP邻居状态,看AS_PATH有没有被偷偷塞进公共互联节点。
  • 抓包看MPLS标签交换,真物理隔离的通道根本不需要外层再套一层GRE隧道。
  • 测空载和满载的Jitter,超过3毫秒的直接打回重做,这绝对是共享带宽池在作祟。

三种跨境承载网硬指标对比

承载模型光层隔离度MTU开销100M满载延迟
套壳MPLS无(走公网)24 Bytes15-40ms
标准IPLC时分复用8 Bytes8-12ms
真物理IEPL波长级硬切4 Bytes2-4ms

深港物理通道排障红线

遇到丢包别急着重启光猫,先敲这几个命令。

mtr -n -c 100 -i 0.2 [目标IP] | grep -v "0.0%"
ping -s 1472 -M do [目标IP] # 专治MTU黑洞
  • 跑`ping -s 1472 -M do`,如果直接回`Message too long`,说明中间某台交换机的MTU被网管手贱改成了1500以下。
  • 看`mtr`的输出,如果在深圳 border 节点突然飙到5%丢包,多半是运营商的QoS限速策略把你的数据流扔进了WRED丢弃队列。

如果你的业务只是传点几十兆的静态图片或内部OA系统,千万别买这种昂贵的物理通道,老老实实用标准SD-WAN叠加公网IP就行,纯属浪费预算。

作者简介:前Tier 1骨干网NOC值班长,现独立做跨境光路勘测。日常靠抓包和看光功率计续命,最烦拿PPT忽悠客户的销售。

带上你的源IP和目的IP,直接去测MTU和BGP路由跳数。数据通道不通,跑什么业务都是扯淡。立刻排查你的物理通道参数。

常见问题解答

01 MTR跑到深圳边境节点突然显示5%丢包,怎么确认是不是被QoS限速了?

用iperf3打UDP流量,同时抓包看DSCP标记。若高优先级队列没标记,说明流量被扔进WRED默认丢弃池,需重配QoS策略。

02 数据库主从同步延迟忽高忽低,但ping延迟只有2ms,查哪里?

查MTU和TCP窗口。用ping大包测路径,若中间设备强剥DF位引发分片,会引爆TCP重传风暴,必须两端严格对齐MTU参数。

03 两端BGP邻居状态一直Up/Down震荡,光衰也正常,啥原因?

查两端BGP的Hold Time与Timer。跨境光路偶发时钟漂移,参数差1秒就导致会话重置,需手动锁定两端路由器的计时器参数。