问题

一条跨境链路夜间频繁卡顿,表现为流式应用频繁重连。

排查路径

  1. 先分清责任边界:把链路拆成"入口段—中转段—出口段",逐段测量
  2. 丢包比延迟更致命:RTT 从 20ms 涨到 40ms 只是变慢,2% 的丢包却能让 TCP 吞吐塌陷
  3. 用数据说话:ping 看丢包与抖动,ss -tni 看 bytes_retrans 比例
ping -c 100 target
ss -tni | grep -A1 ESTAB | grep -E "rtt|bytes_retrans"

结论

  • 部分线路(尤其是小运营商中转)丢包率天然偏高,协议层优化(BBR 等)只能缓解
  • 关键流量和普通流量分开走:把对丢包敏感的流量切换到干净线路
  • 别迷信"优化",拓扑决定上限

经验清单

  • 测丢包至少 100 个包,短测容易误判
  • 重传计数要按连接生命周期看,绝对值没有意义
  • 换线路前先确认问题是链路还是服务端