暂无评论
升级后 IRF 堆叠从原来两条链路分担流量,变成只有单条堆叠链路跑满、另外一条几乎无流量,进而出现拥塞丢包,这是 S7506 (E) 升级版本后很容易碰到的现象,主要是版本升级 IRF 链路缺省 hash 分担算法发生变化,出现 hash 极化,少数情况是堆叠成员端口状态异常。
display irf topology
display irf configuration
display interface 堆叠物理口
1、确认两条堆叠物理口都是 UP,都已经正确绑定进 irf‑port,没有端口处于 down、faulty。
如果其中一个物理口实际异常,自然只有一条跑流量,优先排查光模块、光纤。
display irf‑port load‑sharing mode
老版本和新版本 Comware7 IRF 缺省分担因子不一样,升级完配置没改,但系统默认 hash 策略变了。现网业务流特征如果比较单一(少数大流量长流),就会出现所有流量全部 hash 选到其中一条堆叠链路,另一条空闲,也就是 hash 极化,单条堆叠口直接跑满拥塞丢包H3C。
看堆叠口实际流量确认现象:
display counters rate inbound interface 堆叠物理口
display counters rate outbound interface 堆叠物理口
一条带宽打满,另外一条速率很低,就是分担不均。
系统视图下修改 IRF 全局负载分担,根据业务调整 hash 因子,把源目 IP、源目端口都带上,打散大流量,避免全部打到一条链路上H3C。
system‑view
irf‑port global load‑sharing mode source‑ip destination‑ip source‑port destination‑port
修改完不需要重启 IRF,即时生效;改完再看
display counters rate,观察两条堆叠口流量是否逐步分摊开。
注意:IRF‑port 视图下也可以单独针对某一组堆叠口配置
irf‑port load‑sharing mode,优先级高于全局。
1、确认有没有开启link‑aggregation load‑sharing mode local‑first本地优先转发。跨框聚合 / ECMP 本地优先转发会大量增加 IRF 堆叠链路的转发压力,升级后部分版本缺省行为变化,会把更多业务流量推到 IRF 堆叠链路上,造成堆叠带宽暴涨跑满,业务丢包H3C。
display link‑aggregation load‑sharing mode
2、检查升级过程 IRF 是否完整合并,有没有发生 IRF 分裂后合并异常:
display mad verbose
display irf
3、看接口是否存在拥塞丢包计数:
display interface 堆叠物理口 | include drop
如果堆叠口有 output‑drop,就确认是单条链路带宽占满溢出丢包。
1、IRF 是逐流 hash 分担,不是逐包,如果业务是少数几条超大流,无论怎么调 hash,都有可能全部落在同一条链路,这是 IRF 堆叠本身机制限制;
2、修改 IRF 分担模式不会影响业务,不需要割接重启;
3、如果调整 hash 后还是严重不均,收集display diagnostic‑information全套信息,联系 400,核对该版本是否有 IRF 分担相关已知 bug。
display irf‑port load‑sharing mode确认分担因子;irf‑port global load‑sharing mode增加 hash 因子打散流量;暂无评论
亲~登录后才可以操作哦!
确定你的邮箱还未认证,请认证邮箱或绑定手机后进行当前操作
举报
×
侵犯我的权益
×
侵犯了我企业的权益
×
抄袭了我的内容
×
原文链接或出处
诽谤我
×
对根叔社区有害的内容
×
不规范转载
×
举报说明
暂无评论