H3C网络排障入门 常见网络故障怎么排查

网络出故障了,第一反应是什么?很多新手是"哪里不通点哪里",试来试去浪费半天。真正专业的做法是"按层排查、逐步缩小范围"。H3C 认证里,从 H3CNE 的 ping/tracert,到 H3CIE 的《网络规划与排障》课程,都在训练这套方法论。这篇文章把网络排障的入门框架讲清楚,照着走,大多数常见故障都能定位。
先记住排障的总原则:从物理层往上层一层层查,先通后懂、先粗后细。网络分层模型(OSI/TCP-IP)不只是考试概念,它本身就是排障地图——故障发生在哪一层,就用那一层的工具去验证。
第一步,确认故障现象和范围。别急着动手,先搞清楚三个问题:谁不通?(单台电脑、一个部门、还是全网?)什么业务不通?(ping 不通、网页打不开、还是只能上网不能访问内网?)什么时候开始不通的?(改动过配置、换过设备、还是突然断的?)范围能帮你快速锁定位置:单台不通查终端和接入,一个部门不通查汇聚,全网不通查核心和出口。
第二步,从物理层开始验证。最常见的"低级故障"都在物理层:网线松了、接口没 up、光模块坏了。用 `display interface` 看端口状态(up/down、有没有错包),用 `display transceiver` 看光模块信息(光功率是否正常)。物理层不通,上面全白搭——这一步排障成本最低,收益最大。
第三步,用 ping 做连通性测试,逐跳定位。ping 不通时,用 tracert(Windows)/tracert(H3C 设备命令)看报文走到哪一跳断了。比如:终端 ping 网关通、ping 服务器不通,tracert 显示到某台路由器就停了,故障点基本就在那台路由器或其下一条链路。这是"分段定位"的经典用法。
第四步,按故障类型分头排查。常见场景给你列几个:
场景一,VLAN 不通。终端能配 IP 但跨交换机不同 VLAN 不通:查 Trunk 口是否放行了对应 VLAN、Access 口 VLAN 归属是否正确、VLAN 是否创建。用 `display vlan` 看端口和放行列表。
场景二,路由不通。ping 网关通、ping 远端不通:查路由表(`display ip routing-table`)看目标网段有没有路由、下一跳是否正确;查 OSPF 邻居状态(`display ospf peer`)看协议是否正常。很多"路由不通"其实是"协议没起来"。
场景三,NAT 不通。内网访问外网失败:查 NAT 配置、查接口是否应用了 NAT 策略、查公网地址池。用 `display nat session` 看会话表,看流量有没有被 NAT 转换。
场景四,DNS 解析失败。能 ping 通 IP 但打不开网页:查 DNS 配置,`display dns` 或终端上 nslookup 验证解析是否正常。
第五步,用好日志和抓包。设备日志(`display logbuffer`)会记录接口 down/up、协议状态变化,很多时候故障原因日志里已经写了。再不行就抓包(ACL+镜像抓包,或 `debugging ip packet` 开调试),看报文到底发没发出去、回没回来。抓包是排障的"终极武器",H3CIE 机试里排障就靠这个。
第六步,排障完做总结。故障根因是什么?怎么解决的?下次怎么预防?把这个写下来,你的经验值就涨了。这也是 H3CIE 面试常考的点——面试官问"你排过什么故障",讲得出完整过程的人,比只说"我重启了设备"的人高好几个档次。
给想系统提升排障能力的人一个建议:排障能力是练出来的,不是看出来的。方法有两个,一是工作中多积累真实故障案例,二是主动做排障训练——把配置好的网络故意搞坏(断链路、错配路由、堵端口),然后自己排查修复。H3CIE-RS+ 的《H3C 网络规划与排障》课程就是这么设计的,6 天课程里有 4 个大型排障实验。想学的话,找开这个课程的授权培训中心,比如润天教育,H3C 钻石级授权培训中心,用真机环境带你做排障案例训练。
最后总结一句:网络排障 = 分层排查 + 分段定位 + 善用工具。把"先物理、再二层、后三层"的思路练成习惯,再常见的故障都能在几分钟内定位。入门排障,从今天这篇开始。