网络设计第十七问到二十二问:运维与高级主题
自发现与配置、移动性管理、可靠性、网络管理、IPv6 过渡、能效——这六个主题不再是"数据怎么传",而是"系统怎么稳定运行"。
文章目录
- 网络设计第十七问到二十二问:运维与高级主题
- 第十七问:自发现与配置
- 第十八问:移动性管理
- 第十九问:可靠性
- 第二十问:网络管理
- 第二十一问:IPv6 过渡
- 第二十二问:能效
第十七问:自发现与配置
新设备接入网络,不知道它的 IP、掩码、网关、DNS 是什么。DHCP 自动分配——设备广播 DHCP Discover→服务器回应一个 Offer→设备选择→确认——拿到配置。DNS-SD 发现局域网内的服务——打印机、网络存储——自动在应用层提供。
在政务系统里——新终端接入必须加上准入控制——802.1X——用户名/密码或证书认证后才能获得 IP——不是随意接入。否则任何设备插入网线就能拿到内网地址。
第十八问:移动性管理
设备带着 IP 从一个网段移动到另一个——IP 变了——所有 TCP 连接必须断——因为 IP 是连接的标识。
蜂窝网的解决——移动 IP——家地址(固定的)和转交地址(临时的)。家代理接收所有发到家地址的包——转发到设备当前的转交地址——设备回来时撤销转交。
5G 里——UPF 就是那个家代理——连接一直保持——设备移动中 IP 可能变——但核心网的隧道保证数据不中断。
第十九问:可靠性
网络可靠性不是一根线不断——是断了之后多快能绕过。
- 生成树协议——检测到环路→路径自动切——端口从阻塞态经监听/学习到转发态——整个过程耗几十秒
- HSRP/VRRP——多台路由器共享一个虚拟 IP——主路由器故障切换——从备份切割——耗时几秒
- BFD 双向转发检测——毫秒级检测路径故障——比链路层检测快千百倍
政务专线的可靠要求:双链路、双设备、双路电源——任何单一故障都不能中断主链路超过 50ms——这是对高频交易的要求——也是社保扣款这种"每一秒都在发生"的业务所需。
第二十问:网络管理
SNMP 查询设备状态——统计端口流量、错误计数、CPU 负载、温度。NETCONF + YANG 这是现代网络的配置管理——用 XML 协议下发配置——代替手动配 CLI——政务云的运维标准。
Zabbix/Prometheus 等监控工具整合 SNMP 数据——设定阈值——超过即告警——没有监控等于盲飞。
第二十一问:IPv6 过渡
IPv4 地址用完了。IPv6 的地址空间足够给全宇宙的每一粒沙子一个 IP。但全球大部分系统仍是 IPv4。
过渡机制:
- 双栈——同时跑 IPv4 和 IPv6——最透明——需要业务全链条支持
- NAT64——IPv6 客户端访问 IPv4 服务——在中间翻译地址
- 隧道——6in4/Teredo——在 IPv4 网络上封装 IPv6 包
政务政务网处于两难:长期看必须迁移 IPv6(政策要求),但市县系统、银行、外部接口大多仍是 IPv4。在过渡期内——所有对外接口必须兼容双模式。
第二十二问:能效
数据中心 1/3 的用电在冷却。以太网支持 EEE——空闲时降低发送功率——活动时恢复。4G/5G 基站有休眠技术——低负载时关掉部分天线。你的服务器在非高峰期——低负载——功耗却不变——这就是浪费。但在政务网中——设备通常被配置为"永不休眠"——因为任何几分钟的无响应都可能被监控系统告警为"系统故障"。
✅ 亮点:六个运维级话题横向归并——自发现保证零配入网、移动 IP 保证移动不中断、冗余保证断得快恢复、管理协议保证可被监控、过渡机制保证 v4→v6 兼容、能效保证不被功耗吃掉。