银行、证券、大型政企这两年上系统的口号里,"同城双活"出现的频率越来越高。这个听着高大上的架构,到底是个啥?网络工程师在里面的参与度有多少?值不值得往这个方向钻?这篇讲讲明白。
先说双活数据中心要解决什么问题。传统的容灾方案是"两地三中心"里常见的主备模式:生产中心干活,灾备中心待命,真出事了再切换。问题是主备模式平时灾备侧基本闲置,资源浪费,而且真到切换那天,心里没底——好几年没演练过的切换,成功率谁都不敢打包票。同城双活的思路是让同城两个数据中心同时承载业务、互为备份,日常负载分摊,故障时秒级切换,业务连续性的保障等级完全上了一个台阶。监管在金融行业对这类架构也有明确的要求导向,所以银行、券商、支付机构的同城双活项目这几年是实打实在建的。
那网工在里面干什么?很多人以为双活是存储和应用层的事,其实网络层是整个架构的地基,活儿一点不少。拆开看:一是双中心的互联网络,两个机房之间要跑大带宽低时延的专线或者裸光纤,时延指标直接决定哪些业务能双活;二是数据中心内部的网络架构,Spine-Leaf、VXLAN这些技术在双活场景里是标配,服务器要能跨机房迁移,二层网络要能跨机房拉通,EVPN做控制面,这些正是H3CIE级别考纲里的核心内容;三是流量调度和健康检测,DNS、负载均衡、路由策略联动,故障时把用户流量导到活的那一侧;四是安全域的镜像建设,两侧的策略要一致,防火墙、负载设备的会话同步都要考虑。这四块里除了DNS偏应用,其余全是网工的主场。
这个方向的机会有多大?同城双活不是一次性工程,而是持续性运营。建完之后的日常巡检、切换演练、扩容调整、故障复盘,都需要懂这套架构的工程师守着。金融行业尤其讲究演练常态化,一年几次的真切换演练,每次都是网络团队的硬仗。也就是说,一旦你进入这个领域,经验的稀缺性会随时间累积,因为全国真正把双活玩明白的团队就那么多,圈子小,好苗子互相都盯着。

怎么往这个方向靠?给三条路。路径一,在集成商或者厂商里主动申请金融行业的项目组,哪怕是去做割接的值守和文档,先进项目再谈深入。路径二,在甲方数据中心团队的话,推动内部做高可用改造的调研,把双活的学习材料啃下来,机会来了你就是接得住的人。路径三,技术储备要跟上,VXLAN、EVPN、M-LAG、路由联动这些内容,光看文档不入门,得搭环境练。H3C的IE课程里对这些有系统的实验训练,像润天教育这类机构的真机实验环境,能让学员把双活里用到的关键技术在实验室里先跑通一遍,到了项目现场不至于两眼一抹黑。
也要提醒一句:双活项目周期长、环节多、责任重,割接窗口都在深夜,上线前的那种压力不是每个人都受得了。但反过来讲,网络行业里能让人快速拉开差距的,恰恰就是这类高复杂度的项目。守着常规园区网五年,和干过两个同城双活项目五年,在市场上的身价是两回事。看准了自己的承受力,再决定要不要跳进这个池子。