知识卡片
分布式路由消除中心节点单点故障
内容
早期架构里所有虚拟机的三层路由请求都要经过一个集中的网络节点转发,这个节点一旦故障,会导致该数据中心内所有跨网络流量瞬间中断,是典型的单点故障。把路由能力下放到每台计算主机上、让每个虚拟机直接由本机路由器转发流量后,单个计算节点故障的影响范围就被收窄到只影响这台机器上的实例,不再波及全局。发散:这是一个可复用的容错设计模式——当发现某个中心化组件的故障会造成大范围连锁影响时,优先考虑的不是给这个中心组件做冗余,而是问能不能把它的职责下放、分散到本来就已经存在多份的节点上,从根本上缩小故障半径而不是事后补救。
参考来源
《OpenStack云计算实战手册 第3版》第3章《Neutron——OpenStack网络服务》