1.有节点宕机,通过多个provider集群+注册中心,可在运行期保证服务整体可用 2.有节点偶尔异常,但是没有宕机,通过重试+负载均衡重新选择节点 3.有节点在一段时间内异常(这个实例上有很多服务,其中个别服务比如说)、没宕机甚至其它服务甚至是好使的 重试也可能还是调用坏的节点,因此进行故障隔离,把故障节点识别出来,隔离
- 探活好了,故障恢复,full open
- 每次探活放一笔流量进来,half open
灰度发布与常规发布: 1.常规发布是滚动发布,能直接打到的 2.蓝绿发布是使用集群分流,消除服务在停机和部署升级时的风险
- 两个集群 蓝集群和绿集群
- 绿集群是老版本,版本升级成蓝集群,先不可用,测试验证完,再把流量打到蓝集群
- 灰度发布最关键的是流量调拨