心里苦,了解业界常见服务发布手段~

前言

最近上线需求,服务发布成功后,不一会,告警群就开始滴滴滴,我一看,擦 空指针了,赶紧根据堆栈以及error日志定位到问题代码的行数,根据代码调用上下文迅速判断出出现空指针场景,提了个fix上线,让leader审批下,然后就被批斗怎么每次都出bug......

哎,虽然在测试环境一切正常,但总有测不到的场景,一上线,问题就暴露出来了,而且不同于绝大多数公司存在单点部署,滚动升级的策略,我们发布就是 一把梭哈,出事了就回滚或者赶紧修

借这个坏心情,整理一下业界常见的服务上线发布方式及流程~


服务发布方式

梭哈

目前我们的服务部署了5台机器

  1. 再起同等数量的机器,部署新的代码
  2. 都起来了之后,将流量全切到新机器上
  3. 下线旧机器

称这种方式为梭哈 毫不过分,即使发现告警后及时进行回滚,回滚也需要一定时间,错误代码承接了全部流量,纯纯的风险最大化的操作。


单点部署、滚动升级

目前我们的服务部署了10台机器

  1. 选择一台机器进行部署
  2. 单点部署完毕后,进入容器内部观察一段时间日志,是否存在error日志(如果流量较少不好观察,可以再选择一台或多台机器进行部署,具体是业务场景而定)
  3. 观察一段时间后,如果不存在error日志,代码运行正常,此时可选择滚动升级
  4. 选择每个滚动升级的数量,比如选择3,则每次滚动升级三台机器,直至全部升级完毕

通过上述发布流程,我们可以看到一个字: 经过一段时间的单点部署、日志观察,我们能够及时的发现代码问题,将事故最小化


蓝绿发布

目前我们的服务部署了10台机器

  1. 再起同等数量的机器,部署新的代码
  2. 进行流量控制,逐步将流量切换到新机器上,直至100%
  3. 此时,新旧机器并行存在 ,当然,流量切换期间如果出现任何异常直接将流量再切换到旧机器上,保证服务的稳定性
  4. 流量切换完毕后,新旧机器同时存在,此时再验证一段时间,如果没问题的话再下掉旧机器

蓝绿发布 存在与梭哈 相似之处,都是新起同等数量的机器 ,不过在之后的流量切换上做了稳妥机制,采用逐步切流的方式,来减小可能的事故影响

最后在流量切换完毕后,不会尽快下掉旧机器,新旧机器会并行存在一段时间,避免可能因为业务场景流量小不能够及时暴露问题,等流量全切后才暴露出来

此时,由于旧机器还存在,回滚只需要切流量即可~


灰度发布(金丝雀发布)

目前我们的服务部署了10台机器

  1. 再起小部分机器,比如一两台,形成灰度集群,部署新代码
  2. 引入小部分流量到灰度集群上去进行验证
  3. 验证失败,则将所有流量切回旧机器
  4. 验证成功,即可进行全量发布

灰度发布过程中引入了小部分流量进行验证,能够尽快发现问题,不过灰度发布一般容量有限,只会使用少部分机器,这样的话小流量情况下有些问题是无法暴露的,也算是一种缺点~


结尾

本文整理了业界一些常见服务发布方式及其流程,没有原理干货,hh,敬请谅解~

参考: 有赞灰度发布与蓝绿发布实践

相关推荐
mldong1 小时前
给若依加审批流,不用 Flowable
java·spring boot·架构
考虑考虑3 小时前
数据库中的EXISTS
运维·数据库·后端
Wang's Blog3 小时前
Java框架快速入门: Spring Security+OAuth2之数据库和实体类的RBAC改造
java·数据库·spring
讳疾忌医丶3 小时前
深度拆解 RocksDB 内核:基于 C++17 的 FIFO 调度状态机与温度阶梯自愈设计
java·c++·算法·架构
郑州光合科技余经理4 小时前
国际版外卖系统:税率字段怎么和订单主流程解耦
android·java·开发语言·前端·后端·php·ai编程
毅炼4 小时前
Rover-Suite 开源发布:轻量服务注册中心与网关一体化方案
java·后端·系统架构·gateway
梦想平凡4 小时前
百游棋牌源代码开发搭建教程(十):隔离部署、备份恢复与双端验收
java·前端·javascript·数据库·源代码管理
天远数科5 小时前
零信任架构实战:基于天远全能消金报告构建自动化信贷评估网关
运维·人工智能·架构·自动化
sunshine22 girl6 小时前
Idea中如何搜索
java·ide·intellij-idea
猫吻鱼6 小时前
【AI 01】【Spring AI 基础使用】
java·spring·spring ai