部署自动化的重要性之骑士资本案例研读

骑士资本(Knight Capital)是一家证券交易所的金融服务公司,也是美国市场上最大的交易商之一。其在纽约证券交易所的市场份额为 17.3%,在纳斯达克的市场份额为 16.9%。

该公司有一项零售流动性计划,打算用新的 RLP 代码替换旧的 SMARS 代码。他们的策略是重新利用一个用于开启和关闭代码运行的标记。旧代码是一个留在服务器上的 "动力管道挂钩"(power pipe peg)。他们计划先升级代码,切换标记,然后开始运行新代码。那么,这过程中会出什么岔子呢?

2012 年 8 月 1 日,他们手动升级了八台服务器中的七台。一名系统管理员完成了其中七台的升级,却忘了升级第八台服务器。他们进入测试模式,在切换开关时还以为自己是在测试服务器。然而,第八台服务器却在真实网络上进行了真实交易,导致 6.4 亿美元的损失。

这一事件严重扰乱了纽约证券交易所上市的 148 家公司的股价。收到的主订单被处理,有缺陷的 "动力管道挂钩" 发出了数百万条子订单,在大约 45 分钟内促成了 154 只股票、超过 3.97 亿股的 400 万笔交易。第二天,骑士资本就破产倒闭了,原因就是有人没升级那第八台服务器。旧代码运行起来,进行了本不该有的交易。

他们原本可以采取什么不同做法来避免这类错误呢?

这个案例很好地说明了,采用持续交付(Continuous Delivery)实现部署自动化,原本可以避免出现某一台服务器配置与其他服务器不同的情况。没有自动化,每次部署都可能出现人为失误,还可能导致应用程序出现故障。针对测试环境、预发布环境和生产模拟环境进行自动化部署和测试,原本可以确保此次代码变更不会引发这场灾难。

相关推荐
乘云数字DATABUFF3 天前
5分钟部署开源APM Databuff:OpenTelemetry全链路追踪入门实战
运维·后端
荣--5 天前
一键部署不是为了省时间 —— 它是把"买来的 PaaS"变成"自己的平台"的拐点
运维·zabbix·工程化·一键部署·平台化·边界设计
江华森5 天前
动手实战学 Docker — 从零到集群编排完全指南
运维
Avan_菜菜5 天前
FRP 内网穿透完整实战:从 HTTP 映射到 HTTPS 自签代理
运维·nginx·https
SelectDB6 天前
Litefuse 开源并推出单进程轻量模式,25 秒就能跑起来的 Agent 可观测与评估平台
运维·后端·自动化运维
XIAOHEZIcode8 天前
Linux系统鼠标偏移常见原因以及修复方案
linux·运维·游戏
用户0328472220708 天前
如何搭建本地yum源(上)
运维
大树8811 天前
金刚石散热越强,管路越先见顶
大数据·运维·服务器·人工智能·ai
摇滚侠11 天前
Linux CentOS7 rpm 安装 MySQL 5.7
linux·运维·mysql
霸道流氓气质11 天前
领域驱动设计(DDD)在 Spring Boot 微服务中的实践指南
运维·spring boot·微服务