网传滴滴系统崩了,是因为k8s版本升级错误?

11月27日晚间,滴滴因系统故障导致App服务异常登上热搜,不仅无法显示定位、无法打车,有司机的后台还显示收入超690亿。28日和29日,滴滴两次发文致歉,称初步确定事故起因是底层系统软件发生故障。

相较于一些网友戏谑的"滴滴减'猿'增效14%员工导致系统崩溃",网传的"K8S版本升级错误,控制节点挂了,SRE工程师花了三个小时都未能解决"可能是滴滴系统大规模长时间故障的主要原因。一位业内专业人士指出,互联网公司核心业务频繁宕机,且宕机时间较长,往往是成本降低和效率提升的副作用之一。如果系统投资不足、维护资源有限,程序员更替频繁,就容易导致程序漏洞增多。

根据滴滴最近六个季度公开的收入与费用数据显示,如果以70-80万的研发人均薪酬成本为基准,2023年滴滴研发人员的减少约为1200-1400人。因此,除了技术问题之外,滴滴系统此次崩溃可能还受到研发费用投入不足和技术人员不断减少等因素的影响。

相关推荐
Henry-SAP3 小时前
SAP S/4HANA引领物流ERP新生态
人工智能·云原生·sap·erp
这个DBA有点耶3 小时前
从DBA到数据架构师(五):数据架构演进中的技术债务管理
数据库·程序人生·云原生·架构·dba·数据库管理员
猫吃了源码5 小时前
k9s简介和安装
linux·docker·kubernetes
云原生指北6 小时前
Docker Sandboxes 上手:从安装到第一次跑 Agent
运维·docker·容器
霸道流氓气质7 小时前
微服务架构中多实例消息抢占问题:技术解析与解决方案
微服务·云原生·架构
heimeiyingwang8 小时前
【架构实战】Kubernetes故障排查全景图:从Pod异常到集群雪崩的诊断手册
容器·架构·kubernetes
骇客野人8 小时前
Docker Compose 部署多个独立 Jar 服务完整实操步骤
docker·容器·jar
AAA@峥9 小时前
K8s 资源管控:ResourceQuota 与 LimitRange 机制详解与实战
云原生·容器·kubernetes
daoihfoaf9 小时前
太原助听器品质甄选
容器
秦渝兴10 小时前
Ansible 自动化部署 K8s 三节点集群(完整教程)
kubernetes·自动化·ansible