故障切换

ly76897 天前
java·数据库·redis·主从复制·故障切换·psync
Redis 主从复制全解析:从 PSYNC 协议到复制积压缓冲区的故障切换边界假设你负责一个电商秒杀系统,Redis 采用一主两从部署:主节点 M 处理所有写请求,从节点 S1、S2 通过复制保持数据一致。某个大促凌晨,M 所在机器宕机,Sentinel 在几秒内把 S1 提升为新主。运维在监控上看复制延迟只有 50ms,理论上最多丢 50ms 的数据。但业务核查时发现,某件商品的库存扣减记录丢失了近 3 秒的写入量——用户付款成功,库存却没扣。
hey you~2 个月前
架构·故障切换·多活架构·呼叫中心高可用·全链路自研·通信paas
呼叫中心系统全链路自研架构:如何实现99.999%通话高可用摘要:99.999%可用性意味着全年故障时间不超过5.26分钟。对于承载企业核心客户触点的呼叫中心系统,这个数字不是“技术参数”而是“业务生命线”——一通丢失的来电可能就是一个流失的客户。本文基于中国信通院、Gartner 2025-2026年行业数据,从全链路自研的架构视角,拆解呼叫中心高可用设计的四个核心层:接入层冗余、传输层容灾、应用层弹性、数据层一致性。涵盖故障域隔离、多活架构、自动故障切换、混沌工程验证等关键工程实践,并给出可落地的可用性度量与验证体系。
想你依然心痛3 个月前
看门狗·心跳检测·故障切换·降级策略·容错架构·自愈机制·冗余设计
嵌入式系统的容错架构——降级策略与自愈机制设计人的一切烦恼都来自贪婪,尤其是对外求的欲壑难填。 希望外界符合自己的期待:别人应该理解我、事情应该顺利、我应该被认可……一旦现实不符,烦恼就升起。欲望本身不是问题,问题是对“结果必须如我所愿”的执念。当你能分辨“需要”和“想要”,烦恼会少一大半。
码字的字节1 年前
hdfs高可用性·元数据同步·故障切换
深入解析Hadoop HDFS高可用性:原理、故障切换与元数据同步在分布式存储领域,Hadoop分布式文件系统(HDFS)作为Hadoop生态系统的核心存储组件,其高可用性(HA)设计一直是架构师们关注的焦点。传统HDFS架构中,NameNode作为单一主节点管理整个文件系统的元数据,这种设计虽然简单高效,却存在明显的单点故障风险——一旦NameNode宕机,整个集群将陷入瘫痪状态。
我是有底线的