集群

程序员大阳18 天前
大数据·集群·nat·网路
副队长大数据教程(5)--集群情况下虚拟机网络配置搭建 Hadoop 完全分布式集群,网络是最基础也最容易踩坑的前置环节。很多初学者上来直接选用桥接模式,后续频繁遇到 IP 变动、IP 冲突、集群通信异常等问题。
Sun 328520 天前
数据库·opengauss·集群·节点角色·磐维数据库·运行状态
读懂集中式主备的集群状态与节点角色查看数据库状态时,经常会遇到 Primary、Standby、Normal、Pending 等名称。它们看起来都在描述“状态”,实际回答的却是不同问题。
七夜zippoe1 个月前
数据库·wpf·集群·常见问题·故障排查·dolphindb
DolphinDB 故障排查实战:系统、数据库与集群常见问题诊断摘要:本文面向 DolphinDB 运维与开发人员,系统讲解系统层、数据库层、集群层三类常见故障的诊断方法与解决思路。文章基于 DolphinDB 2.0.x 版本,通过 5 组可复用的诊断脚本、3 类 Mermaid 图解和 3 张配图,帮助读者建立"现象→定位→根因→验证"的完整排查链路。读完本文,你将能独立处理启动失败、内存过高、连接数打满、查询变慢、节点失联、数据同步延迟等高频问题,并掌握日志分析、性能监控与诊断报告生成的核心技巧,适合作为团队值班与故障复盘的参考手册。
七夜zippoe2 个月前
运维·集群·监控·告警·dolphindb·指标采集
DolphinDB 2.x 集群监控运维平台实战:从指标采集到告警自愈摘要:本文面向需要为 DolphinDB 集群搭建监控平台的运维与研发工程师,基于 DolphinDB 2.x 单机与集群环境,系统讲解集群监控的核心概念、指标采集、告警机制、可视化展示与性能分析。通过 5 个可直接运行的 DolphinDB 脚本片段,展示如何采集系统/数据库/集群三层指标、设计告警规则并实现通知与自动修复、搭建可视化面板与性能基线。文章还给出最小可用监控平台的初始化流程、版本差异提示与落地边界,帮助读者在测试环境跑通后,再平滑推广到生产。
七夜zippoe2 个月前
agent·集群·lot·轻量级·边缘部署·openclaw
OpenClaw 边缘部署实战:IoT 场景下的轻量级 Agent 集群与离线自治摘要:工业 IoT 场景长期面临网络不稳定、边缘算力有限、数据需本地处理三大痛点,传统云端 Agent 架构在此环境下频繁掉线、响应延迟、数据外泄风险高。本文以 OpenClaw v2.8+ 为基座,系统阐述如何通过 Node 机制将 Agent 集群下沉至边缘节点,实现轻量级部署、离线自治、断网续传与数据本地闭环。文章对比云端、边缘、混合三种部署模式,给出边缘节点配置、离线 Skill 定义、数据同步管理代码,并通过 Mermaid 架构图、状态机图和时序图呈现核心机制,最后补充适用边界、故障排查与替代
七夜zippoe2 个月前
分布式·集群·dolphindb·节点配置·高可用部署
基于 DolphinDB 构建分布式集群:从节点配置到高可用部署的完整实践摘要:本文面向运维工程师和平台架构师,讲解如何基于 DolphinDB 2.x 构建生产级分布式集群。从核心概念出发,拆解四类节点角色、三种集群拓扑、DFS 分布式存储与副本管理、MapReduce 并行计算及 Controller 高可用机制。提供 5 段可运行脚本(集群初始化、DFS 建库建表、数据均衡检查、并行聚合计算、监控告警整合),配合 3 类 Mermaid 图与 3 张架构占位图。所有代码经本地验证可执行,帮助读者在一天内搭建端到端的分布式数据底座。
数据库小学妹2 个月前
分布式·分布式数据库·数据库架构·集群·分库分表·主从集群·集群与分布式
集群与分布式啥区别?从主从集群到分布式实战大家好,我是数据库小学妹 👋我踩过的坑,你别再踩。朋友小林做社区团购,他的订单库从一台破服务器,一路升级到分布式,整整用了三年。三年里,同一个问题他问了我三次:“集群与分布式,现在要不要上?”
刘某的Cloud2 个月前
linux·运维·数据库·负载均衡·mariadb·集群·高可用
Galera Cluster部署 mariadb 节点down机,log sequence number恢复假设你有一个 3 节点的 MariaDB Galera Cluster(Node1: 192.168.31.185、Node2: 192.168.31.186、Node3: 192.168.31.187),由于机房断电、硬件故障或内核崩溃等原因,所有节点同时异常宕机,没有经过正常的 systemctl stop mariadb 流程。
吴声子夜歌3 个月前
java·数据库·redis·集群
Redis 3.x——集群故障转移当集群内某个节点出现问题时,需要通过一种健壮的方式保证识别出节点是否发生了故障。Redis集群内节点通过ping/pong消息实现节点通信,消息不但可以传播节点槽信息,还可以传播其他状态如:主从状态、节点故障等。因此故障发现也是通过消息传播机制实现的,主要环节包括:主观下线(pfail)和客观下线(fail)。
吴声子夜歌3 个月前
redis·缓存·集群
Redis 3.x——集群节点通信在分布式存储中需要提供维护节点元数据信息的机制,所谓元数据是指:节点负责哪些数据,是否出现故障等状态信息。常见的元数据维护方式分为:集中式和P2P方式。Redis集群采用P2P的Gossip(流言)协议,Gossip协议工作原理就是节点彼此不断通信交换信息,一段时间后所有的节点都会知道集群完整的信息,这种方式类似流言传播,如图所示。
何中应3 个月前
数据库·postgresql·集群·开发工具
Postgres 搭建主从集群本文介绍如何搭建 Postgres 主从集群,操作系统为 CentOS7,数据库版本是 postgresql-15
无小道3 个月前
redis·集群
Redis——集群主从结构解决的是可用性和并发量的问题,集群解决的是内存容量不足的问题,简单来讲,就是把所有数据分成几个部分分别存放在集群中的不同分片上。示意图如下:
AOwhisky3 个月前
笔记·云原生·kubernetes·云计算·k8s·集群·网络策略
kubernetes(K8s)学习笔记:第八期与第九期核心知识点自测与详解本自测解析针对 Kubernetes 系列第八期(集群治理与控制(上篇):网络策略——NetworkPolicy)和第九期(集群治理与控制(下篇):调度与节点管理——Scheduler + 污点容忍 + 节点维护)的核心内容。共 10 题,每题包含题目回顾、考查知识点、详细解答与分析,帮助读者巩固 Kubernetes 网络策略与调度管理的核心技能。
小小工匠4 个月前
redis·性能优化·集群·并发
Redis - 如何使用 Redis 实现分布式锁在分布式系统里,多个进程需要协调访问共享资源时,分布式锁几乎是绕不开的工具。Redis 因为性能好、部署简单、命令丰富,成为实现分布式锁的最常见选择。但简单不等于容易——一把"看起来能用"的 Redis 分布式锁,真正用到生产环境,常常因为细节问题踩坑。
小小工匠4 个月前
redis·性能优化·集群·内存管理·持久化
Redis - 缓冲区管理:避免溢出引发的“惨案“缓冲区是Redis中一个看似简单却极易引发严重问题的机制。它的职责是暂存命令数据,弥补发送方和接收方之间的速度差异。但如果管理不当,缓冲区溢出会导致客户端连接被强制关闭、数据丢失、甚至Redis实例崩溃。
小小工匠4 个月前
数据结构·redis·性能优化·集群·持久化
Redis - 异步机制与阻塞规避:Redis 单线程模型的生存之道Redis 的高性能建立在单线程模型之上:主线程负责网络 IO 和所有键值对的读写操作。这个设计避免了多线程的锁竞争和上下文切换开销,但也意味着任何一个耗时操作都会直接阻塞整个实例,所有客户端的请求都得排队等着。
WAIT_TIME4 个月前
mysql·docker·集群·innodb cluster
基于 Docker 快速构建 MySQL InnoDB Cluster 高可用集群与 Router 读写分离三台服务器 的相同路径下(如 /data/mysql-cluster)建立如下结构:结构如下:常用排错命令
爱莉希雅&&&5 个月前
linux·redis·缓存·集群·哨兵·数据库同步
Redis哨兵模式和主从复制和集群模式搭建与扩容缩容三大架构是递进关系:主从复制(基础:读写分离 / 数据备份)→ 哨兵模式(高可用:自动故障转移)→ 集群模式(分布式:分片 / 扩容 / 高可用)
何中应5 个月前
nacos·集群·高可用
Nacos集群搭建本文如何搭建 Nacos 集群服务器清单服务器环境示意:部署版本Docker环境镜像导入在三台服务器上分别执行: