prometheus

爱琴孩8 小时前
prometheus·wal
记一次Prometheus的WAL异常,导致服务器磁盘占用过高国庆假期期间,群里有开发联调环境服务器监控告警,具体信息如下登录到服务器之后,发现prometheus目目录下面有很多WAL文件
Cheney Pan1 天前
prometheus
第12篇 Prometheus 高可用与长期存储前面篇章都是基于单机 Prometheus ,已能满足中小企业的基本需求。但针对一些重要业务系统,或把监控数据作为重要数字资产的企业,单机 Prometheus 将存在重大风险。
飞鸟真人2 天前
prometheus·apm·open telemetry·openmetrics
应用性能监测(APM)之 (五)Prometheus与OpenMetrics协议OpenMetrics 是指标暴露文本协议规范,从 Prometheus 原始文本格式进化而来,目标是统一云原生指标的线上传输标准,脱离 Prometheus 本身,做到客户端、采集器无关。
Cheney Pan2 天前
安全·prometheus
第13篇 监控安全与权限治理前面把监控体系从「能采集」一路做到了「能看、能告警、能出报告、还能高可用长期存」。但是:系统本身几乎是敞开的。
蓝胖的四次元口袋4 天前
grafana·prometheus
Prometheus+Grafana知识梳理(2)作者:没有四次元口袋的蓝胖 日期:2026-10-1 标签:Grafana, 监控体系Prometheus 自带一个简陋的 Web UI(http://localhost:9090),只适合调试 PromQL 表达式。真正的生产环境可视化全靠 Grafana——一个开源的数据可视化平台,支持多种数据源,通过 Dashboard 面板将时序数据变成直观可读的图表。
Cheney Pan4 天前
prometheus
第8篇 关键指标分析方法:RED/USE 与黄金信号前面详细介绍了各层涉及的指标:主机层 50 多个 Collector、应用层十来个指标族、接入层 8 个原生指标、依赖层 5 类 Prober。
Cheney Pan5 天前
prometheus·exporter
第7篇 业务数据监控:SQL Exporter 与自定义业务指标业务数据躺在关系型数据库里,Prometheus 拉不到它,中间必须有人做翻译。而这一层该不该独立部署、该不该在抓取时查库,决定了它是"监控"还是"事故源"。
Cheney Pan6 天前
jvm·spring boot·后端·prometheus
第4篇 Spring Boot 应用监控:Micrometer 与 JVM 指标在企业级应用的技术选型中,Spring Boot 已稳居主流架构之列。微服务拆分与容器化部署的大规模落地,带来了服务实例数量与调用链路的指数级增长,也带来了一个无法回避的工程命题——如何洞察运行时的真实状态。JVM 的堆内存波动、GC 停顿、线程阻塞,任何一项指标的异常都可能演变为线上故障。可观测性不再是锦上添花,而是生产环境的刚性需求。Micrometer 作为 Spring Boot 默认的指标门面,与 Actuator 配合,将 JVM 及业务指标以标准化格式暴露给 Prometheus 等监控系统
飞鸟真人6 天前
prometheus
应用性能监测(APM)之 (四)Prometheus与Metrics集群存储目录一、时序数据库1. Prometheus生态时序库(监控指标专用)2. 通用时序数据库3. 时序库的特点
Cheney Pan6 天前
prometheus
第09篇 告警体系设计:Alertmanager 路由与告警治理上一篇把该看的指标收敛到了十条以内,规则也按 RED / USE / 黄金信号归好了类。但规则配完只算走完一半,响不响、响几条、响给谁、多久响一次,全在 Alertmanager 这一层。
蓝胖的四次元口袋7 天前
grafana·prometheus
Prometheus+Grafana知识梳理(1)作者:没有四次元口袋的蓝胖 日期:2026-09-30 标签:Prometheus, 监控体系监控系统是后端架构中不可或缺的一环。在微服务时代,没有监控就等于裸奔——服务挂了不知道、性能瓶颈找不到、容量规划靠猜。Prometheus 是目前最主流的开源监控方案,几乎所有中大型公司都在用,也是 Kubernetes 生态的标配监控组件。
晨陌y7 天前
mysql·centos·prometheus
CentOS 7 部署 mysqld_exporter:MySQL 指标采集、Prometheus 告警与远程监控Prometheus 可以通过 Exporter 获取业务组件的内部状态,而 MySQL 并不会直接提供符合 Prometheus 采集格式的全部指标。mysqld_exporter 的作用,是连接数据库读取相应状态,再通过 HTTP /metrics 暴露数据供监控中心抓取。部署时需要明确三段链路:Exporter 能否使用监控账号登录 MySQL,Prometheus 能否访问 Exporter 监听端口,告警规则是否基于实际存在的指标正确评估。任何一段出错,都可能导致界面中有目标却没有有效数据库指标
倔强的小石头_8 天前
数据库·ubuntu·prometheus
Ubuntu部署Prometheus与Alertmanager:systemd配置、告警对接及cpolar远程访问在 Prometheus 监控体系中,采集到指标只是第一步。能否把连续异常转成有意义的告警,再将不同级别的消息交给对应人员,才决定了系统有没有形成完整的告警处理链路。若只在监控界面看到曲线,却缺少规则评估和通知路由,服务出问题时仍然需要人工守着页面;若没有等待时间、分组和重复通知控制,短暂波动又可能制造大量噪音。
打工仔折腾 AI8 天前
后端·python·docker·容器·性能优化·prometheus·ai agent 实战
Prometheus接入Pushgateway实战:二进制与Docker部署、指标推送与远程写入Prometheus 的核心采集模型是 pull:它按 scrape_interval 周期性地去各个 target 的 /metrics 拉数据。这个模型对长期运行的服务很合适,但对另一类任务就不太友好——那些跑几秒、几十秒就结束的进程。
Elastic 中国社区官方博客9 天前
大数据·数据库·spring boot·elasticsearch·搜索引擎·全文检索·prometheus
两个依赖和一个配置块:通过 Prometheus 远程写入将 Spring Boot 指标发送到 Elasticsearch作者:来自 Elastic Christoph HegerPrometheus 远程写入会将 Micrometer 的 Actuator 指标转发到 Elasticsearch 时序数据流中。JVM 堆、请求延迟、GC 暂停时间和 HikariCP 活动都可以通过 ES|QL 进行查询,而且无需在其旁边运行任何新的组件。
User_芊芊君子9 天前
docker·容器·prometheus
Prometheus接入Pushgateway实战:二进制与Docker部署、指标推送及远程上报Prometheus 默认采用 Pull 模型:它按采集周期访问目标的 /metrics 端点。这对 Web 服务、数据库等长期运行的进程非常合适,但在批处理监控中会碰到时间差。备份脚本执行完就退出,CI/CD 作业可能只运行几分钟;假如进程在两次抓取之间启动又结束,Prometheus 就未必能采到这次任务的执行结果。
lbb 小魔仙16 天前
数据库·人工智能·redis·oracle·prometheus
OpenClaw + cpolar 实战:远程 NAS、分享小游戏、RDP,再配置公网 AI 入口OpenClaw 真正部署成功以后,我反而觉得最容易卡住的不是安装,而是“接下来到底拿它做什么”。只在本机对话当然能用,但如果它还能帮我把家里的 NAS 服务临时开放到外网、写一个小游戏后直接分享、给 Windows 远程桌面建立连接,甚至把 OpenClaw 自己也变成一个可以从手机打开的 Web 入口,那它才开始从“装好了”变成“真的进入日常使用”。不过这种玩法越往外延伸,越不能只盯着“一句话完成”这几个字:本地服务、cpolar 隧道、OpenClaw 网关、Origin 白名单、Token 和设备
zhoupenghui16816 天前
prometheus·pprof
Golang pprof 工具详解:监控、压测与调优实战指南pprof 是 Go 语言官方提供的性能分析与调优工具集,它通过采样(Sampling)的方式收集程序运行时的各类指标,其核心原理是基于 pprof 协议,通过 HTTP 端点暴露运行时的性能数据,开发者可以使用 go tool pprof 命令行工具或配合火焰图(FlameGraph)进行可视化分析,pprof 支持多种维度的性能分析,包括 CPU 热点、内存分配、Goroutine 泄漏、锁争用以及阻塞分析,是 Go 开发者排查线上问题、进行性能调优的必备利器
ggaofeng18 天前
prometheus
prometheus时序数据库时序数据库理论部分,参考时序数据库_vm时序数据库-CSDN博客时序数据库一般采取拉的方式,在配置文件中配置每个采集任务的url地址,采集周期,然后周期到每个采集节点去http get数据。
A心有千千结22 天前
nginx·prometheus·devops
Nginx网关可观测建设:打通流量入口,加速线上故障诊断Nginx 通常守在业务系统最前面,反向代理、负载均衡、TLS 卸载、缓存和限流这些活儿,很多都要经过它。用户访问慢了、接口报错了,或者后端服务不可用了,请求往往也都会先经过 Nginx。