OS的load average很高

参考文档:

(KB432115) Oracle Linux: Multiple floppy_read_block_0 in D-State causes High Load Average

(KB424510) Oracle Linux: Continuously Increasing High Load Average on the Server.

(KB112591) Top Shows High Load Average

(KB398652) Abnormally High Load Average Numbers Observed On Exadata Server

在很多年前,看到过一个rac,节点1上的load average 在250左右,但是节点1的cpu使用率很低,也没有IO相关的负载。节点2的load average在4左右(当时百思不得其解)

今天看到一个exaddata的计算节点,是x11 。其中一个节点上load average已经快42亿了,另一个节点还不到5 。

在load average 42亿的节点上,看到%CPU使用率很低。部分信息如下

复制代码
top - 10:46:43 up 208 days, 47 min,  0 users,  load average: 4294967301.72, 4294967301.29, 4294967300.87
Tasks: 5139 total,   8 running, 5131 sleeping,   0 stopped,   0 zombie
%Cpu(s): 15.9 us, 10.0 sy,  0.1 ni, 73.1 id,  0.0 wa,  0.3 hi,  0.6 si,  0.0 st
MiB Mem : 778927.1 total, 113914.6 free, 504902.9 used, 160109.5 buff/cache
MiB Swap:  16384.0 total,  16375.2 free,      8.8 used. 250068.2 avail Mem 

通过以下命令,查看了下,确实有个进程状态的D.

复制代码
ps -aux | awk '$8 == "D" {print $0}'

这个进程状态为D的进程为exawatcher.

这个问题,到此得到了解释。

关于(KB398652) Abnormally High Load Average Numbers Observed On Exadata Server这个文档。里面的load average 和今天发现的是一样的(至少前面的42亿多,是一样的)。不过这个文档中提到没有D进程,而且这个文档说的是exadata storage,也就是cell节点。不过今天的是计算节点。

END

相关推荐
mlidongfeng9 分钟前
[AI][昇腾950]TA 学习
数据库·学习
bestsun99917 分钟前
rac集群环境下配置JDBC
数据库
java_logo1 小时前
Docker 部署 FalkorDB:轻松搭建属性图数据库与知识图谱平台
数据库·docker·知识图谱·falkordb·轩辕镜像·falkordb部署教程·falkordb部署文档
小白说大模型1 小时前
Spring AI 框架中集成 MCP 的完整指南:从服务端到客户端的全流程实践
大数据·数据库·人工智能·安全·spring·chatgpt·开源
计算机魔术师1 小时前
第二届世界人形机器人运动会开幕:2056 台机器人齐聚“冰丝带“,666 支队伍竞技 51 赛项
数据库·人工智能·机器人
@insist1231 小时前
系统集成项目管理工程师-配置管理角色与活动
数据库·软考·系统集成项目管理工程师·软考中项·软件水平考试
巨大八爪鱼2 小时前
XP系统运行IoTDB 2.0.10数据库服务器
数据库·iotdb·xp
卓怡学长2 小时前
w181springboot机场乘客服务系统
java·数据库·spring boot·spring·intellij-idea
阮胜昌2 小时前
MySQL 9.7.0 LTS 现已发布:扩展了社区功能,并为企业级应用增加了动态数据脱敏功能
数据库·mysql