Prometheus相关的主机监控指标

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

一、CPU监控

  • CPU负载指标

node_load1

node_load5

node_load15

以上三个指标为主机CPU平均负载,分别对应一分钟、五分钟和十五分钟的时间间隔。CPU负载是指某段时间内占用CPU时间的进程和等待CPU时间的进程数之和。一般来说,cpu负载数/cpu核数如果超过0.7,应该开始关注机器性能情况 ,如果超过1的话,运维人员应该介入处理。

  • CPU使用率

node_cpu_seconds_total

该指标包括了多个标签,分别标记每种处理模式使用的CPU时间,该指标为counter类型。这个指标不适合直接拿来使用,可通过前面学习的PromQL,将其转化成CPU使用率的指标

mode="idle"代表CPU 的空闲时间,所以我们只需要算出空闲的时间占比,再以总数减去该值 ,便可知道CPU的使用率,此处使用irate方法。由于现有的服务器一般为多核,所以加上avg求出所有cpu的平均值,才是CPU的使用率情况 。

例:100 -avg(irate(node_cpu_seconds_total{mode="idle"}[5m])) by (instance)* 100

二、内存监控

  • 物理内存使用率

对于内存,我们一般会关注内存的使用率,但node-exporter并不直接进行计算,我们需要根据node-exporet返回的内存指标自己写计算公式:

例:

node_memory_MemTotal_bytes #总内存大小

node_memory_MemFree_bytes #空闲内存大小

node_memory_Buffers_bytes #缓冲缓存大小

node_memory_Cached_bytes #页面缓存大小

计算的公式为:(总内存 -(空闲内存 + 缓冲缓存 + 页面缓存))/ 总内存 * 100

(node_memory_MemTotal_bytes - (node_memory_MemFree_bytes + node_memory_Buffers_bytes+node_memory_Cached_bytes ))/node_memory_MemTotal_bytes * 100

  • swap内存使用率

Swap为交换内存分区,它使用磁盘上的部分空间来充当服务器内存,当系统物理内存吃紧时,Linux 会将内存中不常访问的数据保存到 swap 上,这样系统就有更多的物理内存为各个进程服务。而当系统需要访问 swap 上存储的内容时,再将 swap 上的数据加载到内存中,这就是常说的换出和换入。交换空间可以在一定程度上缓解内存不足的情况,但是它需要读写磁盘数据,所以性能不是很高。

例:

node_memory_SwapTotal_bytes #swap内存总大小

node_memory_SwapFree_bytes #swap空闲内存大小

计算的公式:

(node_memory_SwapTotal_bytes - node_memory_SwapFree_bytes)/node_memory_SwapTotal_bytes * 100

三、磁盘监控

  • 磁盘分区使用率

分区使用率的指标可以通过分区空间总容器和分区空闲容量计算出来

node_filesystem_size_bytes #分区空间总容量

node_filesystem_free_bytes # 分区空闲容量

由于主机一般会有多个分区 ,需要通过指标的标签mountpoint 进行区分 ,如 获取 / 分区磁盘使用率可使用公式:

(node_filesystem_size_bytes{mountpoint="/"} - node_filesystem_free_bytes{mountpoint="/"})/node_filesystem_size_bytes{mountpoint="/"} * 100

  • 磁盘吞吐量

node_disk_read_bytes_total #分区读总字节数

node_disk_written_bytes_total #分区写总字节数

指标分别对应了分区读写的总字节数,指标为counter类型。前面文章讲过,counter类型会不断的累加,该指标直接使用对于监控没有意义,但可通过下面公式转化为磁盘的每秒读写速率。device代表对应的磁盘分区。

irate(node_disk_read_bytes_total{device="vda"}[5m])

irate(node_disk_written_bytes_total{device="vda"}[5m])

  • 磁盘IOPS

IOPS表示每秒对磁盘的读写次数,它与吞吐量都是衡量磁盘的重要指标。对于IOPS的监控,可通过下面两个指标算得出

node_disk_reads_completed_total #分区读总次数

node_disk_writes_completed_total #分区写总次数

计算公式,使用我们熟悉的irate或rate函数来处理

irate(node_disk_reads_completed_total{device="vda"}[5m])

irate(node_disk_writes_completed_total{device="vda"}[5m])

四、网络监控

  • 网卡流量

网卡流量一般分为上传和下载流量,下面两个指标分别为总的字节数,可通过这两个指标计算出来网卡每秒流量

node_network_receive_bytes_total #下载流量总字节数

node_network_transmit_bytes_total #上传流量总字节数

计算公式如下,此处排除Loopback 网卡

irate(node_network_receive_bytes_total{device != "lo"}[1m]

  • 可用性监控

除了监控主机的性能参数外,我们还需要关注实例的可用性情况,比如是否关机、exporter是否正常运行等。在exporter返回的指标,有一个up指标,可用来实现这类监控需求。

up{job="node-exporter"}

主机监控是基础架构监控中较底层的一类,虽然基础但是非常重要,node-exporter自身还提供不少有用的指标,包括支持textfile的自定义指标。在生产环境中,需要根据实际情况进行调试。

博客可能不能及时回复问题,技术问题欢迎加入交流。

具有丰富的模板开发及项目落地、管理经验分享欢迎加入交流

微信号:king_songax

Prometheus 实践操作 -> 常用统计指标PQL 指标统计语句 阅读详情

相关推荐

Prometheus监控运维实战十: 主机监控指标

Swap为交换内存分区,它使用磁盘上的部分空间来充当服务器内存,当系统物理内存吃紧时,Linux 会将内存中不常访问的数据保存到 swap 上,这样系统就有更多的物理内存为各个进程服务。mode="idle"代表CPU 的空闲时间,所以我们只需要算出空闲的时间占比,再以总数减去该值 ,便可知道CPU的使用率,此处使用irate方法。前面文章讲过,counter型会不断的累加,该指标直接使用对于监控没有意义,但可通过下面公式转化为磁盘的每秒读写速率。对于IOPS的监控,可通过下面两个指标算得出。

青梅煮酒 5372

如何使用 Node Exporter 监控 Linux 上的磁盘 I/O

在 Linux 系统中,Node Exporter 是一款用于 Prometheus 监控系统的客户端软件,用于收集和导出系统的各种指标数据。其中包括了对磁盘 I/O 的监控,它能够提供有关磁盘读写操作的详细信息。本文将详细介绍如何使用 Node Exporter 监控 Linux 上的磁盘 I/O。

网络技术联盟站 869

Prometheus + Grafana 配置监控指标

根据您的需求,您可以创建自定义的仪表板来展示特定的监控指标。步骤如下:创建新仪表板在 Grafana 左侧导航栏,点击图标,选择Dashboard。点击。配置图表选择数据源:确保选择Prometheus。编写 PromQL 查询:根据您要展示的指标,编写 PromQL 查询。选择可视化型:选择GraphGaugeBar Gauge等适合的图表型。配置图表样式:调整图表名称、颜色、单位等,以便更好地展示数据。保存仪表板点击右上角的Save。

weixin_38428874的博客 1634

prometheus 监控公式

prometheus+node_exporter 监控服务器资源情况

qq_40414159的博客 2224

Prometheus中cpu相关指标

Prometheus中有很多关于CPU的指标,其中一些常见的指标包括: node_cpu_seconds_total: 每个CPU核心在某个时间间隔内所有状态下的时间之和. node_cpu_seconds_user: 每个CPU核心在用户状态下的时间之和. node_cpu_seconds_system: 每个CPU核心在系统状态下的时间之和. node_cpu_seconds_idle: 每...

weixin_35749545的博客 1851

Prometheus使用节点导出器监控Linux主机指标

完整译文请访问:http://www.coderdocument.com/docs/prometheus/v2.14/guides/monitoring_linux_host_metrics_with_node_exporter.html。 Prometheus节点导出器暴露了大量与硬件和内核相关指标。 在本指南中,你将: 在本地启动一个节点导出器; 在本地启动一个Prometheus实...

云原生之家 1159

Prometheus 告警指标

主机与容器监控告警规则摘要 本文档汇总了主机硬件、容器及中间件(Redis/RabbitMQ)的关键监控指标告警规则,涵盖以下维度: 主机监控: 资源指标:内存不足(<10%)、CPU高负载(>80%)、磁盘空间不足(<10%)、swap使用过高(>80%)、磁盘I/O延迟(>100ms) 网络指标:流量异常(>100MB/s)、收发错误、网卡故障 硬件健康:温度过高(>75℃)、RAID磁盘故障、内存EDAC错误 容器监控: 容器存活状态检测 资源阈值:CPU(&

m0_47484677的博客 102

Prometheus+grafana監控linux性能指標

【代码】Prometheus+grafana監控linux性能指標。

qq_55650788的博客 574

Prometheus监控docker容器

@ Prometheus(普罗米修斯)监控 Prometheus是最初在SoundCloud上构建的开源系统监视和警报工具包 。自2012年成立以来,许多公司和组织都采用了Prometheus,该项目拥有非常活跃的开发人员和用户社区 。 使用prometheus的特性 易管理性 Prometheus核心部分只有一个单独的二进制文件,可直接在本地工作,不依赖于分布式存储 不依赖分布式存储,单服务器节点是自治的 高效 单一Prometheus可以处理数以百万的监控指标;每秒处理数十万 的数据点

Mr.李的博客 1万+

kube-prometheus监控Linux主机

需注意复用的规则应将监控目标修改成外部的node Job名称,上述job名称为external-node-exporter。那么该规则同样要指定该job名称,否则监控规则无法生效。Node 模版ID1860。防火墙放行9100端口。

wuxingge的博客 500

Prometheus告警--Redis节点服务指标告警规则

在当今数字化监控领域,Prometheus 凭借强大的功能备受青睐。

Pierreze的博客 422

云原生涉及的技术

【代码】云原生涉及的技术。

天行健,君子以自强不息;地势坤,君子以厚德载物。 375

linux中yum安装splunk,Splunk tips

### 1、Splunk HF 转发syslog到第三方主机**outputs.conf**```[syslog]defaultGroup=syslogGroup[syslog:syslogGroup]type = udpserver = 10.203.19.22:514```**props.conf**```[sourcetype::cosmo_syslog]TRANSFORMS-nyc = s...

weixin_39866857的博客 564

prometheus使用 (二) 监控主机节点

上一章,我们部署了prometheus服务,但是点开页面发现基本都是空白的>︿< 这是因为没有添加要监控的对象是什么,我们来简单的操作一下 一. 监控prometheus本身 #我们先访问一下当前主机的http http://192.168.1.20:9090/metrics prometheus是通过使用http请求方法,请求客户端节点上的端点信息来收集数据的 同时,prometheus也会用相同的方法去暴露自身的指标数据,所以是可以去监控自身的 也可能你会说,这不是已经收集到了吗?.

默子昂 4348

prometheus cadvisor 容器相关指标

3、 container_cpu_user_seconds_total与container_cpu_system_seconds_total的总和,代表容器占用CPU的总和。6、 查询容器相关的 数据:查询所有POD的1min内CPU使用情况,用到的数据指标是k8s通过request(下限)和limit(上限)限制容器的CPU和内存的使用范围,在容器运行的过程中需要实时监控容器对cpu的使用情况。1、 容器用户态占用CPU的时间总和。

小楼一夜听春雨,深巷明朝卖杏花 7130

Prometheus监控实战之Prometheus监控K8S

Prometheus监控K8S

sre救赎之路 1万+

性能监控之 node_exporter+Prometheus+Grafana 实现主机监控

文章目录一、概述二、功能三、安装1、二进制包2、docker容器3、使用 Kubernetes Operator 安装四、 node_exporter 监控指标五、配置 Prometheus六、使用 PromQL 查询监控数据七、数据可视化八、扩展知识1、推荐的exporter2、注意版本3、实现原理九、小结 一、概述 在 Prometheus 的架构设计中,Prometheus Server 并不直接服务监控特定的目标,其主要任务负责数据的收集,存储并且对外提供数据查询支持。因此为了能够能够监控到某些东

7DGroup,让技术更有价值! 3603

Prometheus监控K8S

Prometheus监控K8S,此文章附带yam文件

礁之的博客 1万+

Prometheus+Grafana 监控 Kubernetes

Prometheus+Grafana 监控 Kubernetes

qq_44930876的博客 2449
上一篇: Zabbix监控网络设备模板配置
下一篇: Zabbix监控开源国产华为openGauss数据库
MichaelCoCoQ
博客等级 码龄5年 640粉丝 74原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

MichaelCoCoQ

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值