服务器之家:专注于VPS、云服务器配置技术及软件下载分享
分类导航

PHP教程|ASP.NET教程|Java教程|ASP教程|编程技术|正则表达式|C/C++|IOS|C#|Swift|Android|VB|R语言|JavaScript|易语言|vb.net|

服务器之家 - 编程语言 - 编程技术 - 使用 Node Exporter 自定义监控指标

使用 Node Exporter 自定义监控指标

2021-10-28 22:35k8s技术圈阳明 编程技术

node_exporter 除了本身可以收集系统指标之外,还可以通过 textfile 模块来采集我们自定义的监控指标,这对于系统监控提供了更灵活的使用空间。

使用 Node Exporter 自定义监控指标

node_exporter 除了本身可以收集系统指标之外,还可以通过 textfile 模块来采集我们自定义的监控指标,这对于系统监控提供了更灵活的使用空间,比如我们通过脚本采集的监控数据就可以通过该模块暴露出去,用于 Prometheus 进行监控报警。默认情况下 node_exporter 会启用 textfile 组建,但是需要使用 --collector.textfile.directory 参数设置一个用于采集的路径,所有生成的监控指标将放在该目录下,并以 .prom 文件名后缀结尾。

所有自定义生成的监控指标需要按照如下所示的方式进行存储,比如我们使用 shell 或者 python 脚本写入的文件:

  1. #HELPexample_metricMetricreadfrom/some/path/textfile/example.prom
  2. #TYPEexample_metricuntyped
  3. example_metric1

这其实就是一个标准的 metrics 接口内容格式,这里如果没有加上 HELP 信息的话,系统会帮助生成一个简单的描述信息,但是如果有多个文件中出现了相同的指标名称,那么需要保证这些指标的 HELP 和 TYPE 要一致,否则采集会出错。

一般来说输出指标到 .prom 文件的脚本任务会放入到 crontab 中去执行,按照需求设置采集指标的时间,但是如果 node_exporter 采集的时候正好文件在执行写入操作,可能会导致文件出现问题,我们可以将任务先转移到一个临时文件,然后通过临时文件的重命名进行操作,降低风险,如下所示:

  1. */5****$TEXTFILE/printMetrics.sh>/path/to/directory/metrics.prom.$$&&mv/path/to/directory/metrics.prom.$$/path/to/directory/metrics.prom

对于 .prom 文件的采集,系统会自动的加入采集文件的修改时间,通过该指标我们可以设置告警用于判断是否文件发生了变化,比如采集指标时间为每 10 分钟一次,那么修改时间应该 <15 分钟,否则就应该报警上次的采集未成功,指标名称为 node_textfile_mtime_seconds,指标收集时间为 unixtime 格式时间。

同时除了加载一些探测信息,使用该方式还可以用于静态信息的收集,比如定义的系统角色信息,或者服务器特殊的配置信息等等,这些也都可以通过 metrics 的方式进行传递。

  1. echo'role{role="application_server"}1'>/path/to/directory/role.prom.$$
  2. mv/path/to/directory/role.prom.$$/path/to/directory/role.prom

这里我们以官方提供的一个脚本用于采集文件夹目录大小的 shell 脚本为例进行说明,脚本地址为:https://github.com/prometheus-community/node-exporter-textfile-collector-scripts/blob/master/directory-size.sh,内容如下所示:

  1. #!/bin/sh
  2. #
  3. #Exposedirectoryusagemetrics,passedasanargument.
  4. #
  5. #Usage:addthistocrontab:
  6. #
  7. #*/5****prometheusdirectory-size.sh/var/lib/prometheus|sponge/var/lib/node_exporter/directory_size.prom
  8. #
  9. #sedpatterntakenfromhttps://www.robustperception.io/monitoring-directory-sizes-with-the-textfile-collector/
  10. #
  11. #Author:AntoineBeaupré
  12. echo"#HELPnode_directory_size_bytesDiskspaceusedbysomedirectories"
  13. echo"#TYPEnode_directory_size_bytesgauge"
  14. du--block-size=1--summarize"$@"\
  15. |sed-ne's/\\/\\\\/;s/"/\\"/g;s/^\([0-9]\+\)\t\(.*\)$/node_directory_size_bytes{directory="\2"}\1/p'

首先需要在 node_exporter 启动程序中指定 textfile 采集器目录,我们这里指定的目录为 /root/p8strain/textfile:

使用 Node Exporter 自定义监控指标

然后重新启动 node_exporter:

  1. ☸➜systemctldaemon-reload
  2. ☸➜systemctlrestartnode_exporter

这样 node_exporter 就会开始去收集我们指定有的 textfile 目录里面的自定义指标数据了。为了使用上面的测试脚本,我们可以将生成的文件放入临时文件,然后重新命令,另外一种方式就是可以使用 sponge 命令来保证以原子方式写入内容 | sponge ,我们这里是 CentOS 系统,需要额外安装该工具:

  1. ☸➜yum-yinstallepel-release
  2. ☸➜yum-yinstallmoreutils

将上面的示例脚本保存为 directory-size.sh,放入 /root/p8strain 目录下面,然后在 crontab 中加入如下命令来统计该目录的大小:

  1. ☸➜crontab-e
  2. #加入如下所示定时任务
  3. ☸➜crontab-l
  4. */5****/root/p8strain/directory-size.sh/root/p8strain|sponge/root/p8strain/textfile/directory_size.prom

正常就会在 /root/p8strain/textfile 目录下面生成上面指定的 directory_size.prom 指标文件,内容如下所示:

  1. #HELPnode_directory_size_bytesDiskspaceusedbysomedirectories
  2. #TYPEnode_directory_size_bytesgauge
  3. node_directory_size_bytes{directory="/root/p8strain"}459378688

正常该指标就已经被 Prometheus 采集了,我们可以直接去查询该指标获取相关信息:

使用 Node Exporter 自定义监控指标

使用 Node Exporter 自定义监控指标

原文链接:https://mp.weixin.qq.com/s/X73XRrhU_lYMvkJvF1z2uw

延伸 · 阅读

精彩推荐
  • 编程技术Delphi - Indy idMessage和idSMTP实现邮件的发送

    Delphi - Indy idMessage和idSMTP实现邮件的发送

    这篇文章主要介绍了Delphi - Indy idMessage和idSMTP实现邮件的发送,本文通过实例代码给大家介绍的非常详细,具有一定的参考借鉴价值,需要的朋友可以参考下...

    JJ_JeremyWu6592020-09-22
  • 编程技术真正聪明的程序员,总有办法不加班

    真正聪明的程序员,总有办法不加班

    工作效率提升了,就可以少加班了,聪明的程序员,总会有一堆可以提升编码效率的工具?当一种工具满足不了工作需求,就去探索新的,今天纬小创就给...

    今日头条12482021-03-04
  • 编程技术让开发效率倍增的 VS Code 插件

    让开发效率倍增的 VS Code 插件

    今天来分享一些提升开发效率的实用 VS Code 插件!Better Comments 扩展可以帮助我们在代码中创建更人性化的注释,有不同形式和颜色的注释供我们选择。 ...

    前端充电宝7132022-04-21
  • 编程技术AIOps,SRE工程师手中的利器

    AIOps,SRE工程师手中的利器

    AIOps开始成为一种极为重要的站点可靠性工程工具。它能够高效吸纳观察数据、参与数据以及来自第三方工具的数据,判断系统运行状态并保证其处于最佳...

    至顶网5972021-03-08
  • 编程技术2021年值得关注的React PDF 库

    2021年值得关注的React PDF 库

    今天,许多网络应用程序为其用户提供内置的PDF浏览选项。然而,选择一个并不容易,因为它们的功能远远超过显示PDF。在这篇文章中,我将评估5个React的...

    TianTianUp5232021-06-21
  • 编程技术从Context源码实现谈React性能优化

    从Context源码实现谈React性能优化

    这篇文章主要介绍Context的实现原理,源码层面掌握React组件的render时机,从而写出高性能的React组件,源码层面了解shouldComponentUpdate、React.memo、PureComponen...

    魔术师卡颂5312020-12-20
  • 编程技术用户态 Tcpdump 如何实现抓到内核网络包的?

    用户态 Tcpdump 如何实现抓到内核网络包的?

    在网络包的发送和接收过程中,绝大部分的工作都是在内核态完成的。那么问题来了,我们常用的运行在用户态的程序 tcpdump 是那如何实现抓到内核态的包...

    开发内功修炼11612021-09-08
  • 编程技术简单、好懂的Svelte实现原理

    简单、好懂的Svelte实现原理

    本文会围绕一张流程图和两个Demo讲解,正确的食用方式是用电脑打开本文,跟着流程图、Demo一边看、一边敲、一边学...

    魔术师卡颂4822021-11-10