WGCLOUD是一款常用的服务器运维监控工具,它能够在无侵入的情况下对服务器上的业务应用状态进行持续监测,帮助运维人员及时发现进程退出、端口不可达等异常。下面介绍其具体的监测方式和配置思路。

一、基于进程名的监测
WGCLOUD的agent会周期性读取系统的进程列表,用户只需要在服务端WEB页面添加要监控的进程名称,系统便会匹配服务器中对应的业务进程。若进程不存在,则判定应用状态异常。
配置步骤
- 登录WGCLOUD服务端,进入主机管理对应的agent页面
- 选择进程监控,填写应用进程名,例如 java 或 nginx
- 设置告警阈值,如进程连续消失几次后发送通知
二、基于端口的连通性检测
除了进程,WGCLOUD也支持对业务监听端口进行TCP探测。该功能可以验证应用虽然进程在,但服务是否真正可对外提供访问。
| 监测方式 | 适用场景 | 判定标准 |
|---|---|---|
| 进程名匹配 | 明确知道启动命令 | 进程存在为正常 |
| 端口检测 | Web或API服务 | 端口可连为正常 |
三、自定义脚本采集业务指标
如果希望了解应用内部的业务状态,比如订单处理量或接口耗时,可以使用WGCLOUD的自定义脚本功能。agent会定时执行脚本并上报输出。
以下是一个简单的Shell脚本示例,用于检测本地HTTP接口是否返回200:
#!/bin/bash
# 检测业务接口状态
code=$(curl -s -o /dev/null -w "%{http_code}" http://127.0.0.1:8080/health)
if [ "$code" = "200" ]; then
echo "status:ok"
else
echo "status:fail"
fi
将脚本路径配置到WGCLOUD的自定义监控项中,即可在图表中看到status输出,并依据关键字配置告警。
四、告警与通知
当WGCLOUD监测到应用进程丢失或端口不通时,会根据用户设置的渠道(如邮件、钉钉、微信)推送告警。这样运维人员不用一直盯着面板,也能快速感知业务应用状态变化。
总体来看,WGCLOUD通过进程、端口及脚本三种手段覆盖大多数业务应用监测需求,部署负担小,适合日常服务器运维使用。