Linux服务器硬件运行状态及故障邮件提醒的监控脚本分享
作者:傲雪星枫 发布时间:2023-02-15 21:27:43
标签:监控,shell
监控硬件运行状况
shell 监控cpu,memory,load average,记录到log,当负载压力时,发电邮通知管理员。
原理:
1.获取cpu,memory,load average的数值
2.判断数值是否超过自定义的范围,例如(CPU>90%,Memory<10%,load average>2)
3.如数值超过范围,发送电邮通知管理员。发送有时间间隔,每小时只会发送一次。
4.将数值写入log。
5.设置crontab 每30秒运行一次。
ServerMonitor.sh
#!/bin/bash
# 系统监控,记录cpu、memory、load average,当超过规定数值时发电邮通知管理员
# *** config start ***
# 当前目录路径
ROOT=$(cd "$(dirname "$0")"; pwd)
# 当前服务器名
HOST=$(hostname)
# log 文件路径
CPU_LOG="${ROOT}/logs/cpu.log"
MEM_LOG="${ROOT}/logs/mem.log"
LOAD_LOG="${ROOT}/logs/load.log"
# 通知电邮列表
NOTICE_EMAIL='admin@admin.com'
# cpu,memory,load average 记录上一次发送通知电邮时间
CPU_REMARK='/tmp/servermonitor_cpu.remark'
MEM_REMARK='/tmp/servermonitor_mem.remark'
LOAD_REMARK='/tmp/servermonitor_loadaverage.remark'
# 发通知电邮间隔时间
REMARK_EXPIRE=3600
NOW=$(date +%s)
# *** config end ***
# *** function start ***
# 获取CPU占用
function GetCpu() {
cpufree=$(vmstat 1 5 |sed -n '3,$p' |awk '{x = x + $15} END {print x/5}' |awk -F. '{print $1}')
cpuused=$((100 - $cpufree))
echo $cpuused
local remark
remark=$(GetRemark ${CPU_REMARK})
# 检查CPU占用是否超过90%
if [ "$remark" = "" ] && [ "$cpuused" -gt 90 ]; then
echo "Subject: ${HOST} CPU uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}
echo "$(date +%s)" > "$CPU_REMARK"
fi
}
# 获取内存使用情况
function GetMem() {
mem=$(free -m | sed -n '3,3p')
used=$(echo $mem | awk -F ' ' '{print $3}')
free=$(echo $mem | awk -F ' ' '{print $4}')
total=$(($used + $free))
limit=$(($total/10))
echo "${total} ${used} ${free}"
local remark
remark=$(GetRemark ${MEM_REMARK})
# 检查内存占用是否超过90%
if [ "$remark" = "" ] && [ "$limit" -gt "$free" ]; then
echo "Subject: ${HOST} Memory uses more than 90% $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}
echo "$(date +%s)" > "$MEM_REMARK"
fi
}
# 获取load average
function GetLoad() {
load=$(uptime | awk -F 'load average: ' '{print $2}')
m1=$(echo $load | awk -F ', ' '{print $1}')
m5=$(echo $load | awk -F ', ' '{print $2}')
m15=$(echo $load | awk -F ', ' '{print $3}')
echo "${m1} ${m5} ${m15}"
m1u=$(echo $m1 | awk -F '.' '{print $1}')
local remark
remark=$(GetRemark ${LOAD_REMARK})
# 检查是否负载是否有压力
if [ "$remark" = "" ] && [ "$m1u" -gt "2" ]; then
echo "Subject: ${HOST} Load Average more than 2 $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}
echo "$(date +%s)" > "$LOAD_REMARK"
fi
}
# 获取上一次发送电邮时间
function GetRemark() {
local remark
if [ -f "$1" ] && [ -s "$1" ]; then
remark=$(cat $1)
if [ $(( $NOW - $remark )) -gt "$REMARK_EXPIRE" ]; then
rm -f $1
remark=""
fi
else
remark=""
fi
echo $remark
}
# *** function end ***
cpuinfo=$(GetCpu)
meminfo=$(GetMem)
loadinfo=$(GetLoad)
echo "cpu: ${cpuinfo}" >> "${CPU_LOG}"
echo "mem: ${meminfo}" >> "${MEM_LOG}"
echo "load: ${loadinfo}" >> "${LOAD_LOG}"
exit 0
监控网站是否异常
shell 监控网站是否异常的脚本,如有异常自动发电邮通知管理员。
流程:
1.检查网站返回的http_code是否等于200,如不是200视为异常。
2.检查网站的访问时间,超过MAXLOADTIME(10秒)视为异常。
3.发送通知电邮后,在/tmp/monitor_load.remark记录发送时间,在一小时内不重复发送,如一小时后则清空/tmp/monitor_load.remark。
#!/bin/bash
SITES=("http://web01.example.com" "http://web02.example.com") # 要监控的网站
NOTICE_EMAIL='me@example.com' # 管理员电邮
MAXLOADTIME=10 # 访问超时时间设置
REMARKFILE='/tmp/monitor_load.remark' # 记录时否发送过通知电邮,如发送过则一小时内不再发送
ISSEND=0 # 是否有发送电邮
EXPIRE=3600 # 每次发送电邮的间隔秒数
NOW=$(date +%s)
if [ -f "$REMARKFILE" ] && [ -s "$REMARKFILE" ]; then
REMARK=$(cat $REMARKFILE)
# 删除过期的电邮发送时间记录文件
if [ $(( $NOW - $REMARK )) -gt "$EXPIRE" ]; then
rm -f ${REMARKFILE}
REMARK=""
fi
else
REMARK=""
fi
# 循环判断每个site
for site in ${SITES[*]}; do
printf "start to load ${site}\n"
site_load_time=$(curl -o /dev/null -s -w "time_connect: %{time_connect}\ntime_starttransfer: %{time_starttransfer}\ntime_total: %{time_total}" "${site}")
site_access=$(curl -o /dev/null -s -w %{http_code} "${site}")
time_total=${site_load_time##*:}
printf "$(date '+%Y-%m-%d %H:%M:%S')\n"
printf "site load time\n${site_load_time}\n"
printf "site access:${site_access}\n\n"
# not send
if [ "$REMARK" = "" ]; then
# check access
if [ "$time_total" = "0.000" ] || [ "$site_access" != "200" ]; then
echo "Subject: ${site} can access $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}
ISSEND=1
else
# check load time
if [ "${time_total%%.*}" -ge ${MAXLOADTIME} ]; then
echo "Subject: ${site} load time total:${time_total} $(date +%Y-%m-%d' '%H:%M:%S)" | sendmail ${NOTICE_EMAIL}
ISSEND=1
fi
fi
fi
done
# 发送电邮后记录发送时间
if [ "$ISSEND" = "1" ]; then
echo "$(date +%s)" > $REMARKFILE
fi
exit 0
0
投稿
猜你喜欢
- All-in-One的Mac平台WEB服务器4DWebSTARV是一款MAC平台的多功能服务器软件包,它包含了WEB,FTP,WebdAV和
- 1, 梦想靠淘宝客发大财的。其实,无论阿里妈妈还是其他淘宝客把淘宝客说的天花乱坠,无论多少人说他通过淘宝客赚了多少多少钱,淘宝客终其特性决定
- 分词技术对搜索引擎来说是指将文本中的词语分离和抽取出来,使得搜索引擎能够通过矩阵,向量等方式保存网页并作出合适的索引,对于我们seo来说是将
- 虽然以前针对服务器性能优化做过很多设置。如:优化应用程序池,增加虚拟内存等等。但是前段时间,服务器还是经常会CPU满100%。一开始想法是写
- Google AdSense相信大家都很熟悉,想实实在在的通过做Google AdSense赚取美金,我们必须充分的了解Goog
- 完美站长站立足于草根站长和个人企业,很多人问我们一些常见的CMS的优劣区别,今天抽个时间写一下供大家参考自己做站长很多年了,对国内的CMS也
- 通过下面 10 步来保护 IIS:1.为IIS 应用程序和数据专门安装一个NTFS 设备。如果有可能,不要允许IUSER(或其它任何匿名用户
- linux系统中,利用grep打印匹配的上下几行如果在只是想匹配模式的上下几行,grep可以实现。//搜索inputfile中满足partt
- 网络赚钱方法无穷无尽,。相信大家都玩过一些游戏,游戏你是否都被人家骗过什么装备,金钱。网赚就如游戏,有人的地方就有骗术,好多新手刚刚新手入门
- xampp 把apache mysql, php, phpmyadmin都integrate在一起, 很好安装,操作简单,但是也有弊端。 用
- Docker 技术发展为微服务落地提供了更加便利的环境,使用 Docker 部署 Spring Boot 其实非常简单,这篇文章我们就来简单
- 前言:绝大多数的站长是负担不起独立主机所带来的金钱、时间、维护上的消耗,于是就有了虚拟主机业务。随着虚拟主机近几年良莠不齐的发展,如何选择一
- 这两天遇到一个很愚蠢的问题,每次登录淘宝/支付宝的时候,总是会遇到“此网站的安全证书有问题”的提示,指出正在访问的网站所出具的安全证书未生效
- 相信很多用phpcms v9的站长都不是程序员,而我也是一个网页设计师,所以对制作模板还是可以对付的。但是一设计到自己写程序,就一个头两个大
- 部署Exchange Server 2007的前提条件Microsoft .NET Framework 2.0http://www.micr
- 架设sendmail服务器 这次我们来学习Linux系统中的Sendmail服务器的配置。(邮件服务器的IP192.168.1.2 主机域名
- 在升级到WindowsSP2系统后,本人的电脑经常出现这种怪毛病,具体情况为:在上网时网关能够PING通,用Bitcomet下载文件也能够正
- 服务器群集功能最早是为 Microsoft Windows NT® Server 4.0 操作系统设计的,这一功能在 Mic
- 背景CVE-2021-21972 vmware vcenter的一个未授权的命令执行漏洞。该漏洞可以上传一个webshell至vcenter
- 如何使用Godaddy的免费空间,下面就介绍一下几个简单的步骤: 1. 登陆account manager2. 点free pro