shell 监控cpu,memory,load average

shell 监控cpu,memory,load average,记录到log,当负载压力时,发电邮通知管理员。

原理:

1.获取cpu,memory,load average的数值

2.判断数值是否超过自定义的范围,例如(CPU>90%,Memory<10%,load average>2)

3.如数值超过范围,发送电邮通知管理员。发送有时间间隔,每小时只会发送一次。

4.将数值写入log。

5.设置crontab 每30秒运行一次。

ServerMonitor.sh

  1. #!/bin/bash
  2. # 系统监控,记录cpu、memory、load average,当超过规定数值时发电邮通知管理员
  3. # *** config start ***
  4. # 当前目录路径
  5. ROOT=$(cd “$(dirname “$0″)”; pwd)
  6. # 当前服务器名
  7. HOST=$(hostname)
  8. # log 文件路径
  9. CPU_LOG=”${ROOT}/logs/cpu.log”
  10. MEM_LOG=”${ROOT}/logs/mem.log”
  11. LOAD_LOG=”${ROOT}/logs/load.log”
  12. # 通知电邮列表
  13. NOTICE_EMAIL=’admin@admin.com’
  14. # cpu,memory,load average 记录上一次发送通知电邮时间
  15. CPU_REMARK=’/tmp/servermonitor_cpu.remark’
  16. MEM_REMARK=’/tmp/servermonitor_mem.remark’
  17. LOAD_REMARK=’/tmp/servermonitor_loadaverage.remark’
  18. # 发通知电邮间隔时间
  19. REMARK_EXPIRE=3600
  20. NOW=$(date +%s)
  21. # *** config end ***
  22. # *** function start ***
  23. # 获取CPU占用
  24. function GetCpu() {
  25.     cpufree=$(vmstat 1 5 |sed -n ‘3,$p’ |awk ‘{x = x + $15} END {print x/5}’ |awk -F. ‘{print $1}’)
  26.     cpuused=$((100 – $cpufree))
  27.     echo $cpuused
  28.     local remark
  29.     remark=$(GetRemark ${CPU_REMARK})
  30.     # 检查CPU占用是否超过90%
  31.     if [ “$remark” = “” ] && [ “$cpuused” -gt 90 ]; then
  32.         echo “Subject: ${HOST} CPU uses more than 90% $(date +%Y-%m-%d’ ‘%H:%M:%S)” | sendmail ${NOTICE_EMAIL}
  33.         echo “$(date +%s)” > “$CPU_REMARK”
  34.     fi
  35. }
  36. # 获取内存使用情况
  37. function GetMem() {
  38.     mem=$(free -m | sed -n ‘3,3p’)
  39.     used=$(echo $mem | awk -F ‘ ‘ ‘{print $3}’)
  40.     free=$(echo $mem | awk -F ‘ ‘ ‘{print $4}’)
  41.     total=$(($used + $free))
  42.     limit=$(($total/10))
  43.     echo “${total} ${used} ${free}”
  44.     local remark
  45.     remark=$(GetRemark ${MEM_REMARK})
  46.     # 检查内存占用是否超过90%
  47.     if [ “$remark” = “” ] && [ “$limit” -gt “$free” ]; then
  48.         echo “Subject: ${HOST} Memory uses more than 90% $(date +%Y-%m-%d’ ‘%H:%M:%S)” | sendmail ${NOTICE_EMAIL}
  49.         echo “$(date +%s)” > “$MEM_REMARK”
  50.     fi
  51. }
  52. # 获取load average
  53. function GetLoad() {
  54.     load=$(uptime | awk -F ‘load average: ‘ ‘{print $2}’)
  55.     m1=$(echo $load | awk -F ‘, ‘ ‘{print $1}’)
  56.     m5=$(echo $load | awk -F ‘, ‘ ‘{print $2}’)
  57.     m15=$(echo $load | awk -F ‘, ‘ ‘{print $3}’)
  58.     echo “${m1} ${m5} ${m15}”
  59.     m1u=$(echo $m1 | awk -F ‘.’ ‘{print $1}’)
  60.     local remark
  61.     remark=$(GetRemark ${LOAD_REMARK})
  62.     # 检查是否负载是否有压力
  63.     if [ “$remark” = “” ] && [ “$m1u” -gt “2” ]; then
  64.         echo “Subject: ${HOST} Load Average more than 2 $(date +%Y-%m-%d’ ‘%H:%M:%S)” | sendmail ${NOTICE_EMAIL}
  65.         echo “$(date +%s)” > “$LOAD_REMARK”
  66.     fi
  67. }
  68. # 获取上一次发送电邮时间
  69. function GetRemark() {
  70.     local remark
  71.     if [ -f “$1” ] && [ -s “$1” ]; then
  72.         remark=$(cat $1)
  73.         if [ $(( $NOW – $remark )) -gt “$REMARK_EXPIRE” ]; then
  74.             rm -f $1
  75.             remark=””
  76.         fi
  77.     else
  78.         remark=””
  79.     fi
  80.     echo $remark
  81. }
  82. # *** function end ***
  83. cpuinfo=$(GetCpu)
  84. meminfo=$(GetMem)
  85. loadinfo=$(GetLoad)
  86. echo “cpu: ${cpuinfo}” >> “${CPU_LOG}”
  87. echo “mem: ${meminfo}” >> “${MEM_LOG}”
  88. echo “load: ${loadinfo}” >> “${LOAD_LOG}”
  89. exit 0
0 Comments
Leave a Reply