濮阳杆衣贸易有限公司

主頁 > 知識庫 > shell腳本監(jiān)控系統(tǒng)負(fù)載、CPU和內(nèi)存使用情況

shell腳本監(jiān)控系統(tǒng)負(fù)載、CPU和內(nèi)存使用情況

熱門標(biāo)簽:衛(wèi)星地圖標(biāo)注地名 電銷機(jī)器人 劍魚 寧波智能外呼系統(tǒng)公司 聯(lián)通電話機(jī)器人怎么接 地圖標(biāo)注輻射圖案 曲阜400電話辦理 申請公司400電話要注意什么 安裝外呼系統(tǒng)費(fèi)用 奧維互動地圖標(biāo)注參數(shù)

在沒有nagios監(jiān)控軟件的情況下,只要服務(wù)器能上互聯(lián)網(wǎng),就可通過發(fā)郵件的方式來提醒管理員系統(tǒng)負(fù)載與CPU占用的使用情況。

一、安裝linux下面的一個郵件客戶端msmtp軟件(類似于一個foxmail的工具)

 1、下載安裝:
 http://downloads.sourceforge.net/msmtp/msmtp-1.4.16.tar.bz2?modtime=1217206451big_mirror=0

復(fù)制代碼 代碼如下:

# tar jxvf msmtp-1.4.16.tar.bz2
# cd msmtp-1.4.16
# ./configure --prefix=/usr/local/msmtp
# make make install

 2、創(chuàng)建msmtp配置文件和日志文件(host為郵件域名,郵件用戶名fuquanjun,密碼fuquanjun)

復(fù)制代碼 代碼如下:

# vim /root/.msmtprc

account default 
host xxxxx.com 
from fuquanjun@xxxx.com 
auth login 
user fuquanjun
password fuquanjun
logfile ~/.msmtp.log
 # chmod 600  /root/.msmtprc
 # touch ~/.msmtp.log

3、mutt安裝配置:(一般linux下有默認(rèn)安裝mutt)

如果沒有安裝,則使用yum安裝

復(fù)制代碼 代碼如下:

yum -y install mutt
# vim /root/.muttrc
set sendmail="/usr/local/msmtp/bin/msmtp"
set use_from=yes
set realname="moniter"  
set from=fuquanjun@xxx.com 
set envelope_from=yes
set rfc2047_parameters=yes
set charset="utf-8

4、郵件發(fā)送測試(-s郵件標(biāo)題,-a表加附件)

復(fù)制代碼 代碼如下:

 # echo "郵件內(nèi)容123456" | mutt -s "郵件標(biāo)題測試郵件" -a /scripts/test.txt  fuquanjun@xxxx.com

出現(xiàn)下面報錯信息:
復(fù)制代碼 代碼如下:

msmtp: account default not found: no configuration file available

發(fā)送信件出錯,子進(jìn)程已退出 78 ()。
無法發(fā)送此信件。
解決方法:

單獨(dú)使用msmtp發(fā)送測試:/usr/local/msmtp/bin/msmtp -S  發(fā)現(xiàn)是配置文件沒找到

復(fù)制代碼 代碼如下:

msmtp: account default not found: no configuration file available

查看當(dāng)前的配置文件路徑:/usr/local/msmtp/bin/msmtp -P
復(fù)制代碼 代碼如下:

ignoring system configuration file/work/target/etc/msmtprc: No such file or directory
ignoring user configuration file /root/.msmtprc: No such file ordirectory
falling back to default account
msmtp: account default not found: no configuration file available

故將/usr/local/etc/msmtprc  復(fù)制為/root/.msmtprc
查看一下mutt文件安裝目錄情況
復(fù)制代碼 代碼如下:

rpm -ql mutt

故將/etc/Muttrc  復(fù)制為/root/.muttrc即可發(fā)送郵件。

二、監(jiān)控服務(wù)器系統(tǒng)負(fù)載情況:

1、用uptime命令查看當(dāng)前負(fù)載情況(1分鐘,5分鐘,15分鐘平均負(fù)載情況)在蘋果公司的Mac電腦上也適用

復(fù)制代碼 代碼如下:

# uptime
   15:43:59 up 186 days, 20:04,  1 user,  load average:  0.01,    0.02,   0.00

"load average"意思分別是1分鐘、5分鐘、15分鐘內(nèi)系統(tǒng)的平均負(fù)荷。
(1) 主要觀察"15分鐘系統(tǒng)負(fù)荷",將它作為電腦正常運(yùn)行的指標(biāo)。
(2) 如果15分鐘內(nèi),(系統(tǒng)負(fù)荷除以CPU核心數(shù)目之后的)平均負(fù)荷大于1.0,表明問題持續(xù)存在,不是暫時現(xiàn)象。
(3) 當(dāng)系統(tǒng)負(fù)荷持續(xù)大于0.7,你必須開始調(diào)查了,問題出在哪里,防止情況惡化。
(4) 當(dāng)系統(tǒng)負(fù)荷持續(xù)大于1.0,你必須動手尋找解決辦法,把這個值降下來。
(5) 當(dāng)系統(tǒng)負(fù)荷達(dá)到5.0,就表明你的系統(tǒng)有很嚴(yán)重的問題,長時間沒有響應(yīng),或者接近死機(jī)了。
假設(shè)你的電腦只有1個CPU。如果你的電腦裝了2個CPU,意味著電腦的處理能力翻了一倍,能夠同時處理的進(jìn)程數(shù)量也翻了一倍。
2個CPU表明系統(tǒng)負(fù)荷可以達(dá)到2.0,此時每個CPU都達(dá)到100%的工作量。推廣開來,n個CPU的電腦,可接受的系統(tǒng)負(fù)荷最大為n.0。

2、查看服務(wù)器cpu的總核數(shù)

復(fù)制代碼 代碼如下:

 # grep -c 'model name' /proc/cpuinfo  或者       cat /proc/cpuinfo

3、截取服務(wù)器1分鐘、5分鐘、15分鐘的負(fù)載情況
復(fù)制代碼 代碼如下:

# uptime | awk '{print $8,$9,$10,$11,$12}'
   load average:  0.01,    0.02,   0.00

4、查看截取15分鐘的平均負(fù)載

復(fù)制代碼 代碼如下:

# uptime | awk '{print $12}' (用 '{print $12}' 這個獲取的不夠準(zhǔn)確,如果都用awk取第12個字段的話,結(jié)果有可能為空了。而用$NF表輸出最后一段的內(nèi)容)
# uptime | awk '{print $NF}'

5、編寫系統(tǒng)負(fù)載監(jiān)控的腳本文件:
復(fù)制代碼 代碼如下:

# vim /scripts/load-check.sh
[code]
#!/bin/bash 
#使用uptime命令監(jiān)控linux系統(tǒng)負(fù)載變化 
 
#取系統(tǒng)當(dāng)前時間(以追加的方式寫入文件>>) 
date >> /scripts/datetime-load.txt    
 
#提取服務(wù)器1分鐘、5分鐘、15分鐘的負(fù)載情況 
uptime | awk '{print $8,$9,$10,$11,$12}' >> /scripts/load.txt 
 
#逐行連接上面的時間和負(fù)載相關(guān)行數(shù)據(jù)(每次重新寫入文件>) 
paste  /scripts/datetime-load.txt /scripts/load.txt   > /scripts/load_day.txt
# chmod a+x /scripts/load-check.sh

6、編寫系統(tǒng)負(fù)載結(jié)果文件郵件發(fā)送腳本:

復(fù)制代碼 代碼如下:

# vim /scripts/sendmail-load.sh

#!/bin/bash 
#把系統(tǒng)負(fù)載監(jiān)控生成的load_day.txt文件通過郵件發(fā)送給用戶 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#提取當(dāng)前日期 
today=`date -d "0 day" +%Y年%m月%d日` 
 
#發(fā)送系統(tǒng)負(fù)載監(jiān)控結(jié)果郵件 
echo "這是$IP服務(wù)器$today的系統(tǒng)負(fù)載監(jiān)控報告,請下載附件。" | mutt -s "$IP服務(wù)器$today的系統(tǒng)負(fù)載監(jiān)控報告" -a /scripts/load_day.txt  fuquanjun@xxx.com
# chmod a+x /scripts/sendmail-load.sh

7、編寫系統(tǒng)負(fù)載監(jiān)控的腳本文件:

復(fù)制代碼 代碼如下:

# vim /scripts/load-warning.sh

#!/bin/bash 
#使用uptime命令監(jiān)控linux系統(tǒng)負(fù)載變化 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#抓取cpu的總核數(shù) 
cpu_num=`grep -c 'model name' /proc/cpuinfo` 
 
#抓取當(dāng)前系統(tǒng)15分鐘的平均負(fù)載值 
load_15=`uptime | awk '{print $NF}'` 
 
#計(jì)算當(dāng)前系統(tǒng)單個核心15分鐘的平均負(fù)載值,結(jié)果小于1.0時前面?zhèn)€位數(shù)補(bǔ)0。 
average_load=`echo "scale=2;a=$load_15/$cpu_num;if(length(a)==scale(a)) print 0;print a" | bc` 
 
#取上面平均負(fù)載值的個位整數(shù) 
average_int=`echo $average_load | cut -f 1 -d "."` 
 
#設(shè)置系統(tǒng)單個核心15分鐘的平均負(fù)載的告警值為0.70(即使用超過70%的時候告警)。 
load_warn=0.70 
 
#當(dāng)單個核心15分鐘的平均負(fù)載值大于等于1.0(即個位整數(shù)大于0) ,直接發(fā)郵件告警;如果小于1.0則進(jìn)行二次比較 
if (($average_int > 0)); then 
      echo "$IP服務(wù)器15分鐘的系統(tǒng)平均負(fù)載為$average_load,超過警戒值1.0,請立即處理?。。? | mutt -s "$IP 服務(wù)器系統(tǒng)負(fù)載嚴(yán)重告警!??!"  fuquanjun@xxx.com 
else 
#當(dāng)前系統(tǒng)15分鐘平均負(fù)載值與告警值進(jìn)行比較(當(dāng)大于告警值0.70時會返回1,小于時會返回0 ) 
load_now=`expr $average_load \&; $load_warn` 
 
#如果系統(tǒng)單個核心15分鐘的平均負(fù)載值大于告警值0.70(返回值為1),則發(fā)郵件給管理員 
 if (($load_now == 1)); then 
    echo "$IP服務(wù)器15分鐘的系統(tǒng)平均負(fù)載達(dá)到 $average_load,超過警戒值0.70,請及時處理。" | mutt -s "$IP 服務(wù)器系統(tǒng)負(fù)載告警"  fuquanjun@xxx.com 
 fi 
fi
 # chmod a+x /scripts/load-warning.sh

三、監(jiān)控服務(wù)器系統(tǒng)cpu占用情況:

1、使用top命令查看linux系統(tǒng)cpu使用情況:

復(fù)制代碼 代碼如下:

#  top -b -n 1 | grep Cpu   (-b -n 1 表只需要1次的輸出結(jié)果)
     Cpu(s):  0.0%us,  0.0%sy,  0.0%ni, 99.9%id,  0.0%wa,  0.0%hi,  0.0%si,  0.0%st

2、查看截取空閑cpu的百分比數(shù)值命令(只取整數(shù)部分):
復(fù)制代碼 代碼如下:

# top -b -n 1 | grep Cpu | awk '{print $5}' | cut -f 1 -d "."

3、編寫cpu監(jiān)控的腳本文件:
復(fù)制代碼 代碼如下:

# vim /scripts/cpu-check.sh

#!/bin/bash 
#使用top命令監(jiān)控linux系統(tǒng)cpu變化 
 
#取系統(tǒng)當(dāng)前時間(以追加的方式寫入文件>>) 
date >> /scripts/datetime-cpu.txt    
 
#抓取當(dāng)前cpu的值(以追加的方式寫入文件>>) 
top -b -n 1 | grep Cpu  >> /scripts/cpu-now.txt  
 
#逐行連接上面的時間和cpu相關(guān)行數(shù)據(jù)(每次重新寫入文件>) 
paste  /scripts/datetime-cpu.txt   /scripts/cpu-now.txt  > /scripts/cpu.txt
# chmod a+x /scripts/cpu-check.sh

4、查看CPU監(jiān)控的結(jié)果文件:

復(fù)制代碼 代碼如下:

# cat /scripts/cpu.txt

5、編寫cpu結(jié)果文件郵件發(fā)送腳本:
復(fù)制代碼 代碼如下:

# vim /scripts/sendmail-cpu.sh
#!/bin/bash 
#把生成的cpu.txt文件通過郵件發(fā)送給用戶 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#提取當(dāng)前日期
today=`date -d "0 day" +%Y年%m月%d日` 
 
#發(fā)送cpu監(jiān)控結(jié)果郵件 
echo "這是$IP服務(wù)器$today的cpu監(jiān)控報告,請下載附件。" | mutt -s "$IP服務(wù)器$today的CPU監(jiān)控報告" -a /scripts/cpu.txt  fuquanjun@xxx.com
 # chmod a+x /scripts/sendmail-cpu.sh
 

四、監(jiān)控系統(tǒng)cpu的情況,當(dāng)使用超過80%的時候發(fā)告警郵件:

復(fù)制代碼 代碼如下:

# vim /scripts/cpu-warning.sh
#!/bin/bash 
#監(jiān)控系統(tǒng)cpu的情況腳本程序 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#取當(dāng)前空閑cpu百份比值(只取整數(shù)部分) 
cpu_idle=`top -b -n 1 | grep Cpu | awk '{print $5}' | cut -f 1 -d "."` 
 
#設(shè)置空閑cpu的告警值為20%,如果當(dāng)前cpu使用超過80%(即剩余小于20%),立即發(fā)郵件告警 
if (($cpu_idle 20)); then 
      echo "$IP服務(wù)器cpu剩余$cpu_idle%,使用率已經(jīng)超過80%,請及時處理。" | mutt -s "$IP 服務(wù)器CPU告警"  fuquanjun@xxx.com 
fi
# chmod a+x /scripts/cpu-warning.sh

五、使用free命令監(jiān)控系統(tǒng)內(nèi)存:

1、使用free命令查看linux系統(tǒng)內(nèi)存使用情況:(以M為單位)

復(fù)制代碼 代碼如下:

# free -m 
             total       used       free     shared    buffers     cached
Mem:          3952       3414        538          0        168        484
-/+ buffers/cache:       2760       1191
Swap:         8191         86       8105

2、查看截取剩余內(nèi)存free的數(shù)值命令:

(1) 物理內(nèi)存free值: # free -m | grep Mem | awk '{print $4}'
(2) 緩沖區(qū)的free值: # free -m | grep - | awk '{print $4}'
(3) Swap分區(qū)free值: # free -m | grep Swap | awk '{print $4}'

3、編寫內(nèi)存監(jiān)控的腳本文件:

復(fù)制代碼 代碼如下:

# vim /scripts/free-mem.sh
#!/bin/bash 
#使用free命令監(jiān)控linux系統(tǒng)內(nèi)存變化 
 
#取系統(tǒng)當(dāng)前時間(以追加的方式寫入文件>>) 
date >> /scripts/date-time.txt    
 
#抓取物理內(nèi)存free值(以追加的方式寫入文件>>) 
echo Mem-free: `free -m | grep Mem | awk '{print $4}'`M >> /scripts/mem-free.txt  
 
#抓取緩沖區(qū)的free值(以追加的方式寫入文件>>) 
echo buffers/cache-free: `free -m | grep - | awk '{print $4}'`M  >> /scripts/buffers-free.txt 
 
#抓取Swap分區(qū)free值(以追加的方式寫入文件>>) 
echo Swap-free: `free -m | grep Swap | awk '{print $4}'`M  >> /scripts/swap-free.txt 
 
#逐行連接上面的時間和內(nèi)存相關(guān)行數(shù)據(jù)(每次重新寫入文件>) 
paste  /scripts/date-time.txt /scripts/mem-free.txt  /scripts/buffers-free.txt   /scripts/swap-free.txt   > /scripts/freemem.txt
# chmod a+x /scripts/free-mem.sh

4、查看內(nèi)存監(jiān)控的結(jié)果文件:
復(fù)制代碼 代碼如下:

# cat /scripts/freemem.txt

5、編寫free結(jié)果文件郵件發(fā)送腳本:
復(fù)制代碼 代碼如下:

# vim /scripts/sendmail-mem.sh
#!/bin/bash 
#把生成的freemem.txt文件通過郵件發(fā)送給用戶 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#提取當(dāng)前日期時間 
today=`date -d "0 day" +%Y年%m月%d日` 
 
#發(fā)送內(nèi)存監(jiān)控結(jié)果郵件 
echo "這是$IP服務(wù)器$today的內(nèi)存監(jiān)控報告,請下載附件。" | mutt -s "$IP服務(wù)器$today內(nèi)存監(jiān)控報告" -a /scripts/freemem.txt fuquanjun@xxx.com
# chmod a+x /scripts/sendmail-mem.sh

六、監(jiān)控系統(tǒng)交換分區(qū)swap的情況,當(dāng)使用超過80%的時候發(fā)告警郵件:

復(fù)制代碼 代碼如下:

# vim /scripts/swap-warning.sh
#!/bin/bash 
 
#提取本服務(wù)器的IP地址信息 
IP=`ifconfig eth0 | grep "inet addr" | cut -f 2 -d ":" | cut -f 1 -d " "` 
 
#系統(tǒng)分配的交換分區(qū)總量 
swap_total=`free -m | grep Swap | awk '{print  $2}'` 
 
#當(dāng)前剩余的交換分區(qū)free大小 
swap_free=`free -m | grep Swap | awk '{print  $4}'` 
 
#當(dāng)前已使用的交換分區(qū)used大小 
swap_used=`free -m | grep Swap | awk '{print  $3}'` 
 
 
if (($swap_used != 0)); then 
 
#如果交換分區(qū)已被使用,則計(jì)算當(dāng)前剩余交換分區(qū)free所占總量的百分比,用小數(shù)來表示,要在小數(shù)點(diǎn)前面補(bǔ)一個整數(shù)位0 
   swap_per=0`echo "scale=2;$swap_free/$swap_total" | bc` 
 
#設(shè)置交換分區(qū)的告警值為20%(即使用超過80%的時候告警)。 
   swap_warn=0.20 
 
#當(dāng)前剩余交換分區(qū)百分比與告警值進(jìn)行比較(當(dāng)大于告警值(即剩余20%以上)時會返回1,小于(即剩余不足20%)時會返回0 ) 
   swap_now=`expr $swap_per \&; $swap_warn` 
 
#如果當(dāng)前交換分區(qū)使用超過80%(即剩余小于20%,上面的返回值等于0),立即發(fā)郵件告警 
  if (($swap_now == 0)); then 
    echo "$IP服務(wù)器swap交換分區(qū)只剩下 $swap_free M 未使用,剩余不足20%,使用率已經(jīng)超過80%,請及時處理。" | mutt -s "$IP 服務(wù)器內(nèi)存告警"  fuquanjun@xxx.com 
  fi 
fi
# chmod a+x /scripts/swap-warning.sh

七、加入任務(wù)計(jì)劃:系統(tǒng)負(fù)載與CPU占用率每十分鐘檢測一次,有告警則立即發(fā)郵件(十分鐘發(fā)一次),負(fù)載與CPU檢測結(jié)果郵件每天早上8點(diǎn)發(fā)一次。


復(fù)制代碼 代碼如下:
# crontab -e
*/10 * * * *  /scripts/load-check.sh > /dev/null 2>1
*/10 * * * *  /scripts/load-warning.sh 
0 8 * * *  /scripts/sendmail-load.sh 
 
*/10 * * * *  /scripts/cpu-check.sh 
*/10 * * * *  /scripts/cpu-warning.sh 
0 8 * * *  /scripts/sendmail-cpu.sh
 
*/10 * * * *  /scripts/free-mem.sh 
*/10 * * * *  /scripts/swap-warning.sh 
0 8 * * *  /scripts/sendmail-mem.sh
# service crond restart

您可能感興趣的文章:
  • 一個用了統(tǒng)計(jì)CPU 內(nèi)存 硬盤 使用率的shell腳本
  • 統(tǒng)計(jì) cpu 內(nèi)存 使用率的shell腳本代碼
  • 消耗CPU資源的shell腳本
  • 使用shell腳本采集系統(tǒng)cpu、內(nèi)存、磁盤、網(wǎng)絡(luò)等信息
  • Linux中使用Shell腳本查看Java線程的CPU使用情況
  • 自動殺掉占用較多CPU資源的Shell腳本
  • Shell腳本實(shí)現(xiàn)把進(jìn)程負(fù)載均衡到多核CPU中
  • Linux shell腳本實(shí)現(xiàn)CPU預(yù)警

標(biāo)簽:遵義 上饒 仙桃 三門峽 安康 大慶 江西 大興安嶺

巨人網(wǎng)絡(luò)通訊聲明:本文標(biāo)題《shell腳本監(jiān)控系統(tǒng)負(fù)載、CPU和內(nèi)存使用情況》,本文關(guān)鍵詞  shell,腳本,監(jiān)控系統(tǒng),負(fù)載,;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題,煩請?zhí)峁┫嚓P(guān)信息告之我們,我們將及時溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò),涉及言論、版權(quán)與本站無關(guān)。
  • 相關(guān)文章
  • 下面列出與本文章《shell腳本監(jiān)控系統(tǒng)負(fù)載、CPU和內(nèi)存使用情況》相關(guān)的同類信息!
  • 本頁收集關(guān)于shell腳本監(jiān)控系統(tǒng)負(fù)載、CPU和內(nèi)存使用情況的相關(guān)信息資訊供網(wǎng)民參考!
  • 推薦文章
    黄龙县| 洛隆县| 昆山市| 萍乡市| 大同县| 新营市| 崇信县| 礼泉县| 百色市| 泗洪县| 江孜县| 宁津县| 包头市| 富源县| 馆陶县| 河南省| 屯昌县| 永昌县| 商洛市| 太原市| 莒南县| 永川市| 德令哈市| 高平市| 伊宁县| 花莲市| 云南省| 连山| 丘北县| 浏阳市| 桂林市| 林州市| 临猗县| 高碑店市| 澄江县| 阿荣旗| 许昌市| 潼南县| 花莲县| 商水县| 镇雄县|