女人自慰AV免费观看内涵网,日韩国产剧情在线观看网址,神马电影网特片网,最新一级电影欧美,在线观看亚洲欧美日韩,黄色视频在线播放免费观看,ABO涨奶期羡澄,第一导航fulione,美女主播操b

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

Linux系統CPU占用率100%的排查思路

jf_TEuU2tls ? 來源:oschina.net ? 2024-01-23 10:26 ? 次閱讀

前言

大家好,這里是浩道linux,主要給大家分享linux、python網絡通信相關的IT知識平臺。

今天浩道跟大家分享linux硬核干貨,工作中當你服務器CPU達到100%時,干著急是沒有用的,該查問題還得自己去查。本文將給大家羅列排查異常故障思路,并且文末附上相關shell腳本,去實際一番,你會發現原來解決問題的方法如此之簡單!

昨天下午突然收到運維郵件報警,顯示數據平臺服務器cpu利用率達到了98.94%,而且最近一段時間一直持續在70%以上,看起來像是硬件資源到瓶頸需要擴容了,但仔細思考就會發現咱們的業務系統并不是一個高并發或者CPU密集型的應用,這個利用率有點太夸張,硬件瓶頸應該不會這么快就到了,一定是哪里的業務代碼邏輯有問題。

2、排查思路

2.1定位高負載進程pid

首先登錄到服務器使用top命令確認服務器的具體情況,根據具體情況再進行分析判斷。

b653c85c-b981-11ee-8b88-92fbcf53809c.png

通過觀察load average,以及負載評判標準(8核),可以確認服務器存在負載較高的情況;

b66a6846-b981-11ee-8b88-92fbcf53809c.jpg

觀察各個進程資源使用情況,可以看出進程id為682的進程,有著較高的CPU占比

2.2定位具體的異常業務

這里咱們可以使用 pwdx 命令根據 pid 找到業務進程路徑,進而定位到負責人和項目:

b681383c-b981-11ee-8b88-92fbcf53809c.jpg

可得出結論:該進程對應的就是數據平臺的web服務。

2.3定位異常線程及具體代碼行

傳統的方案一般是4步:

1、top oder by with P:1040 // 首先按進程負載排序找到 maxLoad(pid)

2、top -Hp 進程PID:1073 // 找到相關負載 線程PID

3、printf “0x%x ”線程PID:0x431 // 將線程PID轉換為 16進制,為后面查找 jstack 日志做準備

4、jstack 進程PID | vim +/十六進制線程PID - // 例如:jstack 1040|vim +/0x431 -

但是對于線上問題定位來說,分秒必爭,上面的 4 步還是太繁瑣耗時了,之前介紹過淘寶的oldratlee 同學就將上面的流程封裝為了一個工具:show-busy-java-threads.sh,可以很方便的定位線上的這類問題:

b6978588-b981-11ee-8b88-92fbcf53809c.jpg

可得出結論:是系統中一個時間工具類方法的執行cpu占比較高,定位到具體方法后,查看代碼邏輯是否存在性能問題。

※如果線上問題比較緊急,可以省略 2.1、2.2 直接執行 2.3,這里從多角度剖析只是為了給大家呈現一個完整的分析思路。

3、根因分析

經過前面的分析與排查,最終定位到一個時間工具類的問題,造成了服務器負載以及cpu使用率的過高。

異常方法邏輯:是把時間戳轉成對應的具體的日期時間格式;

上層調用:計算當天凌晨至當前時間所有秒數,轉化成對應的格式放入到set中返回結果;

邏輯層:對應的是數據平臺實時報表的查詢邏輯,實時報表會按照固定的時間間隔來,并且在一次查詢中有多次(n次)方法調用。

那么可以得到結論,如果現在時間是當天上午10點,一次查詢的計算次數就是 10*60*60*n次=36,000*n次計算,而且隨著時間增長,越接近午夜單次查詢次數會線性增加。由于實時查詢、實時報警等模塊大量的查詢請求都需要多次調用該方法,導致了大量CPU資源的占用與浪費。

4、解決方案

定位到問題之后,首先考慮是要減少計算次數,優化異常方法。排查后發現,在邏輯層使用時,并沒有使用該方法返回的set集合中的內容,而是簡單的用set的size數值。確認邏輯后,通過新方法簡化計算(當前秒數-當天凌晨的秒數),替換調用的方法,解決計算過多的問題。上線后觀察服務器負載和cpu使用率,對比異常時間段下降了30倍,恢復至正常狀態,至此該問題得已解決。

b6b1de2e-b981-11ee-8b88-92fbcf53809c.jpg

5、總結

在編碼的過程中,除了要實現業務的邏輯,也要注重代碼性能的優化。一個業務需求,能實現,和能實現的更高效、更優雅其實是兩種截然不同的工程師能力和境界的體現,而后者也是工程師的核心競爭力。

在代碼編寫完成之后,多做 review,多思考是不是可以用更好的方式來實現。

線上問題不放過任何一個小細節!細節是魔鬼,技術的同學需要有刨根問題的求知欲和追求卓越的精神,只有這樣,才能不斷的成長和提升。

附上show-busy-java-threads.sh腳本:

#!/bin/bash
# @Function
# Find out the highest cpu consumed threads of java, and print the stack of these threads.
#
# @Usage
#   $ ./show-busy-java-threads.sh
#
# @author Jerry Lee


readonly PROG=`basename $0`
readonly -a COMMAND_LINE=("$0" "$@")


usage() {
    cat < /dev/null; then
    [ -z "$JAVA_HOME" ] && {
        redEcho "Error: jstack not found on PATH!"
        exit 1
    }
    ! [ -f "$JAVA_HOME/bin/jstack" ] && {
        redEcho "Error: jstack not found on PATH and $JAVA_HOME/bin/jstack file does NOT exists!"
        exit 1
    }
    ! [ -x "$JAVA_HOME/bin/jstack" ] && {
        redEcho "Error: jstack not found on PATH and $JAVA_HOME/bin/jstack is NOT executalbe!"
        exit 1
    }
    export PATH="$JAVA_HOME/bin:$PATH"
fi


readonly uuid=`date +%s`_${RANDOM}_$$


cleanupWhenExit() {
    rm /tmp/${uuid}_* &> /dev/null
}
trap "cleanupWhenExit" EXIT


printStackOfThreads() {
    local line
    local count=1
    while IFS=" " read -a line ; do
        local pid=${line[0]}
        local threadId=${line[1]}
        local threadId0x="0x`printf %x ${threadId}`"
        local user=${line[2]}
        local pcpu=${line[4]}


        local jstackFile=/tmp/${uuid}_${pid}


        [ ! -f "${jstackFile}" ] && {
            {
                if [ "${user}" == "${USER}" ]; then
                    jstack ${pid} > ${jstackFile}
                else
                    if [ $UID == 0 ]; then
                        sudo -u ${user} jstack ${pid} > ${jstackFile}
                    else
                        redEcho "[$((count++))] Fail to jstack Busy(${pcpu}%) thread(${threadId}/${threadId0x}) stack of java process(${pid}) under user(${user})."
                        redEcho "User of java process($user) is not current user($USER), need sudo to run again:"
                        yellowEcho "    sudo ${COMMAND_LINE[@]}"
                        echo
                        continue
                    fi
                fi
            } || {
                redEcho "[$((count++))] Fail to jstack Busy(${pcpu}%) thread(${threadId}/${threadId0x}) stack of java process(${pid}) under user(${user})."
                echo
                rm ${jstackFile}
                continue
            }
        }
        blueEcho "[$((count++))] Busy(${pcpu}%) thread(${threadId}/${threadId0x}) stack of java process(${pid}) under user(${user}):"
        sed "/nid=${threadId0x} /,/^$/p" -n ${jstackFile}
    done
}




ps -Leo pid,lwp,user,comm,pcpu --no-headers | {
    [ -z "${pid}" ] &&
    awk '$4=="java"{print $0}' ||
    awk -v "pid=${pid}" '$1==pid,$4=="java"{print $0}'
} | sort -k5 -r -n | head --lines "${count}" | printStackOfThreads

審核編輯:湯梓紅

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • cpu
    cpu
    +關注

    關注

    68

    文章

    11034

    瀏覽量

    216005
  • Linux
    +關注

    關注

    87

    文章

    11460

    瀏覽量

    212794
  • 服務器
    +關注

    關注

    13

    文章

    9688

    瀏覽量

    87285
  • 腳本
    +關注

    關注

    1

    文章

    397

    瀏覽量

    28348

原文標題:Linux系統CPU占用率100%干著急?對著本文排查吧~

文章出處:【微信號:浩道linux,微信公眾號:浩道linux】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏

    評論

    相關推薦
    熱點推薦

    編程之美 指揮CPU占用率

    很經典,自己可以控制CPU占用率曲線
    發表于 05-02 20:45

    proteus仿真CPU占用率過高

    proteus中哪些結構會導致仿真時CPU占用率過高,如何避免?
    發表于 09-09 23:29

    請問為什么am3354 刷新lcd時cpu占用率很高?

    %3.不接lcd跟接上的cpu占用率一樣,都很高4.fb驅動文件使用的是da8xx-fb.c請問這種現象是否為fb驅動的問題,該從哪些方面進行排查?謝謝
    發表于 06-20 05:02

    LinuxCPU和內存占用率查看

    我們經常需要查看CPU和內存占用率,否則一旦存在情況很快就會有IDC(或客戶)找上門,Linux上查看資源使用情況有多種命令可以參考,CPU、內存、IO、NETWORK等資源使用情況都
    發表于 07-24 06:52

    基于IMX6查看Linux下的CPU和內存的占用率

    ;), 100-cpu/NR}'Current CPU Utilization is : 100.00% 方法-2:如何查看 LinuxCPU
    發表于 10-30 10:18

    STM32F407的中斷CPU占用率怎么計算?

    如題!另外,假設中斷函數內的語句一樣,定時器的中斷和DMA的中斷CPU占用率一樣么?
    發表于 06-02 11:15

    如何讓CPU占用率達到100%?

    CPU占用率達到100%的方法
    發表于 11-06 06:52

    rtthread有每個線程的CPU占用率統計嗎?

    rtthread有每個線程的CPU占用率統計嗎,監控每個線程的占用時間,根據這個調整線程優先級。
    發表于 04-14 09:48

    CPU占用率100%的故障解決

      相信很多朋友都遇到過CPU占用率100%的情況,那會導致系統慢如蝸牛。半小時前,筆者正在玩游戲,電腦突然行動遲緩,打開任務管理器,發現CPU
    發表于 08-29 10:24 ?1016次閱讀

    Win10磁盤占用率100%怎么辦

    經常有網友抱怨自己的Win10運行太慢,打開任務管理器一看,磁盤占用率100%。
    的頭像 發表于 06-14 09:43 ?2.6w次閱讀
    Win10磁盤<b class='flag-5'>占用率</b><b class='flag-5'>100</b>%怎么辦

    服務器CPU占用率高的定位分析

    通過性能監控發現上線服務器cpu某核占用率已經達到了100%,而且是由我們的某個核心服務導致的。
    發表于 03-17 16:35 ?1038次閱讀

    虛擬機:查看linux線程的CPU占用率的方法

    虛擬機:查看linux線程的CPU占用率的方法
    的頭像 發表于 06-22 10:06 ?4300次閱讀
    虛擬機:查看<b class='flag-5'>linux</b>線程的<b class='flag-5'>CPU</b><b class='flag-5'>占用率</b>的方法

    Chromebook安裝更新Chrome OS或將導致CPU占用率達到100%和發熱問題

    Chromebook 在安裝最新的 Chrome OS 更新之后,會導致 Google Play Store 服務的 CPU 占用率達到 100%,并讓設備出現發熱和性能問題。在升級到
    的頭像 發表于 09-28 14:23 ?2450次閱讀
    Chromebook安裝更新Chrome OS或將導致<b class='flag-5'>CPU</b><b class='flag-5'>占用率</b>達到<b class='flag-5'>100</b>%和發熱問題

    服務器cpu占用率高怎么解決

    長時間運行的計算任務 應用程序存在內存泄漏,導致CPU占用率上升 系統問題 操作系統配置不當,導致CPU
    的頭像 發表于 10-10 15:14 ?1640次閱讀

    CPU占用率過高的常見原因

    排查系統問題時,CPU 飆升是一個常見的問題。
    的頭像 發表于 10-23 09:33 ?1538次閱讀