在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

cpu利用率異常排查實踐與總結

Linux愛好者 ? 來源:未知 ? 作者:胡薇 ? 2018-11-15 15:33 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

1、問題背景

昨天下午突然收到運維郵件報警,顯示數據平臺服務器cpu利用率達到了98.94%,而且最近一段時間一直持續在70%以上,看起來像是硬件資源到瓶頸需要擴容了,但仔細思考就會發現咱們的業務系統并不是一個高并發或者CPU密集型的應用,這個利用率有點太夸張,硬件瓶頸應該不會這么快就到了,一定是哪里的業務代碼邏輯有問題。

2、排查思路

2.1定位高負載進程pid

首先登錄到服務器使用top命令確認服務器的具體情況,根據具體情況再進行分析判斷。

通過觀察load average,以及負載評判標準(8核),可以確認服務器存在負載較高的情況;

觀察各個進程資源使用情況,可以看出進程id為682的進程,有著較高的CPU占比

2.2定位具體的異常業務

這里咱們可以使用pwdx命令根據pid找到業務進程路徑,進而定位到負責人和項目:

可得出結論:該進程對應的就是數據平臺的web服務。

2.3定位異常線程及具體代碼行

傳統的方案一般是4步:

top oder by with P:1040 // 首先按進程負載排序找到 maxLoad(pid)

top -Hp 進程PID:1073 // 找到相關負載 線程PID

printf “0x%x ”線程PID: 0x431 // 將線程PID轉換為 16進制,為后面查找 jstack 日志做準備

jstack 進程PID | vim +/十六進制線程PID - // 例如:jstack 1040|vim +/0x431 -

但是對于線上問題定位來說,分秒必爭,上面的 4 步還是太繁瑣耗時了,之前介紹過淘寶的oldratlee 同學就將上面的流程封裝為了一個工具:show-busy-java-threads.sh,可以很方便的定位線上的這類問題:

可得出結論:是系統中一個時間工具類方法的執行cpu占比較高,定位到具體方法后,查看代碼邏輯是否存在性能問題。

※如果線上問題比較緊急,可以省略 2.1、2.2 直接執行 2.3,這里從多角度剖析只是為了給大家呈現一個完整的分析思路。

3、根因分析

經過前面的分析與排查,最終定位到一個時間工具類的問題,造成了服務器負載以及cpu使用率的過高。

異常方法邏輯:是把時間戳轉成對應的具體的日期時間格式;

上層調用:計算當天凌晨至當前時間所有秒數,轉化成對應的格式放入到set中返回結果;

邏輯層:對應的是數據平臺實時報表的查詢邏輯,實時報表會按照固定的時間間隔來,并且在一次查詢中有多次(n次)方法調用。

那么可以得到結論,如果現在時間是當天上午10點,一次查詢的計算次數就是 10*60*60*n次=36,000*n次計算,而且隨著時間增長,越接近午夜單次查詢次數會線性增加。由于實時查詢、實時報警等模塊大量的查詢請求都需要多次調用該方法,導致了大量CPU資源的占用與浪費。

4、解決方案

定位到問題之后,首先考慮是要減少計算次數,優化異常方法。排查后發現,在邏輯層使用時,并沒有使用該方法返回的set集合中的內容,而是簡單的用set的size數值。確認邏輯后,通過新方法簡化計算(當前秒數-當天凌晨的秒數),替換調用的方法,解決計算過多的問題。上線后觀察服務器負載和cpu使用率,對比異常時間段下降了30倍,恢復至正常狀態,至此該問題得已解決。

5、總結

在編碼的過程中,除了要實現業務的邏輯,也要注重代碼性能的優化。一個業務需求,能實現,和能實現的更高效、更優雅其實是兩種截然不同的工程師能力和境界的體現,而后者也是工程師的核心競爭力。

在代碼編寫完成之后,多做 review,多思考是不是可以用更好的方式來實現。

線上問題不放過任何一個小細節!細節是魔鬼,技術的同學需要有刨根問題的求知欲和追求卓越的精神,只有這樣,才能不斷的成長和提升。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • cpu
    cpu
    +關注

    關注

    68

    文章

    11063

    瀏覽量

    216478
  • 編碼
    +關注

    關注

    6

    文章

    967

    瀏覽量

    55624

原文標題:CPU 100% 異常排查實踐與總結

文章出處:【微信號:LinuxHub,微信公眾號:Linux愛好者】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    如何利用UCOSII中的統計任務 OS_TaskStat()知道了CPU利用率100%把利用率降下來?

    冒昧的問一下各路大神,假如我們利用UCOSII中的統計任務 OS_TaskStat()知道了CPU利用率100%,則應該怎樣操作,把利用率降下來?另外,
    發表于 07-12 04:36

    Post綜合后的利用率只不過是實施后的利用率

    嗨,Post綜合后的利用率只不過是實施后的利用率......?謝謝娜文G K.
    發表于 05-12 08:57

    UCOS3的CPU利用率問題怎么解決

    我在寫的CPU利用率程序:(改的原子哥的代碼)void census_task(void *p_arg){OS_ERR err;CPU_SR_ALLOC(); CPU_STK_SIZE
    發表于 05-20 04:24

    如何獲取棧利用率

    如何獲取棧利用率
    發表于 02-16 07:34

    如何去實現一種CPU利用率及堆棧檢測統計

    uCOS-III(16) CPU利用率及堆棧檢測統計基本概念代碼基本概念CPU利用率是單位時間內cpu在運行的時間百分比。可用于衡量系統設
    發表于 02-18 06:31

    RT-Thread CPU利用率的統計與測試步驟

    1 CPU利用率統計全速運行:不響應中斷,也不去執行其他任務,就單純讓它在一個地方持續運行一段時間,這個值可以體現CPU的算力有多大。total_count:單位時間內全速運行下的變量值,表現了
    發表于 05-13 15:27

    CPU利用率問題求解

    “你能不能實現一個理想情況下應該在每個時間片開始時執行的監控任務,并確定前一個時間片的利用率。如果利用率過高,則應發出警告。如果我們可以使用空閑時間,那么我們就可以衡量利用率。為了設置這個監視器
    發表于 12-06 06:00

    如何知道CPU利用率和內存使用情況?

    我在 MIMXRT1062 板上工作,我使用了“EVK-MIMXRT1060-guix_washing_machine”示例。我想要 CPU 利用率和內存使用情況。請給我有關它的信息,我也想知道它是如何計算的。
    發表于 03-31 06:21

    活性物質利用率

    活性物質利用率 電池具有活性物質的量與按法拉弟定律計算應產生的電量稱為理論容量。要求電極給出一定的電量時,電極的活性物質利用率可表示為
    發表于 11-06 11:02 ?2588次閱讀

    關于Swarm和Mesos資源利用率優化實踐分析

    資源調度領域的優秀經驗,以及他們在Mesos社區為提升Mesos資源利用率而正在進行的實踐活動,深度剖析了Mesos資源的收集和調度原理,以及如何在Mesos中提供Revocable資源來提高Mesos
    發表于 10-10 11:54 ?0次下載
    關于Swarm和Mesos資源<b class='flag-5'>利用率</b>優化<b class='flag-5'>實踐</b>分析

    利用率的獲取

    值.利用率 = 已使用 / 棧大小.#if defined(ARCH_CPU_STACK_GROWS_UPWARD) ptr = (rt_uint8_t *)thread->stack_addr + thread->stack_siz
    發表于 12-20 19:03 ?8次下載
    棧<b class='flag-5'>利用率</b>的獲取

    uCOS-III(16) CPU利用率及堆棧檢測統計

    uCOS-III(16) CPU利用率及堆棧檢測統計基本概念代碼基本概念CPU利用率是單位時間內cpu在運行的時間百分比。可用于衡量系統設
    發表于 12-23 19:54 ?6次下載
    uCOS-III(16) <b class='flag-5'>CPU</b><b class='flag-5'>利用率</b>及堆棧檢測統計

    Linux系統CPU 100%異常排查實踐與總結

    但是對于線上問題定位來說,分秒必爭,上面的 4 步還是太繁瑣耗時了,之前介紹過淘寶的oldratlee 同學就將上面的流程封裝為了一個工具:show-busy-java-threads.sh,可以很方便的定位線上的這類問題:
    的頭像 發表于 02-23 09:54 ?2021次閱讀

    常見GPU利用率低原因分析

    GPU 任務會交替的使用 CPU 和 GPU 進行計算,當 CPU 計算成為瓶頸時,就會出現 GPU 等待的問題,GPU 空跑那利用率就低了。
    發表于 06-19 12:22 ?2036次閱讀
    常見GPU<b class='flag-5'>利用率</b>低原因分析

    GPU利用率低的本質原因

    、GPU 利用率低的本質 常見 GPU 任務運行流程圖如下: 如上圖所示,GPU 任務會交替的使用 CPU 和 GPU 進行計算,
    的頭像 發表于 06-19 14:07 ?1614次閱讀
    GPU<b class='flag-5'>利用率</b>低的本質原因
    主站蜘蛛池模板: 夜夜操天天爽 | 亚洲国产成人久久77 | 日韩欧美中文字幕在线视频 | 成年人午夜影院 | 久久伊人精品青青草原高清 | 国产成人啪午夜精品网站男同 | 99热网址 | 日本视频一区在线观看免费 | 免费高清特黄a 大片 | semimi亚洲综合在线观看 | 日本www网站 | 亚洲乱码中文字幕综合 | 免费在线看片网站 | 在线色片 | 久久噜噜噜久久亚洲va久 | 婷婷综合久久中文字幕 | 日韩精品视频免费观看 | 黄 色 成 年人在线 黄a大片 | 在线视频黄色 | 国产精品女仆装在线播放 | 国产免费卡1卡2卡 | 天天爽夜夜爽精品视频一 | 日韩一级片在线播放 | 一级黄色免费毛片 | 色婷婷久 | 日韩xx00 | 免费a网站| 韩国xxxxx视频在线 | 一级日本高清视频免费观看 | 国产精品嫩草影院午夜 | 可以免费观看的黄色网址 | 中文字幕一区2区 | 国色天香精品亚洲精品 | 视色4se在线视频播放 | semimi亚洲综合在线观看 | 久久夜色精品国产尤物 | 亚洲乱码一区二区三区在线观看 | 福利一级片| 婷婷丁香激情 | 一级特黄高清完整大片 | 成年网站在线观看 |