用 Linux 指令快速檢查伺服器硬碟健康狀態

# 用 Linux 指令快速檢查伺服器硬碟健康狀態 做 IT 嘅朋友成日都要面對一個問題:部伺服器嘅硬碟到底健唔健康?等到佢真係壞咗先發現,往往已經太遲,數據都救唔返。今日就同大家分享幾個實用嘅 Linux 指令,等你可以喺災難發生之前,及早發現硬碟嘅潛在問題。 ## 點解要定期檢查硬碟健康狀態 硬碟係伺服器入面最常壞嘅零件之一。無論係傳統嘅機械硬碟(HDD)定係固態硬碟(SSD),佢哋都有壽命。...

# 用 Linux 指令快速檢查伺服器硬碟健康狀態

做 IT 嘅朋友成日都要面對一個問題:部伺服器嘅硬碟到底健唔健康?等到佢真係壞咗先發現,往往已經太遲,數據都救唔返。今日就同大家分享幾個實用嘅 Linux 指令,等你可以喺災難發生之前,及早發現硬碟嘅潛在問題。

## 點解要定期檢查硬碟健康狀態

硬碟係伺服器入面最常壞嘅零件之一。無論係傳統嘅機械硬碟(HDD)定係固態硬碟(SSD),佢哋都有壽命。SSD 尤其有個「寫入壽命」嘅限制,寫得越多,壽命越短。定期檢查硬碟健康狀態,可以幫你:

– 及早發現壞軌(bad sector)
– 監察 SSD 嘅寫入損耗
– 預測硬碟幾時會壞,提早做備份
– 避免數據無啦啦消失

## 用 smartctl 檢查硬碟 SMART 數據

`smartctl` 係最常用嘅硬碟健康檢查工具,佢可以讀取硬碟嘅 SMART(Self-Monitoring, Analysis and Reporting Technology)數據。首先安裝佢:

sudo apt install smartmontools

安裝完之後,先睇下系統有邊啲硬碟:

lsblk

假設你嘅硬碟係 `/dev/sda`,執行以下指令睇 SMART 數據:

sudo smartctl -a /dev/sda

呢個指令會輸出好多資訊,最緊要睇幾個位:

– **SMART overall-health self-assessment test result**:如果顯示 `PASSED` 就代表基本健康
– **Reallocated_Sector_Ct**:重新分配嘅壞軌數量,數值越大越危險
– **Wear_Leveling_Count**(SSD 專用):寫入損耗程度

## 用 smartctl 跑短測試

除咗睇數據,仲可以叫硬碟自己跑測試:

sudo smartctl -t short /dev/sda

等幾分鐘之後,再睇測試結果:

sudo smartctl -l selftest /dev/sda

如果測試結果顯示 `Completed without error`,代表硬碟暫時冇問題。

## 用 badblocks 檢查壞軌

`badblocks` 係另一個檢查壞軌嘅工具,佢會逐個區塊去讀寫測試:

sudo badblocks -v /dev/sda > badblocks.txt

⚠️ 注意:呢個指令會好慢,而且對 SSD 嚟講會增加寫入損耗,所以唔建議成日跑。HDD 先至適合用呢個方法。

## 用 df 同 du 檢查磁碟空間

除咗硬碟健康,磁碟空間都係要留意嘅嘢:

df -h

呢個指令會顯示每個分割區嘅使用情況。如果某個分割區用到 90% 以上,就要諗辦法清空間或者加硬碟。

## 總結

定期檢查硬碟健康狀態係每個 IT 人嘅基本功。記住呢幾個指令:

– `smartctl -a`:睇 SMART 數據
– `smartctl -t short`:跑短測試
– `badblocks`:檢查壞軌(HDD 專用)
– `df -h`:睇磁碟空間

🔗 參考資料:NVD NIST 漏洞資料庫

養成習慣,每個月至少檢查一次,咁就可以大大減少因為硬碟突然壞咗而導致嘅數據損失。下次再同大家分享點樣設定自動化監察,等我哋唔使成日手動檢查。

#自動化 #Monitoring #技術分享 #備份 #IT教學

用 Linux 指令快速檢查伺服器硬碟健康狀態 - 文章重點速覽 infographic