- เทคโนโลยี SMART ช่วยให้คุณตรวจสอบพารามิเตอร์ที่สำคัญของดิสก์และคาดการณ์ความล้มเหลวเพื่อกู้คืนข้อมูลได้ทันท่วงที
- เครื่องมือต่างๆ เช่น CrystalDiskInfo, CHKDSK, Disk Utility หรือ smartctl ช่วยให้การอ่านและทำความเข้าใจสถานะของดิสก์เป็นเรื่องง่าย
- NAS และเซิร์ฟเวอร์มีการตรวจสอบ SMART เป็นระยะ ซึ่งเมื่อรวมกับ RAID และการสำรองข้อมูล จะช่วยลดความเสี่ยงได้
- การระบายอากาศที่ดี การใช้งานที่ถูกต้อง และการเลือกใช้ฮาร์ดแวร์ที่มีคุณภาพ จะช่วยยืดอายุการใช้งานของฮาร์ดดิสก์ (HDD) และโซลิดสเตทไดรฟ์ (SSD) ได้

แทบไม่มีใครนึกถึงฮาร์ดไดรฟ์ของตัวเองจนกว่ามันจะเริ่มส่งเสียงแปลกๆ คอมพิวเตอร์ทำงานช้าลง หรือเกิดหน้าจอสีฟ้าที่น่ากลัวขึ้นมา อย่างไรก็ตามการตรวจสอบสถานะของไดรฟ์ (HDD, SSD หรือ M.2) อย่างสม่ำเสมอเป็นหนึ่งในวิธีที่ดีที่สุดในการปกป้องคอมพิวเตอร์ เซิร์ฟเวอร์ หรือ NAS ของคุณจากปัญหาที่ไม่คาดคิด
ในคู่มือนี้ คุณจะได้เรียนรู้รายละเอียดอย่างครบถ้วนเกี่ยวกับวิธีการอ่านสถานะของดิสก์ ความหมายของพารามิเตอร์ SMART อาการที่บ่งชี้ถึงความล้มเหลว และเครื่องมือที่มีให้ใช้งานใน Windows, macOS และ Linux รวมถึงยูทิลิตี้ในตัวและโปรแกรมภายนอก เช่น CrystalDiskInfo หรือ smartmontools เป้าหมายคือเพื่อให้คุณสามารถตรวจจับดิสก์ที่กำลังจะเสียได้ก่อนที่จะสายเกินไป เมื่ออ่านบทความนี้จบ
ทำไมการตรวจสอบสภาพของแผ่นดิสก์จึงสำคัญนัก?
ฮาร์ดไดรฟ์หรือ SSD ไม่เพียงแต่จัดเก็บเอกสารของคุณเท่านั้น แต่ยังเก็บระบบปฏิบัติการ โปรแกรม เกม และข้อมูลสำคัญในการทำงานอีกด้วยหากไดรฟ์เกิดความเสียหายกะทันหัน คอมพิวเตอร์อาจใช้งานไม่ได้ และการกู้คืนไฟล์จากดิสก์จะเป็นเรื่องยุ่งยากและมีค่าใช้จ่ายสูง หรืออาจทำไม่ได้เลยด้วยซ้ำ
นอกจากนี้หน่วยจัดเก็บข้อมูลทั้งหมดมีอายุการใช้งานที่จำกัดโดยในฮาร์ดดิสก์แบบกลไก (HDD) โดยทั่วไปจะมีอายุการใช้งานเพียงไม่กี่หมื่นชั่วโมง ในขณะที่ SSD นั้น ขีดจำกัดจะวัดเป็น TBW (TeraBytes written) ก่อนที่เซลล์หน่วยความจำจะเสื่อมสภาพและเริ่มทำงานผิดพลาด
ปัจจัยสำคัญอีกประการหนึ่งคือการเสื่อมสภาพของฮาร์ดดิสก์มักเกิดขึ้นโดยไม่มีสัญญาณเตือนล่วงหน้าเซกเตอร์เสีย ข้อผิดพลาดในการอ่าน หรือปัญหาเรื่องอุณหภูมิ อาจสะสมอยู่เป็นเวลาหลายเดือนโดยที่คุณไม่ทันสังเกตเห็นอะไรผิดปกติ... จนกระทั่งวันหนึ่งระบบหยุดทำงานหรือไฟล์ของคุณปรากฏขึ้นว่าเสียหาย
ในสภาพแวดล้อมการทำงานระดับมืออาชีพ (เซิร์ฟเวอร์, NAS, เวิร์กสเตชันที่สำคัญ) สถานการณ์จะยิ่งร้ายแรงกว่า เพราะความล้มเหลวของฮาร์ดดิสก์อย่างกะทันหันอาจทำให้บริการหยุดชะงัก ตัดการเข้าถึงข้อมูลสำคัญ และก่อให้เกิดความสูญเสียทางการเงินการหยุดชะงักทางธุรกิจ และแม้กระทั่งปัญหาด้านชื่อเสียงของบริษัท
อาการที่บ่งชี้ว่าฮาร์ดไดรฟ์หรือ SSD ของคุณอาจกำลังเสีย
ก่อนที่จะไปดูเครื่องมือต่างๆ เราควรทราบถึงสัญญาณทั่วไปของฮาร์ดไดรฟ์ที่เสียเสียก่อน เพราะบ่อยครั้งที่ผู้ใช้จะเป็นคนแรกที่สังเกตเห็นสิ่งผิดปกติขณะใช้งานคอมพิวเตอร์ในชีวิตประจำวัน
ตัวบ่งชี้ที่พบได้บ่อยมากคือประสิทธิภาพการทำงานที่ช้าผิดปกติ : ระบบใช้เวลานานในการเริ่มต้น เปิดโฟลเดอร์ หรือโหลดแอปพลิเคชัน หรือคุณสังเกตเห็นว่าทุกอย่างกระตุกแม้ว่าการใช้งาน CPU และ RAM จะไม่สูงก็ตาม
นอกจากนี้ยังมีอาการที่รุนแรงกว่า เช่นเครื่องค้างโดยไม่ทราบสาเหตุ การปิดเครื่องโดยไม่คาดคิด หน้าจอสีฟ้าใน Windowsหรือการรีสตาร์ทเองโดยไม่มีเหตุผล ซึ่งมักเกิดจากข้อผิดพลาดในการอ่านข้อมูลในเซกเตอร์ของดิสก์ที่เก็บไฟล์ระบบอยู่
ในฮาร์ดดิสก์แบบกลไก ควรให้ความสนใจกับเสียงผิดปกติ เช่น เสียงคลิก เสียงเคาะ หรือเสียงหึ่งๆเสียงเหล่านี้อาจบ่งบอกถึงปัญหาที่แกนหมุน จานหมุน หรือหัวอ่าน และโดยปกติแล้วจะเป็นสัญญาณที่ไม่ดีหากเสียงเหล่านั้นเกิดขึ้นซ้ำๆ อย่างต่อเนื่อง
สัญญาณเตือนที่สำคัญอีกประการหนึ่งคือความเสียหายของไฟล์และโฟลเดอร์เช่น เอกสารที่เปิดไม่ได้กะทันหัน รูปภาพเสียหาย ข้อผิดพลาดขณะคัดลอกข้อมูล หรือข้อความแจ้งเตือนจากระบบเกี่ยวกับข้อผิดพลาดของดิสก์ เซกเตอร์เสีย หรือโครงสร้างระบบไฟล์เสียหาย
สุดท้ายนี้ ยังมีสัญญาณทางกายภาพหรือตรรกะที่ชัดเจนมาก เช่นเครื่องร้อนจัดผิดปกติ ข้อความแสดงข้อผิดพลาด BIOS/UEFI ขณะบูตเครื่อง ดิสก์หายไปจากระบบหรือแม้แต่ระบบปฏิบัติการไม่สามารถเริ่มต้นทำงานได้
SMART คืออะไร และเหตุใดจึงเป็นพื้นฐานในการตรวจสอบสถานะของฮาร์ดดิสก์?
ฮาร์ดไดรฟ์สมัยใหม่ทั้งหมด ไม่ว่าจะเป็นHDD แบบดั้งเดิม SSD หรือ NVMe ต่าง ก็มีเทคโนโลยีที่เรียกว่า SMART (Self-Monitoring, Analysis and Reporting Technology) ซึ่งทำหน้าที่เสมือน "กล่องดำ" สำหรับไดรฟ์นั้นๆ
SMART ตรวจสอบพารามิเตอร์ภายในหลายสิบรายการที่เกี่ยวข้องกับความน่าเชื่อถือของดิสก์เช่น ความเร็วในการหมุน ข้อผิดพลาดในการอ่าน/เขียน เซกเตอร์ที่ถูกกำหนดใหม่ เวลาในการเริ่มต้นทำงาน ข้อผิดพลาด CRC บนอินเทอร์เฟซ อุณหภูมิ ชั่วโมงการทำงาน จำนวนครั้งที่เปิดเครื่อง ฯลฯ
คุณลักษณะแต่ละอย่างเหล่านี้มีช่วงค่าที่ถือว่าปกติเมื่อใดก็ตามที่พารามิเตอร์ใดๆ อยู่นอกเหนือขอบเขตเหล่านี้ SMART จะระบุว่าเป็นปัญหาที่อาจเกิดขึ้น และเฟิร์มแวร์ของดิสก์สามารถแจ้งให้ระบบปฏิบัติการแสดงคำเตือนหรือเริ่มการตรวจสอบไดรฟ์ได้
จุดประสงค์ของระบบ SMART คือการแจ้งเตือนล่วงหน้าว่าฮาร์ดไดรฟ์อาจเสียหาย เพื่อให้คุณสามารถสำรองข้อมูลและเปลี่ยนฮาร์ด ไดรฟ์ใหม่ ได้ก่อนที่จะเกิดปัญหาขึ้น การเพิกเฉยต่อการแจ้งเตือนเหล่านี้มักส่งผลให้ข้อมูลสูญหายและฮาร์ดไดรฟ์จะต้องส่งไปให้บริษัทกู้ข้อมูลมืออาชีพซ่อมแซมเท่านั้น
เพื่อให้สามารถใช้ประโยชน์จาก SMART ได้อย่างเต็มที่ BIOS หรือ UEFI ของคอมพิวเตอร์ของคุณต้องเปิดใช้งานฟังก์ชันนี้ และระบบปฏิบัติการหรือเครื่องมือตรวจสอบต้องสามารถอ่านค่าแอตทริบิวต์ได้ปัจจุบันพีซี เซิร์ฟเวอร์ และอุปกรณ์ NAS เกือบทั้งหมดสามารถใช้งานร่วมกันได้
วิธีตรวจสอบสถานะสุขภาพของดิสก์ด้วย CrystalDiskInfo
หนึ่งในวิธีที่ง่ายที่สุดและเห็นภาพชัดเจนที่สุดในการตรวจสอบสถานะของดิสก์ใน Windows คือการใช้CrystalDiskInfo ซึ่งเป็นยูทิลิตี้โอเพนซอร์สฟรีที่แสดงสถานะ SMART ของไดรฟ์ได้อย่างชัดเจน
สิ่งแรกที่คุณควรทำคือดาวน์โหลด CrystalDiskInfo จากเว็บไซต์ทางการของ CrystalMarkขอแนะนำให้เลือกเวอร์ชันพื้นฐานที่ไม่มีการตกแต่งหรือส่วนเสริมแปลก ๆ และถ้าเป็นไปได้ให้เลือกเวอร์ชัน "พกพา" ที่ไม่จำเป็นต้องติดตั้ง
หลังจากดาวน์โหลดไฟล์ .exe แล้ว คุณสามารถเรียกใช้เวอร์ชันพกพาได้โดยตรง หรือติดตั้งหากคุณเลือกตัวติดตั้งแบบคลาสสิกในทั้งสองกรณี โปรแกรมจะขอสิทธิ์ผู้ดูแลระบบในครั้งแรกเพื่อเข้าถึงข้อมูลไดรฟ์
เมื่อคุณเปิด CrystalDiskInfo แอปพลิเคชันจะวิเคราะห์ดิสก์ที่มีอยู่ในระบบโดยอัตโนมัติ และแสดงกล่องหลักที่มี "สถานะสุขภาพ" และอุณหภูมิของไดรฟ์ที่เลือกหากทุกอย่างปกติ คุณจะเห็นสถานะ "ดี" เป็นสีน้ำเงิน
หากฮาร์ดดิสก์ไม่สมบูรณ์ โปรแกรม CrystalDiskInfo จะแสดงเปอร์เซ็นต์ความสมบูรณ์ของดิสก์ และอาจเปลี่ยนสีสถานะเป็นสีเหลือง (ระวัง) หรือสีแดง (แย่)ซึ่งบ่งชี้ถึงปัญหาที่ร้ายแรง และคุณควรสำรองข้อมูลและพิจารณาเปลี่ยนฮาร์ดดิสก์ใหม่โดยเร็วที่สุด
นอกจากสถานะและอุณหภูมิแล้ว เครื่องมือนี้ยังมีตารางข้อมูลที่สมบูรณ์พร้อมคุณลักษณะ SMART ทั้งหมดเช่น เซกเตอร์ที่ถูกกำหนดใหม่ ข้อผิดพลาดในการอ่าน จำนวนเหตุการณ์การกำหนดใหม่ เซกเตอร์ที่รอการแก้ไข ข้อผิดพลาดที่ไม่สามารถแก้ไขได้ อัตราข้อผิดพลาดในการค้นหา เป็นต้น
ด้านขวามือ คุณจะเห็นข้อมูลต่างๆ เช่นเฟิร์มแวร์ของดิสก์ หมายเลขซีเรียล อินเทอร์เฟซ มาตรฐานที่รองรับ คุณสมบัติที่ใช้งานอยู่ (รวมถึง SMART) จำนวนครั้งที่เปิดเครื่อง และชั่วโมงการทำงานตลอดจนสถิติการอ่านและการเขียนในกรณีของ SSD
นอกจากนี้ CrystalDiskInfo ยังช่วยให้คุณตั้งค่าการแจ้งเตือนเกี่ยวกับอุณหภูมิและสถานะสุขภาพได้ คุณสามารถปรับค่าเกณฑ์ได้ตามต้องการ เพื่อให้เมื่อดิสก์ร้อนเกินไปหรือสถานะสุขภาพลดลงต่ำกว่าค่าที่กำหนด Windows จะแสดงคำเตือนหรือส่งเสียงแจ้งเตือน
จากเมนูฟังก์ชัน คุณสามารถปรับแต่งความถี่ในการอัปเดตข้อมูล การรวมเข้ากับถาดระบบ ธีมภาพ ขนาดตัวอักษร และแม้แต่ซ่อนหมายเลขประจำเครื่องได้หากต้องการแชร์ภาพหน้าจอโดยไม่เปิดเผยข้อมูลนั้น
โปรแกรมตรวจสอบดิสก์อื่นๆ และทางเลือกอื่นๆ นอกเหนือจาก CrystalDiskInfo
แม้ว่า CrystalDiskInfo จะเป็นหนึ่งในตัวเลือกยอดนิยม แต่ก็ยังมีเครื่องมืออื่นๆ อีกมากมายสำหรับการวิเคราะห์สุขภาพของฮาร์ดไดรฟ์ทั้งแบบฟรีและเสียเงิน และมีเวอร์ชันสำหรับระบบปฏิบัติการต่างๆ ด้วย
ในระบบปฏิบัติการ Windows คุณจะพบยูทิลิตี้ต่างๆ เช่นHDDScan, DiskCheckup หรือ GSmartControlซึ่งมีฟังก์ชันการอ่านค่า SMART ขั้นสูง การทดสอบพื้นผิว การตรวจสอบอุณหภูมิ และการสร้างรายงานโดยละเอียดสำหรับช่างเทคนิค
ระบบปฏิบัติการ macOS มีโซลูชันต่างๆ เช่นiStat Menusซึ่งสามารถแสดงอุณหภูมิแบบเรียลไทม์ สถานะ SMART และพารามิเตอร์ประสิทธิภาพอื่นๆ โดยผสานรวมเข้ากับแถบเมนูเพื่อให้ทุกอย่างมองเห็นได้ง่าย
ชุดโปรแกรมรักษาความปลอดภัยและบำรุงรักษาจำนวนมากมีโมดูลเฉพาะสำหรับดิสก์ ตัวอย่างเช่นโปรแกรมป้องกันไวรัสและเครื่องมือเพิ่มประสิทธิภาพระบบบางตัวจะรวมเอาตัวตรวจสอบสถานะของ HDD/SSDที่ตรวจสอบ SMART ตรวจจับเซกเตอร์เสีย และแม้กระทั่งช่วยกำหนดเวลาการจัดเรียงข้อมูลหรือการเพิ่มประสิทธิภาพ
อย่างไรก็ตาม สิ่งสำคัญคือต้องเข้าใจว่าไม่มีโปรแกรมมหัศจรรย์ใดที่จะแก้ไขความเสียหายทางกายภาพร้ายแรงของฮาร์ดดิสก์ได้โปรแกรมเหล่านี้มีประโยชน์ในฐานะระบบแจ้งเตือนและวินิจฉัยปัญหา แต่หาก SMART ระบุว่ามีปัญหาที่ร้ายแรง สิ่งสำคัญอันดับแรกคือการกู้คืนข้อมูลและซ่อมแซมฮาร์ดดิสก์หรือเปลี่ยนฮาร์ดดิสก์ใหม่
ตรวจสอบสถานะดิสก์ใน Windows (SMART, CHKDSK และ BIOS)
โดยไม่ต้องติดตั้งอะไรเพิ่มเติม Windows ก็มีวิธีการตรวจสอบสถานะ SMART พื้นฐานและวิเคราะห์พื้นที่ดิสก์เชิงตรรกะ อยู่หลายวิธีแล้ว ทั้งผ่านทางอินเทอร์เฟซแบบกราฟิกและเครื่องมือบรรทัดคำสั่ง
เพื่อตรวจสอบอย่างรวดเร็ว คุณสามารถเปิดCommand Prompt (cmd)ในฐานะผู้ดูแลระบบ และเรียกใช้คำสั่ง wmic diskdrive get status ซึ่งจะอ่านสถานะ SMART และส่งคืน "OK" หากดิสก์อยู่ในพารามิเตอร์ปกติ หรือ "Pred Fail" เมื่อตรวจพบความเสี่ยงที่จะเกิดความเสียหายในทันที
โดยหลักการแล้ว หากผลลัพธ์เป็น "OK" จะไม่มีสัญญาณเตือนถึงความล้มเหลวในทันทีแม้ว่าจะยังคงแนะนำให้ทำการบำรุงรักษาและสำรองข้อมูลเป็นระยะก็ตาม หากปรากฏข้อความ "Pred Fail" คุณต้องสันนิษฐานว่าอุปกรณ์อาจล้มเหลวได้ทุกเมื่อและต้องดำเนินการอย่างรวดเร็ว
อีกหนึ่งเครื่องมือคลาสสิกของ Windows คือCHKDSK (Check Disk)ซึ่งจะตรวจสอบความสมบูรณ์ของระบบไฟล์ ค้นหาเซกเตอร์เสียเชิงตรรกะ และหากได้รับคำสั่ง ก็จะพยายามซ่อมแซมข้อผิดพลาดในโครงสร้างข้อมูลของพาร์ติชั่น
ในการเรียกใช้คำสั่ง ให้เปิด cmd อีกครั้งในฐานะผู้ดูแลระบบ และเรียกใช้คำสั่งchkdsk /f บนไดรฟ์ที่คุณต้องการวิเคราะห์สำหรับไดรฟ์ระบบ โดยปกติแล้วจะขออนุญาตในการดำเนินการดังกล่าวเมื่อรีสตาร์ทครั้งถัดไป และสิ่งสำคัญคืออย่าขัดจังหวะกระบวนการ เนื่องจากรายงานฉบับสุดท้ายจะระบุว่าพบปัญหาอะไรบ้างและได้รับการแก้ไขแล้ว
ผู้ผลิตบางราย เช่น HP จะมีโปรแกรมยูทิลิตี้ของตนเอง (HP Support Assistant, Dell Support เป็นต้น) ที่มีฟังก์ชันทดสอบฮาร์ดแวร์เฉพาะสำหรับดิสก์เช่น การทดสอบการอ่าน การตรวจสอบพื้นผิว หรือการวินิจฉัยปัญหาอย่างครบถ้วนด้วยการคลิกเพียงครั้งเดียว
หากคุณคุ้นเคยกับการบูตเครื่องคอมพิวเตอร์ คุณสามารถเข้าสู่ BIOS/UEFI และมองหาตัวเลือกการวินิจฉัยดิสก์ได้ คอมพิวเตอร์สมัยใหม่หลายเครื่องอนุญาตให้คุณทำการทดสอบแบบรวดเร็วหรือแบบละเอียดบนไดรฟ์ที่เชื่อมต่อจากส่วนนี้ได้
วิธีตรวจสอบสถานะดิสก์ใน macOS
บนเครื่อง Mac เครื่องมือมาตรฐานสำหรับตรวจสอบและซ่อมแซมดิสก์คือ Disk Utilityซึ่งติดตั้งมาพร้อมกับระบบ และช่วยให้คุณสามารถตรวจสอบระบบไฟล์และอ่านสถานะ SMART ของไดรฟ์ภายในได้
วิธีใช้งาน ให้ไปที่ แอปพลิเคชัน > ยูทิลิตี้ แล้วเปิดดิสก์ ยูทิลิตี้ เลือกดิสก์จริงในแผงด้านซ้าย (ไม่ใช่แค่พาร์ติชั่น) และดูข้อมูลที่ปรากฏที่ด้านล่างของหน้าต่าง
ในบันทึกนั้น คุณจะเห็นผลลัพธ์ของการทดสอบ SMARTในช่องที่เรียกว่า “สถานะ SMART” หากระบุว่า “ตรวจสอบแล้ว” ระบบจะถือว่าอุปกรณ์อยู่ในสภาพดี ในขณะที่สถานะ “ล้มเหลว” หรือข้อความที่มีคำว่า “ร้ายแรง” หรือ “ข้อผิดพลาด” เป็นสัญญาณว่าคุณควรทำการสำรองข้อมูลโดยเร็วที่สุด
จากเครื่องมือเดียวกันนี้ คุณสามารถใช้ฟังก์ชันFirst Aid เพื่อลองแก้ไขข้อผิดพลาดเชิงตรรกะในระบบไฟล์ซึ่งมีประโยชน์มากหากคุณตรวจพบปัญหาในการติดตั้งไดรฟ์ การเข้าถึงโฟลเดอร์ช้า หรือแอปพลิเคชันปิดตัวลงโดยไม่คาดคิด
แม้ว่า Disk Utility จะให้ภาพรวมที่ค่อนข้างชัดเจน แต่หากคุณต้องการตรวจสอบข้อมูลเพิ่มเติม ก็มีเครื่องมือจากผู้พัฒนาภายนอกสำหรับ macOS ที่สามารถขยายข้อมูล SMART บันทึกอุณหภูมิและประสิทธิภาพ และแสดงกราฟข้อมูลย้อนหลังซึ่งมีประโยชน์มากสำหรับการตรวจสอบในระยะยาว
วิธีการตรวจสอบสถานะสุขภาพของดิสก์ใน Linux โดยใช้ smartmontools
ในสภาพแวดล้อม Linux และ Unix เอกสารอ้างอิงสำหรับการทำงานกับ SMART คือแพ็กเกจ smartmontools ซึ่งประกอบด้วยยูทิลิตี้ smartctl (สำหรับการใช้งานเป็นครั้งคราว) และ smartd (ดีมอนสำหรับตรวจสอบ) ซึ่งมีอยู่ในแทบทุกดิสทริบิวชัน
ใน Debian, Ubuntu และระบบปฏิบัติการที่พัฒนาต่อยอดจาก Debian คุณสามารถติดตั้งได้ด้วยคำสั่ง sudo apt install smartmontoolsในขณะที่ในระบบปฏิบัติการอื่นๆ คุณจะต้องใช้ตัวจัดการแพ็กเกจที่เหมาะสม (yum, dnf, pacman, zypper เป็นต้น) และระบบปฏิบัติการประเภท BSD ก็มีให้ใช้งานเช่นกัน
ก่อนทำการทดสอบ ควรตรวจสอบก่อนว่าคุณมีดิสก์อะไรบ้างและอยู่ที่ใด ซึ่งคุณสามารถตรวจสอบได้ด้วยคำสั่งเช่นdf -ho หรือ sudo fdisk -lซึ่งจะแสดงรายการไดรฟ์และพาร์ติชั่นที่มีอยู่ในระบบของคุณ
SMART จะถูกจัดการที่ระดับดิสก์ทางกายภาพเสมอ ดังนั้นคุณจะทำงานกับพาธต่างๆ เช่น/dev/sda, /dev/sdb, /dev/nvme0n1 เป็นต้นและไม่ใช่พาร์ติชัน เช่น /dev/sda1, /dev/sda2 เป็นต้น นี่เป็นรายละเอียดที่สำคัญเพื่อให้คำสั่งทำงานได้อย่างถูกต้อง
ในการตรวจสอบว่าไดรฟ์รองรับ SMART หรือไม่ และเปิดใช้งานอยู่หรือไม่ คุณสามารถเรียกใช้คำสั่ง`sudo smartctl -i /dev/sda`หากรองรับแต่ปิดใช้งานอยู่ คุณสามารถเปิดใช้งานได้ด้วย คำ สั่ง `sudo smartctl -s on /dev/sda`เพื่อเริ่มลงทะเบียนแอตทริบิวต์
การใช้คำสั่ง`sudo smartctl -a /dev/sda`จะให้รายงานที่สมบูรณ์มากพร้อมด้วยคุณลักษณะ SMART ทั้งหมด ค่าปัจจุบัน เกณฑ์ จำนวนดิบ และบันทึกเหตุการณ์ ซึ่งผลลัพธ์นี้คือสิ่งที่คุณมักตรวจสอบเมื่อต้องการวินิจฉัยอย่างละเอียด
Smartctl อนุญาตให้คุณทำการทดสอบภายในได้สองประเภทหลักได้แก่ การทดสอบแบบสั้นและการทดสอบแบบยาว การทดสอบแบบสั้นใช้เวลาเพียงไม่กี่นาทีและใช้เพื่อตรวจจับปัญหาพื้นฐาน ในขณะที่การทดสอบแบบยาวอาจใช้เวลานานกว่ามากเนื่องจากจะสแกนพื้นผิวทั้งหมดของไดรฟ์
หากต้องการเริ่มการทดสอบแบบสั้น คุณสามารถใช้คำสั่ง`sudo smartctl -t short /dev/sda`และสำหรับการตรวจสอบแบบยาว ให้ ใช้คำสั่ง `sudo smartctl -t long /dev/sda`เมื่อเสร็จสิ้นแล้ว คุณสามารถตรวจสอบผลลัพธ์ได้ด้วยคำสั่ง`sudo smartctl -H /dev/sda`หรือตรวจสอบรายงานฉบับเต็มอีกครั้งด้วยตัวเลือก `-a`
บนเซิร์ฟเวอร์ Linux และอุปกรณ์ NAS เป็นเรื่องปกติที่จะกำหนดเวลาการทดสอบเหล่านี้ด้วย cron โดยทำการทดสอบสั้นๆ สัปดาห์ละครั้ง และการทดสอบที่ใช้เวลานานเดือนละครั้ง เป็นต้นโดยมักจะทำในช่วงเวลาที่ไม่ใช่ช่วงเวลาที่มีการใช้งานสูงสุด เพื่อลดผลกระทบต่อประสิทธิภาพให้น้อยที่สุด
คุณลักษณะ SMART ที่สำคัญที่สุดเมื่อประเมินฮาร์ดไดรฟ์
เมื่อคุณเริ่มอ่านรายงาน SMART คุณจะพบตารางที่เต็มไปด้วยชื่อและตัวเลขซึ่งอาจดูน่ากลัวเล็กน้อยแต่จริงๆ แล้วมีคุณลักษณะสำคัญบางประการที่ควรให้ความสนใจเป็นพิเศษ
หนึ่งในค่าที่เกี่ยวข้องมากที่สุดคือReallocated_Sector_Ct (จำนวนเซกเตอร์ที่ถูกจัดสรรใหม่)ซึ่งบ่งชี้ว่ามีเซกเตอร์เสียจำนวนเท่าใดที่ถูกย้ายไปยังพื้นที่สำรองของดิสก์ ค่าที่ไม่เป็นศูนย์ไม่ได้หมายความว่าจะเกิดหายนะเสมอไป แต่ถ้าค่านี้เพิ่มขึ้นเรื่อย ๆ มักจะเป็นสัญญาณที่ไม่ดี
สิ่งที่สำคัญอีกอย่างคือReallocated_Event_Count ซึ่งสะท้อนถึงจำนวนรวมของเหตุการณ์การจัดสรรพื้นที่ใหม่ (ไม่ว่าจะสำเร็จหรือไม่ก็ตาม) การเพิ่มขึ้นอย่างต่อเนื่องของตัวนับนี้บ่งชี้ว่าพื้นผิวของดิสก์เริ่มเสื่อมสภาพแล้ว
คุณลักษณะ Current_Pending_Sector ระบุจำนวนเซกเตอร์ที่รอการจัดสรรใหม่เซกเตอร์เหล่านี้คือเซกเตอร์ที่ก่อให้เกิดปัญหาในการอ่านหรือเขียน และดิสก์กำลังตรวจสอบเพื่อตัดสินใจว่าจะสามารถกู้คืนได้หรือควรจัดสรรใหม่
อีกฟิลด์หนึ่งที่ควรจับตาคือOffline_Uncorrectable ซึ่งนับจำนวนข้อผิดพลาดที่ไม่สามารถแก้ไขได้ในการทำงานแบบออฟไลน์ ตัวเลขที่สูงหมายความว่ามีบางส่วนของดิสก์ที่ไม่สามารถเข้าถึงได้อย่างน่าเชื่อถืออีกต่อไป และส่งผลกระทบโดยตรงต่อข้อมูลของคุณ
ในฮาร์ดดิสก์แบบกลไก คุณสมบัติต่างๆ เช่นSpin_Retry_Count (จำนวนครั้งที่พยายามเริ่มหมุน)หรือMulti_Zone_Error_Rate (อัตราข้อผิดพลาดระหว่างการเขียนในโซนต่างๆ)ช่วยตรวจจับปัญหาในมอเตอร์หรือหัวอ่านก่อนที่ความเสียหายจะถาวร
NAS และเซิร์ฟเวอร์: ตรวจสอบดิสก์บน QNAP, Synology และอุปกรณ์อื่นๆ
ในโลกของเซิร์ฟเวอร์ NAS (เช่น QNAP, Synology, ASUSTOR เป็นต้น) ผู้ผลิตมักจะรวมระบบตรวจสอบสุขภาพดิสก์อัตโนมัติไว้ ด้วย ซึ่งสามารถเข้าถึงได้จากเว็บอินเตอร์เฟสโดยไม่ต้องใช้เทอร์มินัล
ตัวอย่างเช่น ใน QNAP คุณสามารถไปที่"พื้นที่จัดเก็บและสแนปช็อต" จากนั้นไปที่ "พื้นที่จัดเก็บ / ดิสก์"เพื่อดูสรุปสถานะของไดรฟ์ทั้งหมด พร้อมข้อมูลเกี่ยวกับอุณหภูมิ สุขภาพโดยรวม และการแจ้งเตือน SMART
หากคุณไปที่ ตัวเลือก"สภาพดิสก์" คุณสามารถเลือกไดรฟ์แต่ละตัวเพื่อดูสถานะโดยละเอียด เรียกใช้การทดสอบแบบรวดเร็วหรือแบบเต็ม และกำหนดเวลาการตรวจสอบเป็นประจำทุกวัน ทุกสัปดาห์ หรือทุกเดือนในเวลาที่เหมาะสมที่สุดสำหรับคุณ
ใน Synology เส้นทางจะนำไปสู่ส่วน Storage Manager, HDD/SSDซึ่งคุณสามารถเลือกดิสก์แต่ละตัวเพื่อดูข้อมูลต่างๆ เช่น อุณหภูมิ เวลาเปิดเครื่อง และสถานะสุขภาพที่ระบบกำหนดให้กับไดรฟ์นั้น
ในสภาพแวดล้อมประเภทนี้ นอกจากการตรวจสอบดิสก์แต่ละตัวแล้ว ควรตรวจสอบสถานะของ RAID หรือกลุ่มพื้นที่จัดเก็บข้อมูล เป็นระยะด้วย เนื่องจากความล้มเหลวหลายจุดในโครงสร้างเช่น RAID 0 อาจส่งผลให้ข้อมูลสูญหายทั้งหมดได้
โดยปกติแล้ว ผู้ดูแลระบบ NAS จะเสริมการตรวจสอบเหล่านี้ด้วยกลยุทธ์การสำรองข้อมูลและการกำหนดค่า RAID ที่เหมาะสม (RAID 1, 5, 6, 10, ZFS พร้อมระบบสำรองข้อมูล ฯลฯ) เพื่อให้หากดิสก์ตัวใดตัวหนึ่งเสียหาย ข้อมูลจะไม่สูญหายโดยอัตโนมัติ
วิธีเพิ่มอายุการใช้งานของฮาร์ดไดรฟ์
แม้ว่าฮาร์ดไดรฟ์จะไม่สามารถใช้งานได้ตลอดไป แต่คุณสามารถปฏิบัติตามแนวทางต่างๆ เพื่อลดความเสี่ยงของการชำรุดก่อนกำหนดและยืดอายุการใช้งานของทั้ง HDD และ SSD ให้ได้นานที่สุด โดยเฉพาะอย่างยิ่งหากคุณใช้งานเป็นเวลานานหลายชั่วโมง
ในกรณีของฮาร์ดไดรฟ์แบบกลไก จำเป็นอย่างยิ่งที่จะต้องหลีกเลี่ยงการกระแทก การสั่นสะเทือนอย่างรุนแรง และการเคลื่อนไหวอย่างกะทันหันขณะที่ฮาร์ดไดรฟ์กำลังทำงาน การกระแทกในเวลาที่ไม่เหมาะสมอาจทำให้แผ่นดิสก์หรือหัวอ่านเสียหายได้
การระบายความร้อนเป็นอีกจุดสำคัญ: ตรวจสอบให้แน่ใจว่าเคสพีซีหรือเคสเซิร์ฟเวอร์ของคุณมีการไหลเวียนของอากาศที่ดีพัดลมทำงานได้อย่างถูกต้อง และไม่มีฝุ่นสะสมอุดตันช่องระบายอากาศ
หากคุณใช้คอมพิวเตอร์เล่นเกมหรือทำงานหนักเป็นเวลานาน อาจเป็นความคิดที่ดีที่จะลงทุนซื้อเคสที่มีระบบระบายอากาศที่ดีกว่า พัดลมเพิ่มเติม หรือแม้แต่ระบบระบายความร้อนเฉพาะทางเพื่อควบคุมอุณหภูมิให้อยู่ในระดับที่เหมาะสม
ในระดับซอฟต์แวร์ ในระบบปฏิบัติการ Windows แนะนำให้ตั้งเวลาให้การจัดเรียงข้อมูลและการเพิ่มประสิทธิภาพของไดรฟ์ (การจัดเรียงข้อมูลแบบคลาสสิกบน HDD และการเพิ่มประสิทธิภาพ TRIM บน SSD) ทำงานโดยอัตโนมัติ เพื่อรักษาประสิทธิภาพและลดภาระการเข้าถึงดิสก์
อย่างไรก็ตาม สิ่งสำคัญที่สุดคืออย่าพึ่งพา "สถานะความสมบูรณ์" ของฮาร์ดดิสก์ที่ปรากฏให้เห็นเพียงอย่างเดียวเพื่อความปลอดภัยของคุณแม้ว่า SMART จะบอกว่าทุกอย่างสมบูรณ์แบบ แต่ก็อาจเกิดความล้มเหลวอย่างกะทันหันได้เสมอ ดังนั้นการสำรองข้อมูลเป็นประจำ (File History, Time Machine, การสำรองข้อมูลไปยัง NAS หรือคลาวด์ ฯลฯ) จึงเป็นสิ่งจำเป็น
สุดท้ายนี้ เมื่อถึงเวลาอัปเกรดฮาร์ดแวร์ ควรเลือกฮาร์ดไดรฟ์จากแบรนด์ที่มีชื่อเสียง เหมาะสมกับการใช้งานที่คุณจะนำไปใช้ (เช่น รุ่นเฉพาะสำหรับ NAS, สำหรับระบบเฝ้าระวัง หรือสำหรับการใช้งานหนักในเซิร์ฟเวอร์) และมีข้อมูลจำเพาะด้านความทนทานที่ชัดเจน
การเข้าใจวิธีการทำงานของ SMART การรู้วิธีตีความพารามิเตอร์หลัก และการใช้เครื่องมือต่างๆ เช่น CrystalDiskInfo, smartmontools, Disk Utility หรือแผงควบคุมการจัดการ NAS ของคุณ จะช่วยให้คุณสามารถตรวจจับปัญหาที่เกิดขึ้นกับดิสก์ ปกป้องข้อมูลของคุณด้วยการสำรองข้อมูล และวางแผนการเปลี่ยนฮาร์ดแวร์ ได้ดียิ่งขึ้น โดยไม่ต้องรอให้เกิดภัยพิบัติขึ้นก่อน