هارد دیسک های قدیمی یا همون HDD ها می تونن کلی فضای ذخیره سازی تقریباً رایگان در اختیارت بذارن؛ گاهی چندین گیگابایت و حتی بیشتر. اگه چند تا هارد قدیمی همین الان یه گوشه کشوی خونه افتاده، خب چرا ازشون استفاده نکنی؟ ولی اینکه بخوای فایل های مهمت رو به اونها بسپری، یه بحث دیگه است.
یکی از راه های خوب برای اینکه بفهمی این HDD ها هنوز سرحال هستن یا نه، استفاده از تست سلامت SMART هست. من قبل از اینکه هر فایل مهمی رو روی یه هارد قدیمی منتقل کنم، همیشه آمار و اطلاعات مرتبط با سالم بودن هارد رو که در ادامه مطلب توضیح میدم، چک می کنم.
هاردت تمام این مدت داشته وضعیت خودش رو ثبت می کرده
بی نقص نیست، ولی کمک زیادی می کنه
SMART که مخفف Self-Monitoring, Analysis, and Reporting Technology هست، یه سیستم تشخیصی داخلیه که تقریباً روی تمام هاردهای مدرن وجود داره. بله، حتی یه HDD ده ساله هم این سیستم رو داره! هارد مدام اطلاعات مربوط به وضعیت خودش رو توی یه بخش مخصوص از صفحات مغناطیسی ذخیره می کنه و چیزهایی مثل ساعت کارکرد، سکتورهای جابه جا شده و خطاهای خواندن رو زیر نظر می گیره.
می تونی SMART رو مثل یه جعبه سیاه در نظر بگیری که از همون روز اولی که هارد شروع به چرخیدن کرده، داشته اطلاعاتش رو ثبت می کرده. البته این قضیه فقط مخصوص HDD نیست و برای SSD ها هم صدق می کنه. من حتی برای یه SSD کاملاً نو هم عادت دارم این اطلاعات رو چک کنم.
بررسی SMART بیشتر از یکی دو دقیقه وقتت رو نمی گیره. خود من برای این کار از CrystalDiskInfo استفاده می کنم، چون همه ویژگی ها رو توی یه پنجره نشون میده. ابزار smartctl هم تقریباً روی هر سیستم عاملی همین کار رو انجام میده.
هر ویژگی SMART یه مقدار نرمال شده و یه مقدار خام داره. برای تمام مواردی که توی این لیست بررسی می کنیم، چیزی که اهمیت داره همون Raw Value یا مقدار خامه.
البته یه نکته وجود داره؛ چون خب طبیعتاً همیشه یه نکته وجود داره! SMART بیشتر از ۷۰ ویژگی مختلف رو بررسی می کنه و بیشترشون اطلاعات چندان مفیدی بهت نمی دن.
پس لازم نیست بشینی تمام ردیف های اطلاعات رو یکی یکی بررسی کنی. فقط همون مواردی رو که پایین میگم همیشه چک کن. پنج تا از این موارد همون چیزهایی هستن که Backblaze زیر نظر می گیره و این شرکت هم اطلاعات صدها هزار هارد رو برای بررسی خرابی در اختیار داره.
SMART 5 میگه سطح هاردت داره سکتور از دست میده
Reallocated Sector همون سکتورهاییه که هارد بی سر و صدا تعمیرشون می کنه
SMART 5 تعداد سکتورهای Reallocated یا سکتورهای بازتخصیص یافته رو نشون میده.
اینها بخش هایی از سطح هارد هستن که هارد موقع خوندن یا نوشتن اطلاعات توشون به خطا خورده و بعد تصمیم گرفته اطلاعات رو به یه بخش یدکی منتقل کنه. هر HDD از اول یه تعدادی سکتور یدکی برای همین کار داره. بنابراین اگه یه عدد کوچیک اینجا ببینی، لزوماً به این معنی نیست که هاردت داره خراب میشه. ولی چیزی که از خود عدد مهم تره، روند تغییر اون عدده.
اگه هاردت چند ماهه همون چند سکتور بازتخصیص یافته رو نشون میده، احتمالاً وضعیتش ثابته. ولی اگه این عدد مدام بیشتر بشه، یعنی سطح دیسک داره واقعاً خراب میشه و هارد داره از ذخیره سکتورهای یدکی خودش استفاده می کنه.
مطالعات گسترده Backblaze و گوگل روی تعداد زیادی هارد هم نشون دادن که این شاخص یکی از قوی ترین نشونه ها برای پیش بینی خرابی هارده. برای همین من همیشه این مورد رو بالای چک لیستم میذارم.
SMART 9 نشون میده هاردت چقدر کار کرده
SMART 9 تعداد ساعت هایی رو نشون میده که هارد روشن بوده و برخلاف بقیه موارد این لیست، اصلاً هشدار خرابی نیست. این عدد فقط یه اطلاعات کلی درباره میزان کارکرد هارد بهت میده. خرابی هارد معمولاً از چیزی به اسم منحنی وان حموم یا Bathtub Curve پیروی می کنه. یعنی اوایل عمر هارد، به خاطر ایرادهای تولید، احتمال خرابی بیشتره. بعد یه دوره طولانی داریم که خرابی ها نسبتاً کم هستن و در نهایت وقتی هارد پیر میشه، دوباره احتمال خرابی بالا میره.
یه مطالعه در سال ۲۰۲۶ توسط Secure Data Recovery انجام شده که اطلاعات SMART مربوط به ۵۱۰۶ هارد خراب رو بررسی کرده. نتیجه جالب بود: ۴۹.۸ درصد هاردها قبل از رسیدن به یک سال کارکرد، یعنی قبل از ۸۷۶۰ ساعت روشن بودن، خراب شده بودن. این نتایج باعث شد من به عدد SMART 9 روی هاردهای قدیمی جور دیگه ای نگاه کنم.
مثلاً یه هارد که ۲۰ یا ۳۰ هزار ساعت بدون مشکل کار کرده، بخش خطرناک ابتدایی عمرش رو پشت سر گذاشته. حتی میشه گفت شاید چنین هاردی از یه هارد کاملاً نو هم قابل اعتمادتر باشه.
البته منحنی بالاخره دوباره برمی گرده بالا. بنابراین وقتی هاردت به حدود ۶۰ هزار ساعت کارکرد رسید، بهتره دوباره به وضعیتش شک کنی. راستی، قدیمی ترین هاردی که توی اون مطالعه هنوز زنده مونده بود، یه WD Caviar Blue با ظرفیت ۳۲۰ گیگابایت بود که بیشتر از ۱۵۴ هزار ساعت کار کرده بود.
با این مقدار کارکرد، سال دیگه باید دیپلم بگیره!
SMART 187 همون عددیه که Backblaze فوراً بهش واکنش نشون میده
خطاهای غیرقابل اصلاح یعنی سیستم ایمنی هارد دیگه نتونسته کاری انجام بده
SMART 187 تعداد خطاهای خواندنی رو نشون میده که سیستم تصحیح خطای هارد نتونسته برطرفشون کنه. اینجا دیگه بهتره اصلاً ریسک نکنی.
اینکه سیستم تصحیح خطای هارد بعضی مشکلات رو شناسایی و برطرف کنه، کاملاً طبیعیه. ولی وقتی با یه Uncorrectable Error یا خطای غیرقابل اصلاح مواجه میشی، یعنی اطلاعات یا اشتباه برگشتن یا اصلاً برنگشتن. Backblaze همین که مقدار این شاخص از صفر بیشتر بشه، هارد رو برای تعویض در نظر می گیره.
وقتی شرکتی که با تعداد خیلی زیادی HDD کار می کنه، برای یه شاخص چنین قانون سختگیرانه ای داره، من هم ترجیح میدم همین کار رو بکنم.
SMART 188 هاردی رو پیدا می کنه که تازه شروع کرده مکث کنه
Command Timeout ها قابل اعتمادترین شاخص نیستن، ولی ارزش بررسی دارن
این شاخص تعداد دستورهایی رو نشون میده که اجرای اونها بیش از حد طول کشیده یا کلاً متوقف شدن. شاید چیز خاصی به نظر نرسه، ولی می تونه قبل از اینکه آسیب جدی به سکتورها وارد بشه، نشونه ای از مشکل در هدهای هارد یا قطعات الکترونیکی باشه. برای یه HDD این موضوع خیلی مهمه.
البته SMART 188 بین این شش شاخص، کم اعتمادترین مورد محسوب میشه.
Backblaze این شاخص رو زیر نظر می گیره، ولی همه هاردها اصلاً اون رو گزارش نمی کنن. از طرف دیگه، چند Timeout پراکنده هم می تونه به خاطر یه کابل SATA خراب یا پاور معیوب باشه.
پس من اینجا کمی با احتیاط برخورد می کنم: اگه SMART 188 اصلاً وجود نداشته باشه، مشکلی نیست؛ ولی اگه عددش مدام بالا بره، یعنی یه چیزی درست نیست.
SMART 197 تقریباً شبیه یه شمارش معکوسه
Pending Sector ها و اینکه چرا هارد خراب معمولی فقط ۱۳ تا داشت
حالا می رسیم به SMART 197. این شاخص تعداد Pending Sector ها رو نشون میده؛ یعنی قسمت هایی از سطح هارد که هارد توی خوندنشون مشکل داره و اونها رو برای انتقال به سکتورهای یدکی توی صف گذاشته. این مورد تقریباً نزدیک ترین چیز به یه شمارش معکوس برای خرابی هارده.
توی مطالعه Secure Data Recovery، هارد خراب معمولی وقتی از کار افتاده فقط ۱۳ Pending Sector داشته. همین موضوع واقعاً آدم رو به فکر فرو می بره. البته میانگین این عدد خیلی بیشتر بوده و به ۱۷۴۰ رسیده.
بعضی هاردها قبل از مردن هزاران Pending Sector ایجاد می کنن، در حالی که بعضی دیگه تقریباً بدون هیچ هشداری از کار می افتن.
این هم یه دلیل دیگه است که نشون میده متأسفانه حتی وقتی وضعیت سلامت هارد ۱۰۰ درصد نشون داده میشه، باز هم نمی تونی خیالت رو کاملاً راحت کنی.
خلاصه اینکه اگه عدد SMART 197 با سرعت زیادی بالا میره، باید اون رو خیلی جدی بگیری. این یکی از قوی ترین هشدارهاییه که یه هارد می تونه بهت بده. ولی حتی عدد پایین هم تضمین نمی کنه هارد سالم بمونه. خیلی از هاردهای قدیمی با عدد نزدیک به صفر هم از کار افتادن.
SMART 198 وجود داره چون سازنده های هارد سر هیچ چیز با هم توافق ندارن!
یه شمارنده پشتیبان برای وقتی که SMART 197 کمی مشکوک رفتار می کنه
SMART 198 تقریباً برادر SMART 197 محسوب میشه. این شاخص تعداد سکتورهایی رو نشون میده که هارد کاملاً ازشون قطع امید کرده، ولی فقط سکتورهایی که موقع اسکن آفلاین سطح دیسک شناسایی شدن؛ نه مشکلاتی که موقع خواندن عادی اطلاعات پیدا میشن. دلیل اینکه بهتره هر دو شاخص رو بررسی کنی اینه که بعضی سازنده ها یکی از این دو مقدار رو ثبت می کنن و اون یکی رو نه.
پس وقتی هر دو رو کنار هم بررسی کنی، تصویر واضح تری از وضعیت هاردت به دست میاری. تفسیر SMART 198 هم تقریباً مثل SMART 197 هست.
یه گزارش SMART سالم، قول نمی ده هاردت سالم بمونه
برگردیم به همون مطالعه Secure Data Recovery. بیشتر از ۳۰ درصد هاردهایی که خراب شده بودن، در زمان خرابی حتی یک Pending Sector هم نداشتن. پس متأسفانه هیچ مقدار بررسی سلامت SMART نمی تونه کاملاً ازت در برابر خرابی هارد محافظت کنه.
ولی این به معنی بی فایده بودن SMART نیست. بررسی سلامت SMART کار خوبیه و کمک می کنه بعضی نشونه های خرابی هارد رو زودتر ببینی. در نهایت، SMART رو مثل یه سیستم هشدار ببین، نه یه تضمین برای سالم موندن هارد.
اگه فایل مهمی داری، حتماً ازش نسخه پشتیبان بگیر؛ چون حتی هاردی که امروز کاملاً سالم به نظر میرسه هم ممکنه فردا بدون هیچ هشدار خاصی از کار بیفته.
سادهگو




