跳至内容

存储健康·智能·温度

查看驱动器问题 他们变得停机

Hard Disk Sentinel 表面温度趋势,S.M.A.R.T.属性和磁盘自检集中在一处,以便您可以在仍有选择的情况下进行备份、替换或调查。

多驱动
一个仪表板
警报
预警
细节
智能深度
在下面选择一个命名视图。一次一张截图。布局可能因版本而异。

为什么读者要安装监控软件

  • 可预测的故障很少见 磨损和缺陷通常会在猝死之前很久就在 SMART 和行为中留下痕迹。
  • 温度讲故事 热量会加速老化——跟踪峰值对于笔记本电脑、NAS 和紧凑型 PC 来说很重要。
  • 备份创造奇迹 监控可以为验证备份和平静迁移赢得时间——而不是在危机期间。

本星期

将图表变成五分钟的习惯

您不需要完美的仪表板 - 只需要可重复的比较即可 周到 你的 基线。目标是尽早注意到坡度,而不是追逐单一数字。

保持一页基线

型号、固件、空闲温度和您关心的 SMART 属性 - 每个磁盘一个段落。当您更换电缆、外壳或操作系统版本时更新它,以便保持诚实的比较。

每周清单 →

在旅行或大升级之前

运行简短的自检,确认备份已完成,并在机器平静时截取运行状况摘要的屏幕截图。如果某些事情已经发生了变化,您需要在行李或 Windows 更新增加噪音之前获得证据。

安装和基线流程 →

当计数器移动时

记录日期、您正在运行的工作负载以及电缆或扩展坞是否发生变化。如果重新分配、待处理的扇区或接口错误一起加速,请将其视为备份优先事件,而不是论坛辩论。

SMART 属性指南 →

按硬件划分

HDD 和 SSD 奖励不同的习惯

相同的仪表板,不同的物理特性——机械磁盘电报表面和承载应力;固态硬盘强调磨损、热量和控制器报告的错误。浏览两列一次,然后为与您的车队匹配的指南添加书签。

旋转磁盘 (HDD)

优先考虑重新分配和挂起的扇区、声学变化以及轻量 IO 期间的延迟停顿。温度仍然很重要,尤其是在气流较弱的托盘中,但表面指标通常首先说明问题。

  • 绘制项目繁忙季节每周重新分配坡度的图表
  • 当 CRC 错误在扇区没有增长的情况下攀升时排除电缆

硬盘健康指南 →

固态(SSD/NVMe)

观察磨损指示器、不安全关闭、介质错误和持续写入下的热节流。忽略机械时代的民间传说; NVMe 可能会隐藏热点与复合温度 - 趋势一致的一种工具。

  • 图表实际导出时的温度,而不是空闲桌面时间
  • 将 TBW 与误差加速度配对 — 而不是单独的百分比条

SSD健康指南 →

词典

随处可见的六个术语

简短的定义,以便论坛主题和供应商 PDF 使用您已在基线文件中记录的相同单词。

聪明的。

固件报告的计数器——不是单一的通过/失败判定。每周比较坡度,而不是 Reddit 的屏幕截图。

重新分配的部门

该驱动器将薄弱点重新映射到其备用池中。偶尔会出现蜱虫现象;稳定的爬升值得首先进行备份验证。

待定部门

读取固件尚未决定如何处理 - 在宣布磁盘“正常”之前,请与重新分配一起观察。

TBW(写入的 TB 字节)

主机写入与供应商耐用性指南 - 不是过期日期。与 SSD 上的介质错误和热量配对。

CRC/接口错误

传输层问题(电缆、坞站、芯片组)通常会伪装成“坏磁盘”,除非您简化链条。

通电时间

其他所有指标的年龄和工作周期背景——五年平静的岁月与五个炎热的夏天的解读不同。

更深入地了解标准化列与原始列以及供应商命名怪癖: 了解 SMART 属性

分诊

当 PC 感觉有问题但 SMART 保持绿色时

口吃、神秘损坏和复制错误并不总是以重新分配的形式出现。按固定顺序扩大调查范围,以便在更换职业之前更换电缆。

首先排除路径

在假定 NAND 或盘片发生故障之前,交换 SATA 引线、尝试另一个 USB 端口并直接连接脱壳磁盘。当链清除时,CRC 和接口错误通常会被清除。

连接指南 →

RAM、文件系统、驱动程序

复制、过滤驱动程序和测试版文件系统调整期间的位翻转伪装成“坏磁盘”。 SMART 可以在校验和尖叫时保持平稳 - 在 RMA 之前进行交叉检查。

超越智能 →

电源、热量、停电

弱电源轨和热节流会产生复位环路和写入撕裂,有时表现为接口突发或温度悬崖,有时则不然。在基准文件中记下室温和 PSU 寿命。

温度深潜 →

当概览变成红色时

现代驱动器会悄悄地重新映射薄弱扇区,直到阈值突破——当您仍然有克隆窗口时,就会进行监控以发现漂移。

  • 重新分配的部门: 更换备件的驱动器——偶尔会发生增量;陡坡则不然。
  • 待定/无法纠正: 读取不稳定——在深度扫描之前验证备份。
  • 接口错误: 电缆、坞站或控制器问题类似于磁盘故障——在宣布灾难之前更换电缆。
深入阅读警告标志
Hard Disk Sentinel概述显示严重的健康状态和坏扇区警告
降级模式的示例:运行状况百分比低以及明确的表面警告 - 如果您在硬件上看到类似的趋势,请立即验证备份。

决定

观察、计划或替换——没有戏剧性

标题健康百分比使细微差别变得平坦。使用斜率和确凿的属性,然后让备份准备情况来决定节奏,而不是论坛的紧迫性。

观察

电缆验证后指标平坦或缓慢变化 - 每周记录一次,与基准文件进行比较,并保持备份最新。在已知的繁重任务期间出现一次性峰值是正常的。

阅读 SMART 趋势 →

计划备用

重新分配或挂起的扇区会加速,或者在路径交换后仍然存在接口错误 - 刷新备份、预算替换并首先迁移热数据。你是在购买日历时间,而不是恐慌。

失败迹象 →

尽快订购

无法纠正的错误、已知良好文件的校验和失败或超出恢复窗口的斜率 - 将磁盘视为生产受阻。当操作系统仍然可以正常启动时,首先进行克隆或映像。

备份优先剧本 →

调整警报噪音,使真实的步骤脱颖而出: 警告级别和警报 · 第一个月的节奏

真实会话的屏幕截图

典型安装的静止画面 — 驱动器列表、分区和监控面板,与桌面 Windows 上显示的一样。

带有驱动器和监控面板的 Hard Disk Sentinel 会话屏幕截图
另一个安装配置文件:相同的工具,不同的磁盘布局。
Hard Disk Sentinel 界面显示驱动器列表、运行状况摘要和监控面板
一次典型会话中的概述、图表和 SMART 数据。

入职

监控的第一个月——实际做什么

软件是即时的;信任慢慢建立。使用这种节奏,以便当指标最终出现波动时,图表就有意义 - 您将与 你的 机器,不是 2019 年的屏幕截图。

第一周

标签和枚举

让第一次民意调查结束;在您的脑海中重命名驱动器以匹配物理贴纸。注意哪个托盘是临时托盘还是存档托盘——未来的警报将变得可操作。

第 2 周

捕获基线

在正常工作会话后导出 SMART 文本或记录峰值空闲/负载温度。每个磁盘的一个段落胜过一个神秘屏幕截图文件夹。

第三周

调整警报

提高每次笔记本电脑小睡时 ping 的阈值;收紧任何保护财务或主照片树的东西。将桌面警报与 NAS 设备的每周日历提醒配对。

第 4 周

证明恢复

将随机文件夹从备份恢复到临时路径。监控可以带来远见——备份只有在恢复工作时才有意义。

备份剧本

现场笔记

相同的工具,房子里的不同房间

预期会因机箱气流、谁共享 PC 以及磁盘是否位于壁橱 NAS 中而发生变化。调整基线和警报,而不是追逐一个全球温度数字。

游戏和创作者装备

GPU 废热堆叠在插槽下方的 NVMe 上。真实会话期间的日志峰值(修补和导出),而不是重新启动后的空闲桌面温度。

热导板 →

共享家庭电脑

孩子和客人添加惊喜安装和睡眠设置。保持一种每个人都能理解的保守警报,并在记录可预测的良性窗口后将其静音。

警报调整 →

壁柜 NAS 和冷备件

季节性室温变化的平均幅度大于固件更新的幅度。注意图表跳跃时的环境——通常是灰尘或扇形曲线,而不是突然的盘癌。

NAS 笔记 →

来自真实支持模式的复合场景

不是认可——当人们最终将温度和 SMART 结合在一起时,我们会看到常见的时间表。

自由编辑

“出口煮熟了我的暂存盘”

渲染过程中出现温度峰值,而不是突然失败。改善机箱气流、交错作业、每年更换导热垫。

结果:稳定的 SMART、更安静的风扇、更少的热节流。

远程工作者

“USB 底座归咎于驱动器”

接口错误不断增加——在假定盘片损坏之前更换了电缆和底座芯片组。

结果:错误消失;磁盘保留备用扇区不变。

小型办公室 NAS

“Smart 看起来不错,但事实并非如此”

延迟异常值先于 SMART 行程 — 监控和清理在工作时间而非周五晚上捕获磁盘。

结果:有序 RAID 重建而不是紧急恢复。

学生预算建设

“二手企业硬盘似乎很便宜”

开机时间是诚实的,而磨损时间则不然。监控学期紧缩期间暴露的重新分配增长;在阅读周而不是期中考试期间克隆到新磁盘。

结果:廉价的教训——在信任带有唯一副本的剩余驱动器之前,始终先绘制计数器图表。

照片档案管理员

“冷储盘醒来生气了”

不频繁的旋转掩盖了蠕变,直到年度验证为止——在 Lightroom 目录遭受附带损害之前,在闲置清理期间进行监控,捕获待处理的扇区。

结果:尽早轮换档案;将原件保留在两种媒体类型上。

双启动修补匠

“Linux 调整大小归咎于 Windows 工具”

分区实验强调分区图,而不是硬件。 SMART持平;文件系统检查固定的幽灵。记录避免了不必要的 RMA。

结果:将软件恐慌与磁盘恐慌分开。

实践

使图表值得信赖的迷你练习

简短的练习——没有任何破坏性——可以将监控从壁纸变成肌肉记忆。如果您很忙,每周选择一个;在升级或旅行之前将它们堆叠起来。

60秒的一瞥

打开概述,确认托盘图标状态,扫描过去 7 天的最高温度,并注意是否有任何属性的变化超过本底噪声。到此为止——趋势不断累积;完美则不然。

周二简短自检

在电缆检查后安排一个安静的夜晚进行简短的自检。在基线文件旁边记录通过/失败情况 - 当 SMART 或延迟已经悄然出现时,将保留扩展测试。

恢复一个文件夹

从备份中随机选择一个项目目录;恢复到临时路径并打开一些文件。监控会告诉您风险何时上升,只有恢复才能证明备份是真实的。

备份剧本 →

使一个嘈杂的警报静音

如果在每晚计划备份期间触发相同的阈值,请调整窗口或滞后一次,然后不要理会 SMART 坡度警报。目标是减少被忽略的通知,而不是零通知。

警报指南 →

第一次运行

准备好安装了吗?

使用官方来源,在存在校验和时验证安装程序,并执行第一个会话检查表,以便第一周的图表有意义。

常见问题快照

直接答案——专用页面上的完整列表。

温度越高就一定不好吗?

负载下的短暂爆发是正常的。持续高位收缩裕度——与您自己的基线和机箱气流进行比较,而不是与其他人的屏幕截图进行比较。

SSD 会让监控变得过时吗?

不会——NAND 磨损、热节流和控制器问题仍然存在。这些信号与旋转锈迹不同,但它们仍然受益于趋势。

如果健康状况下降百分之一我应该惊慌吗?

研究变化率和相关属性——单点噪声的发生;斜坡不会说谎。不确定时,请先刷新备份。

RAID 会取代备份吗?

否 — RAID 处理一些硬件故障,而不是意外删除、恶意软件或跨磁盘镜像的静默损坏。保留无法重新创建的任何内容的脱机副本或版本副本。

为什么两个程序显示不同的温度?

传感器放置、轮询间隔以及复合读数与热点读数存在差异,尤其是在 NVMe 上。选择一种工具并观察一段时间内的趋势,而不是追逐相同的数字。

安装监控后第一周应该做什么?

让第一次完整民意调查结束;为外壳贴上标签以匹配屏幕上的 ID;实际工作期间的怠速和典型负载温度。在更换硬件之前记录奇怪的读数——您需要一个故事,而不是一个数字。

我什么时候应该更换驱动器而不是继续观察?

当重新分配或挂起的扇区加速、排除电缆后仍然存在不可纠正的错误或您信任的文件的校验和测试失败时,请优先考虑更换。如果趋势超出了您从备份恢复的速度,请订购一个备用设备 - 即使总体健康状况看起来仍然“良好”。

打开完整的常见问题解答

来自博客

带有目录的长篇指南——选择一个主题并阅读,无需滚动。

浏览所有文章

如何检查硬盘健康状况

基线、重要的 SMART 属性以及何时从观察升级为行动。

继续阅读

如何检查SSD健康状况

磨损均衡、TBW 现实检查以及持续 IO 下的热行为,而不是盲目重用传统 HDD 规则。

继续阅读

硬盘故障的迹象

噪声模式、延迟幽灵、备份演习——在 SMART 赶上之前识别故障模式。

继续阅读

温度和节流

为什么平均值优于快照,热点与总体温度有何不同,以及热裕度何时悄然缩小。

继续阅读

全系统环境

驱动监控看不到什么

SMART 和温度图表描述了存储设备,而不是您的数据所经过的每条路径。当症状和图表不一致时,扩大调查范围,而不是永远循环电缆。

RAM 和静默腐败

有故障的内存会在复制、编译和校验和操作期间翻转位——SMART 可以在档案腐烂时保持安静。当磁盘上随机出现损坏时,运行有针对性的 RAM 测试。

电力输送和停电

薄弱的 PSU 导轨或片状浪涌条会导致重置循环和写入撕裂 — 接口错误突发可能是唯一的磁盘相邻线索。在指责 NAND 之前先排除电源。

文件系统和驱动层

过滤器驱动程序、加密和 Beta 文件系统调整在应用程序中表现为“磁盘问题”,而 SMART 保持绿色。通过供应商更新和干净启动试验进行验证。

下载