Scrutiny 部署指南:给 NAS 硬盘做 S.M.A.R.T 健康监控的完整方案
【免费下载链接】scrutinyHard Drive S.M.A.R.T Monitoring, Historical Trends & Real World Failure Thresholds项目地址: https://gitcode.com/GitHub_Trending/sc/scrutiny
NAS 里一块硬盘悄悄劣化,等你发现时数据已经丢了。S.M.A.R.T 指标往往提前数月就出现恶化迹象,只是没人盯着看。开源工具 Scrutiny 就是为这件事设计的 NAS 硬盘监控方案:Web 仪表板、S.M.A.R.T 历史趋势、按真实故障率设定的阈值,异常发生时多渠道告警。
Scrutiny 是什么:和 smartd 相比多做了三件事
Scrutiny 分两部分:Collector 定期跑 smartctl 采集指标,Web 端负责存储、展示和告警。两者可以拆开部署(Hub/Spoke 模式),也可以装进同一个容器(Omnibus 模式)。
和传统 smartd 比,它多做了三件事:
- 指标按天入库、画成历史曲线,缓慢退化一眼能看出来;
- 阈值参考真实世界硬盘的故障数据,而不是厂商默认值,误报更少;
- 告警渠道可选邮件、Webhook、Telegram、Discord、Slack 等。
部署路线怎么选:按你的平台对号入座
原则很简单:平台上有容器环境,优先 Docker 一体化,省事、好升级;想装得轻,就跑原生 Collector 加定时任务,Web 端放在家里任意一台机器上。
群晖(Synology)上跑通监控的两条路线
走 Docker 一体化。装好 Container Manager 后拉取 Omnibus 镜像,挂上数据卷,填好设备路径,仪表板即可访问。适合不想折腾的用户。
走 Entware 原生。用 Entware 更新 smartmontools,下载对应架构的 Collector 二进制,把采集任务写进群晖的任务计划程序,每天执行一次即可。Collector 只负责把指标推给 Web 端,本身很轻。
详细步骤见 Synology 部署文档。
Unraid 装 Scrutiny:Community Applications 模板一键部署
Unraid 上最顺的路径:装好 Community Applications 插件,在应用列表里找到 Scrutiny 模板,按提示填好设备与通知配置,一键部署。参考 Unraid 安装说明。
TrueNAS、QNAP 与其他平台怎么办
TrueNAS 和 QNAP 的思路与群晖一致:有 Docker 或虚拟机环境就优先容器化,没有就跑 Collector 加定时任务。PFSense、RockStor、Windows 同样支持 Collector,换成本平台的包管理器和计划任务即可。各平台支持情况可查 NAS 支持列表。
部署后的关键配置:设备类型标注与告警通知设置
RAID 控制器和特殊接口建议手动标注。自动扫描偶尔会认错接口类型,导致指标读不全,在 Collector 配置里指定即可:
devices: - device: /dev/sda type: sat通知渠道趁早配。在 Web 端设置页填入邮件、Webhook、IM 渠道,建议至少配一条你每天都会看的方式,配完发一条测试通知验证一下。
日常使用建议:采集频率、阈值调整与备份配合
- 采集频率每天一次足够,硬盘退化是慢过程,加频率主要是多耗资源;
- 阈值先按默认跑一两个月,观察哪些属性在你的盘上真的会漂移,再决定收紧或放宽;
- 监控给的是提前量。收到告警后是先换盘还是先抢救数据,取决于你平时的备份习惯。
遇到问题,先查这三样
- 扫描不到设备:先跑 smartctl 扫描确认盘能被识别,再检查权限;
- 指标不全或类型不对:手动指定设备类型;
- 收不到告警:发一条测试通知,渠道配置问题通常当场就能定位。
部署本身不复杂,难得的是装完后真的会去看。把仪表板加进书签、告警接到手机里,硬盘的状态从此就有底了。
【免费下载链接】scrutinyHard Drive S.M.A.R.T Monitoring, Historical Trends & Real World Failure Thresholds项目地址: https://gitcode.com/GitHub_Trending/sc/scrutiny
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考