南沙一家摄影工作室的群晖 DS920+(4 盘位,装了 2 块西数红盘 4TB 组 SHR)发来消息:存储空间只剩 40GB,Lightroom 图库已经写不进去了。他们想把两块 4TB 换成两块 8TB,问我们能不能代办,以及“换盘的时候数据会不会没”。
结论先说:SHR 支持逐盘热插拔扩容,数据不会丢,但过程长达几十小时,任何一步乱来都可能翻车。我们把全过程记录如下。
动手前:三条铁律
- 先备份再扩容。阵列重建期间硬盘持续高负载,老盘随时可能挂。我们把最关键的 1.2TB 成片和客户原片先 rsync 到一块移动硬盘,这一步花了 9 小时。没有备份就重建阵列 = 拿全部数据赌两块旧盘的命。
- 新盘先体检。两块西数红盘 Plus 8TB(WD80EFZZ)到手先上硬盘盒,全盘慢速扫描(Victoria 全盘读取测试),确认无坏道再装机。新盘带病上岗,重建到一半报错会更麻烦。
- 断电保护。工作室没有 UPS,我们临时借了一台山特 TG-BOX 850VA 接上 NAS 和路由器。事后证明这个决定救了命——第二天下午真的跳闸了一次。
扩容流程:一次只动一块盘
SHR 扩容的规则是逐盘更换,每换一块都要等阵列完全修复后才能换下一块:
| 步骤 | 操作 | 耗时 |
|---|---|---|
| 1 | 热拔出 1 号盘(4TB),插入 8TB 新盘,存储管理器 → 硬盘 → 操作 → 更换硬盘 | 2 分钟 |
| 2 | 阵列进入“降级”状态,自动开始修复(重建数据到新盘并扩容分区) | 22 小时 |
| 3 | 修复完成、状态回到“健康”后,对 2 号盘重复步骤 1-2 | 24 小时 |
| 4 | 两块都换完后,存储管理器 → 存储池 → 操作 → 扩展文件系统(如未自动触发) | 2 小时 |
总耗时约 48 小时。期间 NAS 可以正常读写,但性能明显下降(重建占用 IO),摄影工作室这两天的修图导出慢了一倍,这是预期内的。

意外:重建中途跳闸
第二块盘重建到 61% 时,工作室空调跳闸,NAS 靠 UPS 撑了 12 分钟正常关机(我们在 DSM 里配了“断电时进入安全模式”)。来电后开机,DSM 自动继续重建,从 61% 接着跑,没有丢数据也没有报错。这就是 SHR/RAID 重建的断点续传能力——但前提是正常关机。如果是直接断电(没 UPS),有一定概率出现阵列元数据不一致,那就需要用 mdadm 手工检查修复了,风险大得多。
扩容完成:容量为什么是 7.2TB 不是 14TB?
客户看到扩容后总容量只有 7.2TB 愣住了。解释一下:SHR 两块同容量盘 = RAID1 镜像,一块盘的容量用来存数据,另一块做冗余。两块 8TB 实际可用约 7.2TB(标称 8TB = 7.28TiB,再去掉系统分区)。想要容量翻倍,要么加第三块盘(SHR 三盘开始提供“容量最大化”),要么改 SHR-2/RAID5 后逐盘扩。冗余不是浪费,是数据恢复费的前置折扣——4TB 数据开盘恢复要 3000-8000 元,镜像盘的冗余成本远低于此。
SMART 数据怎么读:换下来的旧盘还能用吗?
两块 4TB 红盘退役前我们读了 SMART:
- 1 号盘:通电 26000 小时(约 3 年不间断),重分配扇区数 0,待映射扇区 0——健康,转为冷备份盘。
- 2 号盘:重分配扇区数 12,待映射扇区 3——已经出现物理坏道,这块盘只能报废。也就是说,如果这次不是主动扩容,2 号盘可能撑不过今年冬天,届时 SHR 降级、1 号盘再出问题就是数据灾难。
这就是我们建议 NAS 用户每半年看一次 SMART 的原因:05(重分配扇区)、C5(待映射)、C6(不可修复)三个值只要不是 0,就该准备换盘了。

附:SHR 扩容时间对照表(DS920+ 实测参考)
| 原容量→新容量 | 单盘重建耗时 | 总耗时(2盘) |
|---|---|---|
| 4TB → 8TB | 22-24 小时 | 约 48 小时 |
| 4TB → 16TB | 40-46 小时 | 约 4 天 |
| 8TB → 16TB | 38-44 小时 | 约 3.5 天 |
重建时间与盘容量成正比、与 NAS 性能反比,期间请保持供电稳定、不要重启 NAS、不要同时跑大量读写任务。
宇际航提供群晖/威联通 NAS 全系服务:扩容换盘代办(含数据校验报告)、阵列修复、误删恢复、勒索病毒解密评估、NAS 系统迁移。南沙番禺上门,其他区可整机到付寄修。扩容代办服务费按盘位计:4 盘位以内 600 元(含 48 小时监控值守),数据备份另计。
