南沙一家摄影工作室的群晖 DS920+(4 盘位,装了 2 块西数红盘 4TB 组 SHR)发来消息:存储空间只剩 40GB,Lightroom 图库已经写不进去了。他们想把两块 4TB 换成两块 8TB,问我们能不能代办,以及“换盘的时候数据会不会没”。

结论先说:SHR 支持逐盘热插拔扩容,数据不会丢,但过程长达几十小时,任何一步乱来都可能翻车。我们把全过程记录如下。

动手前:三条铁律

  1. 先备份再扩容。阵列重建期间硬盘持续高负载,老盘随时可能挂。我们把最关键的 1.2TB 成片和客户原片先 rsync 到一块移动硬盘,这一步花了 9 小时。没有备份就重建阵列 = 拿全部数据赌两块旧盘的命。
  2. 新盘先体检。两块西数红盘 Plus 8TB(WD80EFZZ)到手先上硬盘盒,全盘慢速扫描(Victoria 全盘读取测试),确认无坏道再装机。新盘带病上岗,重建到一半报错会更麻烦。
  3. 断电保护。工作室没有 UPS,我们临时借了一台山特 TG-BOX 850VA 接上 NAS 和路由器。事后证明这个决定救了命——第二天下午真的跳闸了一次。

扩容流程:一次只动一块盘

SHR 扩容的规则是逐盘更换,每换一块都要等阵列完全修复后才能换下一块

步骤操作耗时
1热拔出 1 号盘(4TB),插入 8TB 新盘,存储管理器 → 硬盘 → 操作 → 更换硬盘2 分钟
2阵列进入“降级”状态,自动开始修复(重建数据到新盘并扩容分区)22 小时
3修复完成、状态回到“健康”后,对 2 号盘重复步骤 1-224 小时
4两块都换完后,存储管理器 → 存储池 → 操作 → 扩展文件系统(如未自动触发)2 小时

总耗时约 48 小时。期间 NAS 可以正常读写,但性能明显下降(重建占用 IO),摄影工作室这两天的修图导出慢了一倍,这是预期内的。

多块机械硬盘叠放
换下来的两块4TB红盘没有扔:做成离线冷备份,每季度同步一次

意外:重建中途跳闸

第二块盘重建到 61% 时,工作室空调跳闸,NAS 靠 UPS 撑了 12 分钟正常关机(我们在 DSM 里配了“断电时进入安全模式”)。来电后开机,DSM 自动继续重建,从 61% 接着跑,没有丢数据也没有报错。这就是 SHR/RAID 重建的断点续传能力——但前提是正常关机。如果是直接断电(没 UPS),有一定概率出现阵列元数据不一致,那就需要用 mdadm 手工检查修复了,风险大得多。

扩容完成:容量为什么是 7.2TB 不是 14TB?

客户看到扩容后总容量只有 7.2TB 愣住了。解释一下:SHR 两块同容量盘 = RAID1 镜像,一块盘的容量用来存数据,另一块做冗余。两块 8TB 实际可用约 7.2TB(标称 8TB = 7.28TiB,再去掉系统分区)。想要容量翻倍,要么加第三块盘(SHR 三盘开始提供“容量最大化”),要么改 SHR-2/RAID5 后逐盘扩。冗余不是浪费,是数据恢复费的前置折扣——4TB 数据开盘恢复要 3000-8000 元,镜像盘的冗余成本远低于此。

SMART 数据怎么读:换下来的旧盘还能用吗?

两块 4TB 红盘退役前我们读了 SMART:

这就是我们建议 NAS 用户每半年看一次 SMART 的原因:05(重分配扇区)、C5(待映射)、C6(不可修复)三个值只要不是 0,就该准备换盘了。

NVMe固态硬盘
DS920+ 底部两个 M.2 槽:加装 NVMe SSD 做读写缓存,小文件性能提升明显

附:SHR 扩容时间对照表(DS920+ 实测参考)

原容量→新容量单盘重建耗时总耗时(2盘)
4TB → 8TB22-24 小时约 48 小时
4TB → 16TB40-46 小时约 4 天
8TB → 16TB38-44 小时约 3.5 天

重建时间与盘容量成正比、与 NAS 性能反比,期间请保持供电稳定、不要重启 NAS、不要同时跑大量读写任务。

宇际航提供群晖/威联通 NAS 全系服务:扩容换盘代办(含数据校验报告)、阵列修复、误删恢复、勒索病毒解密评估、NAS 系统迁移。南沙番禺上门,其他区可整机到付寄修。扩容代办服务费按盘位计:4 盘位以内 600 元(含 48 小时监控值守),数据备份另计。