摄影师拍完一场活动后,几百 G 素材到底怎么存才不崩溃?
炸过盘,花了几千块恢复的过来说一下:良好的工作流+冷备份才是唯一靠谱方案。
很多人以为NAS是解决备份问题的,我的看法相反,NAS首先解决的是数据共享。
NAS走公网速度极慢,它最适合的岗位是内局域网多人共享。同一批数据传上去,张三可以读来剪辑素材,李四可以读来做海报,办公室网线一插就跟读本地盘没啥区别;
偶尔王五请假在家了也能走公网下载干活(前提你司要有公网ip),省去个网盘的费用。
但一般NAS并不是灾备用的,灾备用的NAS得上RAID5还有异地。回头讲
这得说回来硬盘本身。固态就不说了,现在大把PLC、QLC颗粒的盘,三年数据损坏丢数据简直常态
机械盘的故障率,也比各位想象的高得多
各大云厂商(谷歌、Backblaze)公布过多年硬盘监控统计,有个指标教年度硬件故障率 AFR
也就是一百块硬盘,一年、三年、五年后有几块gg了。结果是1年AFR=1%,3年AFR=4%,5年直接飙到10%
啥概念,比如你一个中小企业,三四十号人,加上办公电脑加上个人电脑,总共100块硬盘不过分吧,按概率,一年就得炸一个。三年就得炸两双。
炸的时候这块盘上有没有独一份的重要数据,全看运气。
而硬盘什么情况最容易炸,总结起来也就是高I/O、持续写、碎文件多,
这三者刚好是和便利性正相关的。你nas上访问的人越多、互相读取数据越频繁,写的单个文件越小,文件数量越多,最后7*24小时工作,炸的概率就更高
于是NAS在满足便利性的时候,天然也是个硬件损坏加速器。
怕坏怎么办,上RAID阵列呗,RAID就是把好几块盘拼一起用,可以把一个任务分给不同盘读写,这样速度快,这就叫RAID0;可以一次写两份到两个盘上,炸了一个还剩一个,这就叫RAID1;可以把同一个任务同时写在好几块盘上防止某一块出错,这就叫RAID5/6
RAID1是最直接的“双备份”方式,年出错概率差不多0.01%,如果数据丢失对你的损失尚且可控,这个方式足够了。一个小工作室买个小型NAS插俩16T,日常数据任务基本应付的了,几百G素材存三四个月,满了再买俩新的插上去,旧的写个标签保存好
但是如果你要保存的时间长,RIAD1仍然还欠缺一点。刚才咱们说了,便利性和靠谱程度是不可兼得的。
个人/工作室没必要上RAID5,组一个RAID5需要三块盘,成本直接翻三倍。而且如果你没有专门机房的话,哪天某个憨憨一杯咖啡泼上去,或者老李不小心把NAS从桌子上打翻下来,你数据全部还得GG。有机房有财力的,直接机房RIAD5
既然硬盘可能物理损坏,最稳妥的方式(假设这种灾难后果你确实无法承受、确实有必要灾备),还得是把关键的数据存在不同地方,而且一旦遇到问题,恢复时候最好能直接拷贝另一份,而不是技术修复。
而普通人搭建跨域传输的多点分布式存储有点扯淡,有个不扯淡的方法,就是把你的数据工作流,天然变成一个小范围的分布式存储
存储卡、NAS、办公电脑、灾备电脑各成一环,工作的时候让他们自然流通到上边去。某个环节坏了,也还有其他环节兜底:
- 拍摄一定使用双卡(两份数据)
- ↓
- 办公室先搭一个RAID1 NAS。拍完素材回来了,卡里的数据直接拉到NAS上(两份)
- ↓
- 编辑时,再把数据down到个人电脑操作,禁止直接在线编辑(三份)
- ↓
- 确保数据已经在本地工程了,才允许格式化存储卡(两份)
- ↓
- 工程编辑后,文件瘦身,只保留关键素材,无用的素材清理掉,打包(两份)
- ↓
- 打包压缩好的数据,用内网或者FTP,传到另一台灾备电脑做打底备份(三份)
- ↓
- 灾备电脑不用啥配置,找个淘汰下来的老机器或者不常用的办公机就行,内网开个FTP,挂到本地文件夹,已完成的工程确认上传之后,才允许清理个人数据(>=两份)
- ↓
- NAS和灾备盘满后帖标签取下封存好(两份),再换新盘。
顺序不能反。好多人图省事觉得我都拉NAS了卡直接格了也没事,或者我先拷到本地顺手传一下NAS不得了?那你等着吧,哪天遇到个别文件损坏,你想追查发现东西已经没了,等于白搞。
压缩很重要,打压缩包可以避免碎文件太多IO出错;拷贝时也更快速。
以上这个方法,每个环节数据都至少有两重以上备份,除非你工作室一把火烧了之外,基本能应对99.99%的情况。
如果还担心万一一把火,那就把灾备电脑换成网盘,或者别处房间的一台存储设备。总之工作流不变。
以上。