素材加工先做哪一步?我清完攒了3年的1.2T乱素材,这套流程可以直接抄

关键词:素材加工,素材整理,批量转码,ffmpeg,音频响度标准化

摘要:从拍完到能扔进时间线之间那堆脏活,我用了三年才理清。命名规则、批量转码参数、音频降噪和响度标准、图片色彩空间、归档策略,附三种做法的实际耗时对比和几件我不推荐的事。

素材加工先做哪一步?我清完攒了3年的1.2T乱素材,这套流程可以直接抄

图片

先交代背景。 2022年3月我开始自己拍东西,一台二手 A7M3 加一部 iPhone 13,两年多下来移动硬盘里堆了 1.24TB 的原始文件,9000 多个。上个月剪一条 8 分半的视频,光找那个手持拍的空镜就翻了 40 分钟。我当时以为是剪辑软件慢,换了台 M2 Pro 的 MacBook,还是慢。后来才承认:问题不在剪,在我从来没认真做过素材加工这一步——也就是从拍完到能扔进时间线之间,那一堆又脏又没人夸的活。

这篇不是工具合集,是我踩完坑之后剩下的一套流程。哪些步骤能省、哪些千万别省,我直接说不推荐的理由。

第一步:命名和目录,花 20 分钟省你 20 小时

命名我用的是 日期_项目_机位_序号,比如 20250607_ershoujingtou_A_001.MP4。日期必须是 YYYYMMDD,别写 0607 也别写 6月7日,不然跨年、跨文件夹排序全乱,而且排序时 10 会排到 2 前面。

目录只建四个:00_raw(原始,永远不动)、01_audio、02_img、03_out(导出成片)。原始素材不要在里面直接改,这是我丢了两次素材之后立的规矩,第二次是因为顺手在源文件夹里做了降噪,覆盖之后原始录音就没了。

批量重命名我用 Adobe Bridge(装了 PS 就自带)或者 Windows 上的 Total Commander。Bridge 的批重命名支持按创建日期、序号、项目名组合,一次几千个文件没出过问题。

图片

一个很多人不知道的坑:中文文件名在 macOS 和 Windows 之间来回拷会乱码。不是编码错,是 macOS 用 NFD 分解存储、Windows 用 NFC 组合存储,同一个“镜”字在字节层面就不一样。所以我现在的项目名一律用拼音,丑,但省事。

第二步:转码和代理,先搞清楚你到底卡在哪

先给几个真实体积,你对照一下自己的硬盘:iPhone 13 拍 4K 60fps,一分钟大约 440MB;A7M3 的 XAVC S 4K 100Mbps,一分钟大约 750MB。粗略算,拍一小时就是 26GB 到 45GB。我那 1.24TB,差不多等于 40 小时的有效素材。

要压成网上传的版本,用 ffmpeg 一条命令批量搞定:

ffmpeg -i input.mov -c:v libx264 -crf 20 -preset medium -pix_fmt yuv420p -movflags +faststart -c:a aac -b:a 192k output.mp4

-crf 20 是什么意思?x264 的 CRF 范围是 0–51,数字越小画质越高、文件越大。经验值:18 接近视觉无损,20–23 是绝大部分网络视频的甜点区,26 以上暗部和渐变天空开始出现明显块状伪影。-preset medium 是我用的平衡点,换成 slow 体积大概能小 5%–8%,但编码时间差不多翻倍。-movflags +faststart 是把索引挪到文件头,网页上边下边播靠它。

图片

如果你是在剪辑软件里卡,那不是转码问题,是代理问题。Premiere 里建代理,编码建议 ProRes Proxy,1080p 下码率 30–45Mbps,比原始 4K 好读太多;剪映专业版在“全局设置 → 性能”里有代理模式,开了之后预览降到 720p 左右;DaVinci 在媒体池右键就能生成优化媒体。

还有一点:素材盘别用机械硬盘剪 4K 多轨。我实测一块西数 4TB 蓝盘,单轨 4K 25fps 能放,三轨叠加就掉帧;换 NVMe(读取 2000MB/s 以上)之后同样三轨一点不卡。机械盘 120–160MB/s 的顺序读取看着够,但多轨是随机读,实际差一个数量级。

第三步:音频加工,做和不做差距最大的一步

观众能忍画面糊,忍不了声音刺。我最早那期就是典型:室内录旁白,空调嗡嗡的,人声还有轻微爆音,评论区第一条是“声音听得难受”。

降噪在 Audacity 里的正确做法是:先选中一段 0.5 秒左右的纯环境底噪(开口之前那一段),效果 → 降噪 → 获取噪声样本,然后整段应用,降噪量控制在 6–12dB。超过 15dB 就会出现那种水下发闷的电子音,人声高频的齿音、气声会被一起削掉。宁可留一点底噪,也别削太狠,这点我试了不下十次。

音量标准化别靠手拉。流媒体平台的响度标准大致是:YouTube、Spotify 归一到 -14 LUFS,Apple Music 是 -16 LUFS,广播用的 EBU R128 是 -23 LUFS。做视频的话,人声对齐到 -16 LUFS、真峰值 TP 不超过 -1.5dB,到哪都不会爆。ffmpeg 用 loudnorm 两遍法:

ffmpeg -i in.wav -af loudnorm=I=-16:TP=-1.5:LRA=11:print_format=json -f null -

图片

第一遍只测参数,把输出的 measured 值填进第二遍再跑一次,比单遍准。单遍 loudnorm 是动态处理的,会有轻微抽气感。另外采样率统一 48kHz / 24bit,视频项目用 48kHz 是默认,44.1kHz 混进去某些软件重采样会有轻微失真,不致命但没必要。

第四步:图片素材,别在 DPI 上浪费时间

先说一个我认为被误解最深的参数:DPI。照片标 72 DPI 还是 300 DPI,在屏幕上没有任何区别,那只是元数据里的一个标签,真正决定清晰度的是像素尺寸。一张 4000×3000 的照片,标什么 DPI 发到网上都是同一张图,印刷才需要换算。

色彩空间才是真坑。相机设成 Adobe RGB 拍摄,导出时没转 sRGB,在浏览器和手机上看会发灰发绿。这是色域没被正确解释导致的,不是显示器坏了。所有要发到网上的图,最后一步统一转 sRGB。

批量处理我用 ImageMagick,一行命令过整个文件夹:

mogrify -resize '2000x2000>' -quality 85 -colorspace sRGB -strip *.jpg

图片

-strip 删掉 EXIF:一是不泄露拍摄位置(GPS 真的会跟着图跑),二是每张能省 10–30KB。-quality 85 在肉眼几乎看不出损失的前提下,体积通常只有原图的 30%–50%。去背景我用 Photoshop 的动作加批处理,不用在线工具——免费在线服务基本都把分辨率压到 0.25MP 左右(大概 500×500),发朋友圈够,做封面不够。

三种做法的对比,我实际花的时间

方式 处理 200 个素材 成本 适合谁
手动一条条来 6–8 小时 0 一周只发一条的人
命令行脚本(ffmpeg + ImageMagick) 40–70 分钟(含跑批) 0,学命令约 3 小时 长期做、素材量大
一体机客户端软件 1–2 小时 年费 200–600 元 完全不想碰命令行

中间那行是我的选择。第一次写脚本花了一个下午,之后再没手动转过码。

几个我不推荐的流行做法

所有素材都传云端。 上行带宽是瓶颈,家宽 100Mbps 上行传 45GB 要一个多小时,而且不少网盘对单文件有大小限制、对视频还会二次压缩。我的做法是原始素材冷备在移动硬盘,只把成片和少量精选素材上云。

图片

买那种“一键加工”的会员功能。 本质是给你套模板加滤镜,转场和压缩参数写死了,出片一眼能看出来是同一套。你需要的是能复用的流程,不是一次性成品。

拿 NAS 当唯一备份。 RAID 不是备份,它只防单块盘坏,防不了误删、勒索病毒和整机断电烧毁。遵循 3-2-1:三份数据、两种介质、一份异地。

最后是归档,也是最容易被跳过的一步

项目发出去 30 天,如果没人找我改,我就把整个 00_raw 用 7z 打包,分卷压到 4GB,扔进冷备硬盘。打包前跑一遍文件数量核对,1284 个文件压完解压出来还得是 1284 个。这步听着多余,但我在一次拷贝中断之后靠它救回过一整期素材。

归档完,项目文件夹只留 03_out 和工程文件。硬盘从 1.24TB 的乱摊子清到 380GB 可用,翻素材的时间从 40 分钟降到大概 3 分钟。

说白了,素材加工这活不酷,做完也没人给你点赞。但它是那种做一次省一年的投入。我现在最后悔的不是买错了镜头,是前两年拍了 6000 多个文件,一个都没命名。