素材加工到底在加工什么?我拿2.3T废片和一块坏硬盘换来的一套流程
去年冬天接了个本地小家电的活,前后跑了11天,回来一数:2.3TB,417个视频文件,六千多张RAW和JPG混着塞在一个文件夹里。当天晚上我打开 Premiere 往时间线上一拖,预览一格一格蹦,风扇跟吹风机似的。我第一反应是显卡不行,第二天花 1400 收了张二手 3060 装上,情况几乎没变。
后来用 MediaInfo 一个一个翻才发现,机器拍的是 4K 50fps HEVC 10bit,长GOP,码率只有 38Mbps。这种编码压缩率高、画质好,但解帧要靠 CPU 一棵一棵 GOP 去算,预览自然卡。问题根本不在显卡,在“素材本身没加工过就直接上剪辑台”。我那时候才意识到,绝大多数人说的“素材加工”其实只是导出前调个色,真正的加工早就该在拖进时间线之前完成。
我把素材加工拆成四层,很多教程只讲了第一层
介质层:让素材能被顺畅播放和拖动。核心是编解码,不是一个滤镜。 语义层:让素材能被看懂。命名、关键词、文件夹结构都属于这层,比调色重要得多。 结构层:让素材能复用。同一段同期声既能给正片,也能给预告、给竖版切片,不用重复导。 检索层:让素材能被找到。417 个文件里找“主角皱眉那一下”,靠人眼翻是灾难。
大部分教程停在介质层,教你怎么转码、怎么调色,然后告诉你“好的素材加工能让成片更高级”。我不同意这个说法。素材加工的目的不是让素材变好看,是让后面每一次做决定都变便宜——便宜的试错、便宜的返工、便宜的找素材。
介质层怎么做:三种工作流,参数摆出来对比
同样是 4K 50fps 的 HEVC 素材,有三种处理路线,选错了就是白干。
第一种,原生剪辑。不转码,直接剪。优点是省时间和磁盘,缺点是对机器要求高。我的实测:4K HEVC 10bit 在 Premiere 2024 里拖时间线,i5-12400 + 3060 组合大概 12~18fps 预览,加了效果直接掉到个位数。如果你剪的是 1080p H.264(8bit,20Mbps 左右),原生剪辑基本没问题,别折腾。
第二种,代理剪辑(Proxy)。这是我现在的默认选择。把 4K 压成 960×540 或 1024×576 的 H.264,剪辑阶段只用代理,输出时切回原片。关键参数:x264 preset 用 ultrafast,crf 拉到 26~28,音频 aac 128k。这么压出来的代理文件大概是原片的 5%~8%,2.3TB 压完不到 150GB。
# 单文件代理,长边压到 960,保持偶数宽高
ffmpeg -i input.mp4 -vf "scale=960:-2" -c:v libx264 -preset ultrafast -crf 28 \
-pix_fmt yuv420p -c:a aac -b:a 128k -movflags +faststart proxy.mp4
第三种,中间码。DaVinci Resolve 里叫 Optimized Media,默认 DNxHR LB,可以选 1/2 或 1/4 分辨率;Premiere 里一般用 ProRes 422 Proxy。1080p 下 ProRes 422 Proxy 大概 45Mbps,DNxHR LB 大概 36Mbps。帧内编码,拖时间线跟切豆腐一样顺,代价是文件大。2.3TB 如果用 DNxHR LB 全转,出来还是接近 1TB,硬盘顶不住。我一般只给需要做多机位同步或者套底调色的那几条用中间码,其他走代理。
说个反常识的:代理不用压得太狠。我试过 480×270、crf 32 的代理,文件是小了,但看人脸表情全靠猜,粗剪时判断不了“这条能不能用”,等切回原片发现全是废镜头,反而浪费。960 宽是我用了三年觉得最舒服的平衡点。
批量的时候别一个一个点,一次转完再干别的
417 个文件手点是不可能的。我现在的做法是先把待转码的清单一列,用一条循环跑完,然后去吃饭。
# 批量代理:把 ./raw 下所有 mp4/mov 转到 ./proxy,文件名保持一致
mkdir -p proxy
for f in raw/*.mp4 raw/*.mov; do
[ -e "$f" ] || continue
name=$(basename "$f")
ffmpeg -hide_banner -loglevel error -i "$f" \
-vf "scale=960:-2" -c:v libx264 -preset ultrafast -crf 28 \
-pix_fmt yuv420p -c:a aac -b:a 128k -movflags +faststart \
"proxy/${name%.*}.mp4"
done
耗时参考:i5-12400 开 ultrafast,4K 50fps 的 1 分钟素材大概 18~25 秒转完,2.3TB 素材我挂了一夜加一个上午。注意别把代理文件写进机械盘,一边读一边写会互相拖,你的移动固态或者 NVMe 才是该干活的地方。我踩过的坑就是拿一块 4TB 机械盘读写同时跑,读取速度从 150MB/s 掉到 40MB/s,一晚上只转了三分之一。
转完之后在 Premiere 里挂代理:项目面板选中素材 → 右键 → 代理 → 附加代理,或者直接在项目设置里指定代理文件夹自动匹配。剪映专业版也有“代理模式”开关,在全局设置里,导入大素材前先打开,能省不少事。Resolve 在媒体池右键选“生成优化媒体”,参数在偏好设置里定,我用 DNxHR LB + 1/2 分辨率。
语义层才是真正拉开差距的地方
我见过太多人(包括两年前的我)把所有素材命名为 DJI_0384.MP4 然后扔进一个叫“素材”的文件夹。三个月后回来找“厨房台面上那个特写”,你得一个一个点开看。这是纯体力活,而且不可逆。
我现在用的是这套命名规则:
项目缩写-拍摄日期-机位-序号-内容关键词
XJD-20231118-A-0032-厨房台面特写俯拍.mp4
XJD-20231118-B-0007-同期声-客户讲产品痛点.wav
规则本身不重要,重要的是在拍摄当天或者第二天就改完,别拖到剪辑前。拖到剪辑前你已经忘了一半内容。批量改名用 Total Commander 或者 Advanced Renamer 都行,带序号自动递增。文件名里别用 # / ? * : 这些字符,Windows 直接报错,跨平台同步也会出问题。
图片素材同理。我一般先用 XnConvert 跑一遍:输出格式 JPEG,长边限制 2000 像素,画质 82,勾选保留 EXIF,色彩空间统一转 sRGB。六千多张在 i5-12400 + NVMe 上跑了大约 25 分钟。这一步能让后面丢进 Lightroom 或者达芬奇的时候少一半麻烦,尤其是混合了手机、相机、截图三种来源的时候。
关键词用 exiftool 批量写,比在 Bridge 里一张张点快一百倍:
exiftool -Keywords+="产品图" -Keywords+=XJD -overwrite_original *.jpg
写完之后在 Bridge 或 Lightroom 里按关键词筛选,几秒钟就捞出想要的那批。
音频加工:这个最容易被忽略,也最容易翻车
视频组的人普遍不重视音频。我之前的片子被甲方说过“声音忽大忽小”,回去一看,素材里有手机录的、有枪麦录的、还有一段是从另一台机器上扒的环境音,响度差了 12dB。
标准化用 ffmpeg 的 loudnorm 滤镜就行,两遍模式最准。目标响度:YouTube 和 Spotify 都是 -14 LUFS,苹果播客推荐 -16 LUFS,峰值留到 -1.5 dBTP 比较安全。
# 第一遍分析
ffmpeg -i in.wav -af loudnorm=I=-14:TP=-1.5:LRA=11:print_format=json -f null -
# 第二遍按输出的 measured_* 参数回填,这里省略具体数值
ffmpeg -i in.wav -af loudnorm=I=-14:TP=-1.5:LRA=11:measured_I=-18.3:measured_TP=-2.1:measured_LRA=6.4:measured_thresh=-29.0:offset=0.3 -ar 48000 out.wav
降噪这件事我吃过大亏。有一次现场空调声特别大,我图省事在每条素材上都挂了降噪,降了 8dB。结果客户临时说想听听“现场的真实感”,我得把降噪全部撤掉重来,等于白做。降噪、锐化、变声、变速这四类是不可逆的破坏性操作,除非甲方明确要,否则留到最终输出前再动。 调色、LUT、字幕样式、转场这些是可逆的,随便改,提前做也没事。判断标准就一条:这个操作做完之后,原始信息还能不能恢复。
检索层:417个文件怎么在三分钟内找到那一条
最后说一个没人讲的东西:素材去重和近似帧检索。
我拍产品的时候习惯一个动作拍五六条,回来一看,有大量肉眼几乎一样的镜头。全留着,硬盘吃不下;全删了,又怕删掉最好的那条。我的做法是用 ffmpeg 每条视频抽第 1 秒的一帧,转成小图,然后跑感知哈希(pHash)比对,汉明距离小于 6 的我认定是近似镜头,人工过一遍再决定留哪条。工具上,嫌麻烦可以直接用 Duplicate Cleaner 5 的“相似图片”模式,容忍度设 85% 左右,够用。
还有一个更土但更有效的办法:拍完当天写一份文字版素材清单。用手机备忘录也行,记下每段大概拍了什么、哪条最好、哪条有穿帮。我现在的清单长这样:“A机 0031-0038 开箱手部特写,0034 最好,0035 手抖废。”三个月后你觉得这没用,一年后你回来改片子,这份清单就是命。
备份:别等硬盘坏了才想起来
3-2-1 原则是老生常谈,但我真正执行是丢过一次素材之后。外景拍摄卡 → 现场拷到移动固态并校验 → 回公司复制到一块 4TB 机械盘 + 另一块离线移动硬盘。校验用 rclone check 或者直接 ffmpeg 空解一遍:
ffmpeg -v error -i file.mp4 -f null - # 有报错说明文件损坏
我那块坏掉的硬盘是西数 2TB 蓝盘,用了四年,某天早上直接不认盘,里面是两年前一个项目的原始素材。数据恢复报价 3800,我没做,因为项目早就交付了。但如果那是正在做的活,这事就不只是 3800 的问题。
所以,什么时候不该加工
最后给个反向观点:不是所有素材都值得加工。
如果一个项目只有 20 条 1080p 素材、三天内交付、不涉及多机位,那你就别折腾代理了,直接剪,省下的两小时去改脚本更值。我见过有人为了“规范”,把 15 条手机竖屏视频也转一遍 DNxHR,转完发现达芬奇读竖屏素材还得手动改分辨率,纯属自找麻烦。
素材加工这件事,听起来像是“把素材变得更好看”,实际上它是“让后面的每一次决定更便宜”。介质层决定你能不能顺畅地看,语义层决定你能不能快速找到,结构层决定你能不能用一次拍的东西做出三个版本。这三件事做对了,剪辑桌上剩下的就只有创作,没有体力活。