素材加工不是“美化”,是先算信息预算
我自己的观点可能有点反常识:素材加工的第一步不是调色,也不是降噪,更不是补帧,而是算你这条片子最终要投到哪里。抖音/视频号/B站/小红书,横竖屏、码率、时长、审核,决定了你该保留多少信息。比如手机拍的 4K 60fps 10-bit HLG,色彩信息很足,但如果你最终只发 1080×1920 竖屏,码率 8-12Mbps,那么原始素材里大量色深和码率就是“运费”,不是画质。我上个月帮朋友剪宠物店视频,iPhone 15 Pro 的 4K 60 HDR 素材一共 47 段,合计 38.6GB。老笔记本是 i5-10210U + MX250,Premiere 里拖时间线直接 12fps,风扇像吹风机。我以为加内存能救,结果不是,瓶颈在解码和 GPU。后来我把顺序改成:先转代理、再分离音频、再做字幕、最后调色导出,时间线预览回到 40fps 左右。这个顺序我踩过坑:先加 LUT 再转代理,代理文件也带着错误色彩,剪完才发现皮肤是灰绿的。
这里有个对比:方案 A 是“直接剪原片”,看起来省一步,实际每一步都在等;方案 B 是“先加工成可剪版本”,多花 20 分钟转码,但后面省 2 小时。方案 A 的参数通常是 4K 3840×2160、HEVC/H.265、10-bit、BT.2020、HLG、50-100Mbps,很多 2020 年后的轻薄本没有硬解 HEVC 10-bit,或者软解很吃力。方案 B 我一般转成 1080p 或 720p 的 DNxHR LB / ProRes 422 Proxy,帧率跟项目一致,25 或 30fps,8-bit 4:2:0,码率 36-90Mbps 左右。文件会变大,比如 38.6GB 可能变成 70-90GB,但剪辑顺滑。我的习惯是代理只用于剪,导出时用“链接媒体”切回原片,或者达芬奇里用优化媒体。注意:代理不是成片,别把代理直接导出,除非你就是要 1080p 交付。
具体步骤:从素材命名到批量转码
步骤 1:先把素材按“日期_项目_机位_序号”重命名,比如 20250518_pet_iphone_001.mov。别笑,我试过 200 多个 IMG_xxxx,找一条狗打哈欠找了 15 分钟。Windows 可以用 Advanced Renamer,Mac 用 NameChanger,或者直接 FFmpeg 配脚本。步骤 2:用 MediaInfo 看参数,重点看 Codec、Bit depth、Color primaries、Transfer characteristics、Frame rate。iPhone 的 HLG 常见是 bt2020 / arib-std-b67,如果这里没看,后面色偏都找不到原因。步骤 3:转代理。我常用 Shutter Encoder,因为它白嫖 FFmpeg,又有界面。参数:输出 DNxHR LB,分辨率 1920×1080,帧率 25 或 30,音频 PCM 16-bit 48kHz,或者 AAC 192kbps。若用 FFmpeg 命令行:ffmpeg -i input.mov -vf "scale=1920:-2,fps=30" -c:v dnxhd -profile:v dnxhr_lb -pix_fmt yuv422p -c:a pcm_s16le -ar 48000 output.mxf。这个命令我翻车过:dnxhr_lb 有时要求 yuv422p,写成 yuv420p 会报错。步骤 4:如果原片是 HDR,代理阶段先别急着 tone mapping,保留 HDR 元数据,等剪辑定稿后再在调色页统一转 Rec.709。达芬奇里用 Color Space Transform:Input Rec.2100 HLG,Output Rec.709 Gamma 2.4。Premiere 里可以用 Lumetri 的 HLG 转 Rec.709,但不同版本位置不太一样,我用的 2024 版在基本校正里。步骤 5:音频分离。对话类视频先把音频导出成 48kHz 24-bit WAV,在 Audacity 里做降噪、压缩、限幅。降噪别拉满,我一般 6-10dB,太多会像水下说话。步骤 6:字幕。先自动识别再人工改,Whisper、剪映、达芬奇都能做。导出 SRT,再用 Aegisub 调时间轴。字号竖屏 48-64,横屏 36-48,底部安全边距至少 10%。最后导出:H.264,CRF 18-20,preset slow,音频 AAC 192kbps 48kHz,响度 -14 LUFS,真峰值 -1 dBTP。
对比表:直接剪原片 vs 代理流水线
| 维度 | 直接剪 4K HDR 原片 | 先转代理再剪 | 我的选择 |
|---|---|---|---|
| 初始耗时 | 0 分钟 | 20-40 分钟/40GB | 转 |
| 时间线预览 | 8-15fps,卡顿 | 30-60fps,顺滑 | 转 |
| 硬盘占用 | 38.6GB | 70-90GB | 备 1TB SSD |
| 色彩风险 | HDR 映射错,皮肤灰 | 先保留,后统一转 | 后转 |
| 导出质量 | 取决于原片和软件 | 链接原片后一样 | 一样 |
| 适合谁 | 短片、M 系列 Mac | 长片、老电脑、多机位 | 看机器 |
这个表不是绝对的。我后来发现,如果你用的是 M1/M2/M3 Mac,剪 4K HEVC 10-bit 其实很顺,Final Cut Pro 对 ProRes 优化也好,不一定要转代理。但如果是 Windows 轻薄本、老 Intel Mac、或者同时开 AE 做动效,代理就是保命。另一个对比是“先调色还是先剪辑”。我的独立观点:先剪辑,后调色;先做可逆操作,后做不可逆操作。因为剪辑会删掉大量素材,你没必要给废片调色。降噪、补帧、超分都属于不可逆或者至少很难还原的操作,最好放在锁定剪辑之后。Topaz Video AI 超分我试过,2 倍放大 1 分钟 1080p 到 4K,RTX 3060 跑了大概 3 分 40 秒,画面确实锐,但皮肤毛孔会假,后来我把强度从 80 降到 35。补帧也一样,60fps 看起来滑,但人物走路会有果冻感,尤其是背景有栏杆的时候。
素材加工的隐藏问题:版权、重复和上传
很多人只关心“怎么清晰”,但素材加工还有三个现实问题:版权、重复检测、上传限制。版权上,别随便用网上的“无版权”音乐,很多站点的授权只针对个人非商用。我自己的做法是:商用项目只用 Artlist、Epidemic Sound、Musicbed 这类明确给商用授权的,或者用自己录的环境音。重复检测上,平台不是简单看 MD5,它会抽帧、看音频指纹、看画面结构。你把一条视频镜像、加滤镜、改速度,不代表能过。我试过把同一段素材变速 1.05 倍、加边框、改色,发到两个平台,其中一个还是被限流。后来我干脆重剪结构,换开场 3 秒、换 BGM、换字幕样式,才正常。上传限制上,抖音网页版、小红书、B站对码率和时长要求不同。B站 1080p 建议 8-12Mbps,4K 建议 35-45Mbps;抖音竖屏 1080×1920 常用 8-12Mbps;小红书压缩更狠,有时 6-8Mbps 反而比 20Mbps 看起来干净,因为高码率会被二次压缩。音频响度我统一到 -14 LUFS 左右,但 B站和播客可以到 -16 LUFS,具体看平台。别把音频压到 -8 LUFS,会炸。
我现在的默认工作流(可抄)
如果今天让我重新做一遍宠物店那条片子,我会这样:1)用 MediaInfo 过一遍 47 段素材,标记 3 段 HDR、2 段 60fps、1 段音频爆音。2)用 Shutter Encoder 批量转 DNxHR LB 1080p 30fps,音频 PCM 48kHz,输出到 proxy 文件夹。3)Premiere 里创建 1080×1920 25fps 项目,导入代理,原片放另一个 bin。4)先粗剪,删掉至少 40% 素材。5)锁定剪辑后,把 HDR 片段用 Color Space Transform 转 Rec.709,再套一个 Kodak 2383 风格的 LUT,强度 30-40%。6)音频导出 WAV,在 Audacity 里高通 80Hz,压缩比 3:1,阈值 -18dB,限幅 -1dB。7)字幕用 Whisper 生成,手动改错别字,导出 SRT。8)导出 H.264 CRF 19,preset slow,音频 AAC 192kbps,-14 LUFS。这套下来,转码 25 分钟,剪辑 1 小时 10 分,调色 20 分钟,字幕 30 分钟,导出 12 分钟。比第一次直接剪原片少了大概 2 小时,而且没有色偏返工。我的结论:素材加工不是把每个素材都做成大片,而是让“能剪、能改、能交付”这三件事按顺序发生。先代理,后美化;先剪辑,后调色;先可逆,后不可逆。这个顺序比任何单个滤镜都值钱。