素材加工去重到底该改什么?我拿200条片子实测,改参数的基本都在白折腾
我在剪映里删掉第17版时间线的时候是凌晨两点四十。导出,改名,上传,第二天早上播放量312。素材是甲方给的同一批产品空镜,一共6个文件,总时长4分12秒,这是我用它们做的第17条片子。
那阵子我像着了魔。B站、抖音、各种付费群,凡是标题里带「去重」「过审」「防搬运」的教程我全存了,大概四十多个视频,记了两本笔记。现在回头看,那堆笔记里九成在教同一件事:改参数。镜像翻一下,抽个帧,调个对比度,改个码率,换个采样率——看起来特别有技术含量,我照着做的时候也觉得自己在干正事。
结果就是开头那一幕。同一个素材包,前5条数据还行,第6条开始往下掉,掉到第17条的时候是312。那段时间我甚至怀疑是账号被限流了,换了个新号发同一条视频,还是三百多。
我记的那份参数清单,一条不落地全试过
当时我做了个Excel,列了所有能改的维度,每改一个就单开一版导出。清单大概是这样的:
- 画面层面:水平镜像翻转;每12帧抽1帧(25fps下差不多每秒丢两帧);对比度 +5%、饱和度 −3%、色温往暖偏200K;画面缩放到98%,四周留一圈肉眼几乎看不见的黑边
- 时间层面:变速1.03到1.08倍之间随机取值;掐掉开头0.3秒、结尾0.5秒;中间随便插一个0.1秒的闪白
- 编码层面:1080p降到720p再升回1080p;码率从8000kbps压到4000kbps;关键帧间隔从默认改成12;H.264换H.265再换回来
- 音频层面:48kHz重采样成44.1kHz;整体音量拉高1.5dB;在1000Hz附近做个±2dB的EQ
这套东西做完,我用一行命令验过文件指纹:
ffmpeg -i in.mp4 -map 0 -c copy -f md5 -
16个版本的哈希值,全都不一样。写到这里我得承认,当时我盯着那16串不同的字符看了很久,心里想的是「成了」。但从文件本身来说确实16条都是全新的素材,平台那边收到的也是16个不同的文件。问题就出在这儿——我以为自己在对抗的是文件比对,其实根本没人拿哈希值在比。
发现不对劲的转折点,是音频指纹
我后来把两条播放量差得最远的片子扔进 fpcalc(就是 acoustid 项目里那个音频指纹工具,fpcalc -raw 文件名 就能出结果)。本来是想看看画面之外还有没有别的线索,结果这一看有点懵:两条视频的音轨指纹差异非常小,小到我觉得它俩几乎就是同一段声音。
我当时的反应不是「原来如此」,而是「那我前面16版白做了」。因为画面我改了那么多,声音我一直觉得「随便对付一下就行」,只调了个音量和采样率。
但我现在也不觉得音频指纹就是那个决定性的东西。因为后来我把整条音轨换成自己录的环境音,数据也没起来。所以这一层我到现在也没完全搞明白,只是知道它不是全部答案。
真正的转折是我把200条成片(包括帮我朋友剪的那些)的播放量拉出来排了个序,然后去看排在前面的那些,参数上有什么共性。看完我很失望——排在前面的片子,参数改得最少。
有一条第3万播放的,我甚至只做了重新剪辑,一个滤镜都没加,码率也没动。而那些被我叠了七八个处理手法的,基本都趴在几百。
这个结论跟我在教程里看到的东西是反的,我一度以为自己统计错了。
我现在的理解:这件事有三层,大多数人只在最外面那层使劲
我把它拆成三层,纯属个人经验,不一定对:
第一层是像素层。 镜像、抽帧、滤镜、调色、变速、重编码,都在这层。这层的特点是可见、可量化、教程最多、见效最慢。你在这一层做的所有事,目的是让文件本身看起来是新的,但平台如果真在比什么,比的也是压缩完之后剩下的东西,而不是你加了多少层。
第二层是指纹层。 画面哈希、音频指纹、关键帧序列、时长特征。这层的门槛比第一层高一点,因为你要懂一点命令行,但本质上还是「技术活」。我花在这层的时间大概是三个月,收获是学会了 ffmpeg,以及一个不算便宜的教训。
第三层是结构层。 这才是真正影响流量的那一层,而且它跟「去重」几乎没关系。它问的是另一个问题:把原素材的镜头顺序、节奏、信息密度全部打散,你重排出来的这条东西,一个没看过原片的人,前两秒会不会停下来?
我后来在一个账号上专门试了这件事。同样的6个空镜素材,我做了4条:前3条还按老办法加参数,播放分别是 412、608、355;第4条我只做了一件事——把6个镜头按信息密度重排,从最满的那个镜头开始,前1.5秒必须出现画面变化(不能是静止的产品摆拍),原来平均8秒一个镜头切成2.2秒一段,并且全部换成我自己用手机录的环境音。这条跑了1.8万。后面又照这个思路做了两条,7万和2.3万。
四条片子,画面素材一模一样,区别只在结构和声音。
具体操作上的几个数字,你们要的直接抄
如果你也在剪这类素材,下面是我现在固定会做的几件事,都是具体的:
- 前1.5秒必须有位移。这条是硬指标,我自己用秒表卡过,静止画面超过1.5秒,完播率掉得很明显。所以原素材第一个镜头如果是静物,我会把它挪到第3位以后。
- 单镜头时长控制在2到2.5秒。原来8秒的长镜头,拆成3到4段用,中间用不同的景别间隔开,不要连着放同一角度。
- 音轨整条换掉,不是调参数,是换。我现在基本不用素材自带的音乐,哪怕是自己录的街道噪音。
- 参数只留两个:对比度 +4%,锐化 +8。其他全砍。我试过同时上五个处理,画质劣化得肉眼可见,最后那条片子我自己都不想点开。
- 重编一次码是必要的,但不是为了去重,是为了让文件干净、体积小。命令大概是这样:
ffmpeg -i in.mp4 -vf "eq=contrast=1.04" -c:v libx264 -crf 21 -preset medium -g 12 -af "volume=1.05" -c:a aac -b:a 192k out.mp4
这行命令我用了大半年了,没什么玄学,就是普通的重编码。抽帧、镜像那些我早就不做了,不是因为它们没用,是因为它们带来的麻烦(画面跳帧、观众看得出镜像的文字反向)比收益大。
最后说一个可能不太受欢迎的看法
我现在越来越觉得,「素材加工」这个说法本身就有问题。它暗示素材是个半成品,你把表面磨一磨就能用。但我剪了这两百条之后的感觉是反过来的:素材加工里真正值钱的部分,从来不是「加工」,而是「选」和「排」。
我那6个空镜,其实有一个镜头是真的好——产品转过来的那一下,光刚好扫过边缘。所有播放过万的那几条,这个镜头都在很靠前的位置。而所有被我按原拍摄顺序排列的版本,它都躺在第5、第6位,观众根本等不到。
这个发现跟任何一行 ffmpeg 命令都没关系,但它比我这三个月学的所有参数都管用。
所以现在有人问我素材怎么加工才不容易被判重复,我会说:你先别管重复不重复,先问问自己这条东西如果从来没被人看过,你愿不愿意把它看完。不愿意的话,改多少参数都是白改。