图片信息量不是分辨率说了算,别再被像素数骗了
去年冬天去川西拍雪山,我带的是A7R4。6100万像素,快门1/500s,光圈f/8,ISO 100,原片RAW将近64MB。回来之后我从RAW里导出一张JPEG,质量设置8,文件只有7.3MB。传到手机,再发到微信,好嘛,变成了大概800KB的压缩图。拿给朋友看,他们说跟原图有什么区别?我一时语塞,因为……放大到像素级当然有区别,但放到朋友圈,区别就集中在那些没人注意的雪地纹理、暗部噪点、山脊岩石的棱角。说白了,图片信息量和像素数不画等号,而且很多人误解了“图片信息”这四个字。
我后来做过一个实验。把同一张月亮照片切成三块:一块全黑天空、一块月面亮部、一块边缘阴影。全黑天空占了约40%面积,但它在文件里存储的信息基本是“平坦噪声”——像素之间几乎没有差异,转换成JPG后压缩率极高。月面亮部因为陨石坑纹理和明暗过渡,存了一堆高频数据。看文件大小切片分布,和真正让人“记住哪块有内容”的感觉完全相反。如果按香农信息的定义,信息量是消除不确定性,那么天空里几乎每个像素的灰度值都差不多,不确定性很低,信息确实很少。但人的视觉恰恰相反,一块大面积纯色背景会让人觉得“哇,干净”,月亮上灰扑扑的细节反而很容易被忽略。所以照片里的信息实际上有两种:一种存在磁盘上,一种被激活在你看照片的视线移动过程中。
另一个容易被坑的地方是“看元数据”。几乎所有图片格式都携带着拍摄参数的元数据。用exiftool打开我的RAW,会列出几百项:镜头焦距、光圈、快门、测光模式、GPS坐标、色彩配置、镜头调校数据……但这些不是图片信息,严格说是“拍摄信息”。之前有朋友问我,他说自己拍的照片在电脑里看着很锐,传到图库网站后变得模糊,是不是图片信息被平台吞了?确实,图库网站通常会对上传的原图重新编码,比如将Adobe RGB转成sRGB,把14位色深压缩到8位,同时用更高的压缩量化表格。看起来每张图的像素数没变,但颜色层级从4096档变成256档,丢掉的是一种连续过渡的细腻度。所以分辨率和信息量根本是两码事。你拿一台6000万像素的相机拍一块单色背景墙,它的有效细节可能还不如一张1200万像素的人脸照片。
那么,怎么才能看图时知道一张图真正包含多少信息?方法比较土,但也挺准确。把图片导入Photoshop,转成Lab模式,看明度通道的纹理。或者用ImageJ做相邻像素差值分析,计算边缘密度。我常用一个偏方:把图片缩小到20%,再放回100%查看——如果看起来依然清晰,说明这张图的主要信息是低频大形状;如果缩小后感觉细节密集、甚至有混叠摩尔纹,说明它的信息压在高频边缘里。另外一个更直觉的判断:“把图片打印成A3,隔一米看,还能不能讲出故事?”能,就说明关键信息还在。拍摄时我并不追求每个像素的精准还原,而是追求在目标媒介上,让某些结构被感知到。很多人说“我要RAW就是为了信息全”,可RAW里的信息全,不代表输出的图片信息一定全,最终输出格式和观看场景才决定哪些信息是有效的。这张照片值得保存,不是因为它的参数高,而是因为它留下了我当时没注意到的某个细节,而那个细节在几年后成为了我回忆的证据。