上个月整理旧硬盘,打算把那些下载了就没打开过的视频删掉。扫到某个文件夹时,发现里面躺着2016年用一部山寨安卓手机拍的几百张照片。点开一张,画面泛黄,楼梯歪斜,但就是这张破照片,在文件属性里留着当时的经纬度,还有曝光时间、ISO和各层软件名。那一刻我突然意识到:我们对着照片看了半天,看到的不过是信息的冰山一角。真正讲故事的那个数据文件,一直都在旁边,只是被忽略了。
这件事逼我做了一个对比。过去玩胶片,底片上只有画面的光和影,没有快门参数也没有拍摄时间,最多你能通过底片边缘的齿码或者打印照片背后的手写字知道一些信息。而现在,手机拍摄的JPG文件携带的Exif信息能精确到秒。以我的旧相机为例,一张RAW文件体积约25MB,Exif区只占几十KB,这是一个精密的附注。你可以用macOS的“显示简介”查看,也可以在Windows下右键打开属性,切到“详细信息”,逐条读取。虽然大多数应用会展示光圈、快门,但普通人的困惑是“这些参数到底有什么用”。参数本身是死数据,发挥作用的是当你把照片放到正确的语境中时。比如你用手机拍了一道菜,朋友圈滤镜已经抹掉了几乎所有参数,别人看不到破绽,但当你在电脑上打开原图,它记录了你是在晚上9点07分、35米海拔位置拍下这顿饭。不知怎么的,这比画面本身更具备“真实感”。
然而这种“真实感”很容易被误用。很多文章喜欢强调人人都可以用手机拍照制作“图片消息”,但从来没人提醒:分享原图时,你的住址、常去地点、设备型号全都随着图片泄露出去。GPS坐标的误差通常在3-10米之间,足以定位到你家阳台。这和过去只知道照片“看起来像哪”完全是两回事。我这里提到一个有意思的双面性:隐私风险越大,也意味着照片越容易在数年后被重新认定。例如寻找失散文物、研究老城区变迁,历史照片的Exif缺失可能让你束手无策,但有GPS坐标的照片资料库价值高得多。因此,数字元数据究竟是坏处还是好处,取决于你看图的姿态——抓隐私的人看见了位置,做档案的人看见了历史。
再往深里挖,图片信息还包括机器视角下的“语义”。前年我用一个开源OCR项目测试旧书扫描件,同一个图片,人类能看出它是某博物馆的展览门票,但图像识别模型仅把它当作一个高维向量。信息论里,一张全白图的信息熵接近0,而一个随机噪声图熵极高,可后者并不会让你得到更多的“含义”。像素信息量与观感含义之间常常是相反的。所以,当你试图从一张图片里找一条新闻线索时,真正需要做的是换一种解码方式——从看画面转为读像素、读元数据、读上下文。我自己的方法很简单:在整理照片时,先看缩略图,再用批量工具把Exif导成表格,按时间和地理位置排列,这样才能看到一个完整的事件流。以前有人教我从构图中看出故事性,我却觉得,故事本来藏在光圈数值和坐标里,当你把二者与图像重叠时,那种跨维度信息带来的冲击,比任何构图技巧都大。
最后说点实在的。如果你也想避免把私人信息随图片发出去,可以学一下清理Exif。电脑端做法:Windows选中照片→右键→属性→详细信息→点击“删除属性和个人信息”→选择“删除以下属性的此照片”→全选确定。如果你想批量处理几百张,就用ExifTool这个小工具,官网下载约11MB,在文件夹内执行 exiftool -all= *.jpg 即可把所有标签清空。手机端更粗暴:用系统相机设置关闭地理位置记录,或者在App内发送图片时选择“不包含位置”或“原图前先截图”。但请注意,截图会重置尺寸,同时可能丢失原始拍摄日期;所以不要截图来保护隐私,反而会把你排除出“图片信息”这个游戏。总之,多看一步,多查一层属性,可能很多谜题会迎刃而解。