信任媒体文件前,如何核验 Content Credentials
保存文件,先写清核查问题
Content Credentials 可以记录数字资产的来源和处理历史。开始核验前,先保存收到的那份文件,并写下真正要回答的问题:谁签署了记录,记录是否完整,某项编辑是否存在,还是画面中的事情是否真实?前三类问题可以从来源历史获得线索,最后一类必须依靠凭证之外的证据。
C2PA 把这类记录称为 provenance。Content Credential 也叫 C2PA Manifest,是与资产进行密码学绑定、包含签名 assertion 的结构。记录文件名、获取渠道和实际打开的副本。这个留档方法是本文的操作建议,不是 C2PA 规定的案件流程。
检查 manifest 是怎样被找到的
用支持 Content Credentials 的应用打开文件,先记录是否找到 manifest,以及它怎样与资产关联。Manifest 可以嵌入文件,也可以通过 soft binding 从外部关联。C2PA Explainer 列举的 soft binding 方式包括不可见水印和指纹查询,因此找到外部记录不代表 manifest 原本就在文件内部。
沿用工具自己的措辞,逐项抄录验证结果。C2PA Explainer 描述的检查包括:manifest 格式是否有效、是否保持完整、是否与底层资产关联,以及签名实现是否关联到已知信任列表。不要把多项结果压缩成一句“已验证”,无法确定的项目也要保留。某项检查失败,只能说明该环节没有通过当前工具的验证,不能直接扩写成“文件是假的”。
按 assertion 原有强度读取
继续阅读应用展示的 assertion。它们可能描述来源、创建信息、修改、所用工具、AI 使用方式或 ingredient;不同凭证的字段可以不同。没有出现的字段保持“未声明”,除非其他证据补足。
可以建立四列表格:assertion、原始值、验证结果、待解决问题。姓名、日期、工具标签和编辑动作按原文记录。记录说某项操作发生过,不等于解释了操作原因,也不能证明画面表达的事情。若 assertion 提到发布者或工具,还要结合原始发布页面核对其身份是否符合预期。C2PA 验证不会保证 assertion 中每句话都符合现实。
把来源历史与内容真假分开记录
C2PA 明确说明,Content Credentials 不判断来源数据是好是坏,也不判断内容真假。核查报告应保留两个结论:来源历史结论只写找到的记录、通过的检查和 assertion;内容结论只写原始发布语境、独立报道或其他证据对事件的确认。
没有找到凭证时也要守住这条边界。C2PA 采用自愿加入方式,凭证缺失不能证明文件经过合成、篡改或具有欺骗性。记录检查过的文件和应用,随后继续核对来源、语境与取证证据。
把自动检测作为另一条风险信号
保存的图像、视频、音频或文本可以交给 DeepFakeCheck 获取概率性风险信号。这个结果不能验证 C2PA 签名、识别签名者、找回缺失的 manifest,也不能证明事件发生。把结果关联到实际分析的副本,同时与凭证表分开。
自动分析会出现误报和漏报。误报可能把真实媒体标为可疑,漏报可能放过合成或篡改媒体。高风险结果支持进一步调查,低风险结果不能认证文件。若来源历史和检测结果看起来冲突,应保留两份结果并检查来源与语境,不要强行合成一个裁决。
结束时留下简短证据日志:被检查文件、manifest 发现方式、验证结果、采用的 assertion、未知项、独立语境核查、检测结果和后续决定。复核者应能看清每个结论来自哪项证据。
来源
- C2PA, “C2PA Explainer”: https://spec.c2pa.org/specifications/specifications/2.2/explainer/Explainer.html