先说结论:这是来源信号检查工具,不是“100% 无痕”按钮

项目把几类常被混称为“AI 水印”的东西拆开:文本里的零宽字符、双向控制符和特殊空格可以确定性检查;PNG、JPEG、PDF、DOCX 等容器里的 C2PA、EXIF、XMP 或文档属性可以定位并尝试清理;统计文本水印需要大幅重写;像素级 SynthID 类信号则依赖外部评分或重新生成后端。前两类能逐字节比较,后两类在没有厂商 detector、key 和测试协议时不能诚实地给出“已通过官方检测”的结论。

这一区分对中文创作者很重要。平台压缩、CDN 转码、截图和普通编辑器可能意外丢失或破坏 Content Credentials,隐私清理也可能同时删除作者、相机和地点信息。C2PA 又区分对原始字节做加密绑定的 hard binding 与基于指纹或不可见水印的 soft binding;即使嵌入 manifest 被移走,外部 provenance store 仍可能借 soft binding 找回。文件里看不到 C2PA,不等于来源链必然消失。

可复现内容应从“六栏报告”开始

用自制测试包保存原件、哈希与明确披露,分别记录 Unicode、EXIF/XMP、hard-bound C2PA、soft binding、像素水印和统计文本水印。每次处理后用独立工具复验容器、签名状态和官方可用检测入口,再做语义 diff、图像质量与 CDN 转码测试。结果状态至少分为“已定位”“已验证”“已移除”“未检测”“检测器未运行”和“不可验证”,绝不能把后两项写成成功。

所有测试样本、来源、六栏模板、标题和失败结果都应免费公开,并保留原始来源凭证。读者可向搞着玩实验室免费提交自己的自有内容与转码链,先共同设计不伤害署名的验证;只有用户自己的隐私诊断、披露修复原型或固定范围 MVP 才适合另行定义付费范围。