当前位置:主页 > 要闻 > 正文

AI痕迹追踪简史:你的机器写稿记号早被发现了

发布时间:2026-08-14 已有: 位 网友关注

  1949年,贝尔实验室的克劳德·香农发表了一篇名为的论文来探讨密码学,其理论探讨了一个后来不断被扩展的结论:

  他说的是:只要是某个信息源产生的内容,就必然在统计层面留有可辨识的印记。这个印记不需要被故意放进去,它是信息产生机制本身的副产品。

  “2026年8月,Anthropic宣布将在Claude模型生成的文本中全面部署不可见统计水印,并逐步覆盖既有模型。

  几乎同一周,社媒上的AI圈争论此起彼伏,用AI写作、生成的人开始担心,觉得自己会被发现。

  但如果回到香农的框架,这件事其实早就注定了。AI内容能被识别,这一点没有悬念。真正的问题在后面:用什么方式识别、谁来识别、识别之后意味着什么。

  1964年,哈佛的统计学家弗雷德里克·莫斯特勒和大卫·华莱士做了一件更大胆的事。

  是美国立国之初最重要的政治文献之一,由汉密尔顿、麦迪逊等人合著,其中12篇的

  两名统计学家最终用贝叶斯方法统计了这些词在已知署名里的出现频率,拿概率模型去比对争议篇目。

  它在法庭上被用来鉴定匿名信的

  彼时美国历史上最知名的“邮件炸弹犯”卡钦斯基,曾在寄给报纸的万字宣言里有大量个人化的措辞习惯,法庭语言学家对此将宣言和卡钦斯基私人文字做了系统比对,结论是两者“几乎可以确定出自同一

  香农的命题在这些案例里已经被反复验证,一个人选词的概率分布,在统计层面有着相当稳定的个人特征,多到无法用刻意控制来完全消除。

  语言模型生成文字的过程,是在每一步计算下一个词的概率分布,从分布里采样一个词,接进,再做下一次计算。这个过程重复几百次,一段文字就出来了。

  每个模型的概率分布存在着系统性的差异,因为训练环境、数据、架构、对齐方式、解码参数都是不一样的。

  面对同一个上下文,GPT和Gemini给“改变”、“重塑”、“影响”、“颠覆”这几个词分配的概率是不同的,差异在每一次生成里都以某种系统性的方式呈现。单次选词差距微小,但经过几百次、几千次的累积,这种系统性差异会在整篇的统计结构里留下可辨别的轮廓。

  2023年,斯坦福大学米切尔等研究者发表了DetectGPT研究发现,由某个语言模型生成的文字,往往处于该模型概率函数的“局部极大值”附近。

  利用这种曲率特征,在完全不需要预先加入任何水印的情况下,就可以判断一段文字是否更可能由某个模型生成。

  在一次针对特定模型生成假新闻的检测实验中,DetectGPT把命中率从此前最好方法的0.81提升到了0.95。

  OpenAI在2023年1月发布了自己的AI文本检测工具,5个月后以“准确率太低”为由下线,它在自己的评估集上只能正确识别26%的AI写作,同时把9%的人类错误判成AI。

  这个工具用的是风格分类器,和水印检测完全是两种东西,但它证明了一件事:AI内容有统计特征,和“存在可靠的通用检测器”是两件不同的事。

  2025年9月1日,四部门联合发布的正式施行,抖音、快手、小红书、B站、微博同日上线AI内容标识功能。

  但有第三方评测发现,平台的自动识别技术能力参差不齐,快手首周表现尚可,抖音的自动识别几乎失灵;到10月下旬,另一家媒体的评测又翻转了,抖音对AI生成的识别率最高,快手、小红书和号对无水印AI均未作出标识。

  逻辑依然是香农的框架:把秘密信息编码进信道,通过统计规律传递

  Google的DeepMind在2023年8月第一个把这个逻辑做成大规模部署的商业产品SynthID,最初用于模型生成的图像。

  嵌入方式是在图像像素层面写入一个统计信号,人眼无法察觉,但SynthID的检测算法可以识别,对裁切、压缩、加滤镜等常见操作具有一定抵抗性。随后扩展到音频、,2024年5月扩展到文字,部署在Gemini的对话界面里。

  Google的这套文本水印机制,是在模型生成每个词之前,按照一套带密钥的算法对词汇概率分布做出极微小的调整,使最终词汇选择序列在统计上符合一个隐藏规律。

  研究团队把具体方法叫做“竞赛采样”,通过调整词汇之间的竞争规则来编码信息。整篇表面完全正常,信号藏在“每次选了哪个词而没选哪个词”的统计模式里。

  Google在将近2000万条Gemini用户响应里对比了加水印、不加水印版本,用户满意度评分没有显著差异。

  2026年5月的I/O大会上,SynthID的规模被披露已超过1000亿条AI生成图像和被打上水印,AI生成音频的标记量相当于6万年的播放时长,Gemini用户主动发起的水印验证累计5000万次。

  OpenAI、英伟达等大厂也宣布加入SynthID生态,Google同时将SynthID验证能力推进到和浏览器工具中。

  第5条要求,文件的数据结构里需要写入服务提供者编码、内容编号、生成属性等元数据信息。

  这种选择有它的制度逻辑,元数据方案合规成本更低,验证更容易,监管部门可以用统一格式直接审查。

  第12条则明确写道,服务提供者在履行算法备案时应当提供标识相关材料,为防范打击犯罪活动提供支持,设计核心是建立一条从内容到服务商的可追溯制度通道。

  根据截至6月末的数据,国内已有998余款大模型完成备案,598余款在省级部门完成登记;生成式AI产品用户规模超过2.3亿人。

  生成级水印打击的是把AI输出原样粘贴的批量生产者——例如端到端的同质化内容生产者、批量自动化发布账号以及AI翻译站。

  元数据体系在这个场景同样具有优势,当批量自动化内容未经审核直接发布时,元数据里带着服务提供者编码,顺着备案信息以用来追溯

  这对元数据那一层是成立的。但对生成级水印则不然,因为水印是通过影响哪些词被选中来编码的,语言本身就隐含了统计规律与模型指纹。

  把文字变成像素,OCR再把像素变回文字,如果OCR足够准确,还原出来的词汇序列和原来基本一样,水印没有消失。

  真正能消灭生成级水印的是重新生成语言,即理解AI写的一段话,不看原文,从头自己写出意思相近的表达。

  Google和Anthropic在都曾坦言,大幅改写、翻译、与其他文字大量混合,都可能导致水印无法检测。

  2025年,WaterPark基准测试对10种水印方法做了系统评估,覆盖12种攻击类型、3个语言模型和5个数据集。结果是SynthID在未受攻击的原始文本上检测率高达99.8%,但在中等程度的改写攻击下降到49.8%。

  2026年7月的一项实验性研究发现,对包括SynthID在内3种主流水印方案进行了846次改写攻击测试后,SynthID的水印移除率超过了98%,而另外两种被100%的全部移除。

  SynthID还在人类写作的文本上产生了5.4%的误报率,对自己80%的水印文本给出了“不确定”的检测结论。

  研究者的最终结论是,目前AI水印无法满足司法采纳等特殊的场景要求,更没有任何公开的文本水印方案能作为法庭上的独立证据使用。

  Anthropic这次的新技术还有一个隐患,例如它承诺将向第三方提供检测Claude水印的API,但同时使用者也可以它证实“消除水印的反馈信号”,例如通过持续的改,并调用API检查来实现AI水印的最终清理。

  水印体系真正有效打击的,是那些把AI输出原样粘贴、批量自动化发布的黑产者,这往往是政策最需要打击的目标。

  如果回答是确定的,比如东方明珠在哪个城市,模型只会回答上海,这种生成过程中,水印没有足够的概率空间来介入。

  普通交给AI模型来

  技术层面的脆弱性,往往应对了商业上的巨大空白,围绕AI水印体系,产业层面仍然存在一批又一批的真实需求。

  过去的AI检测依赖风格分类器,从统计推断去猜一段话是否产自于AI,水印体系成熟之后,审核逻辑从“猜风格”转向“查

  围绕水印检测API、合规报告生成、内容溯源存证的工具链,是现在最直接的机会窗口,甚至本身就存在着大量可能被应用于AI内容审计的基础设施缺口。

  要求服务提供者在算法备案时提交标识技术细节,这事实上为独立第三方的合规审计服务创造了制度性需求。

  如今近千款备案大模型,每一款都需要证明自己的标识方案符合强制性国家标准要求,目前这个需求几乎没有专门的商业产品在承接。

  普华永道等一些第三方机构进行过合规解读,但从解读到可交付的审计工具和自动化检测服务之间还有非常远的距离。

  抖音、快手、小红书、B站在执行层面遇到的技术困难同样值得关注,平台需要自动检测AI生成内容的能力,但自建成本高、准确率不够。面向内容平台的AI内容检测SaaS,是一个刚刚起泡的赛道。

  当生成级水印成为主流厂商的标配,“在这段内容里检测不到任何已知AI模型的水印信号”开始具有一定的排除意义,尤其作为纠纷中的辅助证据,其法律价值是线年以来,已有多起涉及AI生成内容的著作权纠纷进入司法程序,法院在判定AI辅助和AI生成的边界时缺乏技术工具。的元数据体系提供了一条追溯通道,但元数据在传播过程中丢失之后,归属的举证就变得难上加难。

  研报、分析师评论、企业公告、财经媒体,这些是金融机构依赖决策的客观信息,但必须承认这些内容受AI影响的程度正在快速上升。

  一份用大模型批量生成的研究报告,和一名分析师做了充分调研后写出的判断,信息含量截然不同,但外表可能一模一样。

  欧洲证券和市场管理局在2024年已就AI在投资服务中的透明度发出

  中国的元数据体系和海外生成级水印体系在技术标准的互通上还有很长的路要走,而一家在中国合规落地的内容平台把内容分发到欧洲市场,欧洲的检测系统未必能读取中国格式的元数据,反之亦然。

  帮助内容企业在两套体系之间做格式转换、合规映射、双向存证的中间件服务,是一个政策落地节奏创造出来的窗口期机会。窗口期的长度取决于中欧之间标准互认谈判的进展。

  从香农研究通信系统的统计特性,到用词频率能破解联邦党人文集的

  过去的印记是被动留下的,检测它需要大量样本和复杂统计方法;现在的主动水印,让印记在设计上就是可机器验证的,同时被纳入有法律效力的合规框架。正如国内有,欧洲有,美国也在酝酿联邦层面立法。

  水印技术本身还远谈不上完美。许多基准测试和法庭证据研究都显示,一轮改写就能让大多数方案失效,很难找到稳定的公开方案能达到法庭独立证据的标准。

  但这不妨碍围绕水印体系的产业机会已经打开,例如合规审计工具、内容溯源存证、举证服务、金融信息质量鉴别、跨体系标准互操作。

  这些需求不需要等技术完美就已经真实存在,有机构甚至预测AI水印市场将在10亿美元后增长到25-50亿美元。

  当机器能以一定可靠性证明一段内容“经过AI处理”,接下来必须回答的问题仍然会出现在合同里、在法里、在新闻伦理里、在学术诚信里。

  特别

  赔付1.2亿美元也要退!全球化工巨头“英力士”正式宣布退出与中石化合资企业,为期三年的50:50合资模式终结!网友:胖东来和国际接轨了

  今晚油价下跌,单次“大降近8毛/升”,近6年“最大油价下跌”后,8月油价再下降,别急加油!

  葡萄里长出小蘑菇,两年前的“果菌王”再现?网友喊话“快送中科院”,专家:是一种小众的食用菌

  越南少将阮德辉回忆,当年中国军队能安然撤退,并非越军畏惧不敢追击,而是黎笋在河内那个辗转难眠的深夜,悄悄签发了一道密令

  马斯克的妹妹从小就坚信,跟着哥哥有肉吃,瞒着妈妈把南非家里的房和车都卖了去加拿大投奔哥哥!妈妈哭笑不得的承认是事实!

温馨提示:所有理财类资讯内容仅供参考,不作为投资依据。