Claude写的文字有了“隐形水印”,但AI文本的猫鼠游戏才开始 claude文字能力 claude有文字乱码
创始人
2026-08-17 10:47:31

本文来源:开机实验室 作者:郭美婷,实习生车文恒

刷到一篇“干货满满“的文章,读完才发现是AI写的;看到评论区的高质量回答,分不清对面是真人还是大模型;就连朋友圈里那段 "走心" 的文案,也越来越难判断背后敲键盘的是谁……

当AI写的东西越来越像人,人写的东西又越来越像AI,“作者到底是不是真人”是这个时代最玄学的问题之一。

Claude在近日上线文本隐形水印功能,给所有模型产出的内容做标记。这意味着,今后从 Claude 里流出的每一段文字,都将自带一份“出生证明”。

但水印只能证明AI参与过,证明不了全文都是AI的产物,例如,若稿子只是经过Claude润色,也会被打上AI标签,原创者反而可能被“冤枉”。而对于刻意隐瞒者而言,大幅改写、翻译、短文本都可能让标记失效。

这场AI与反检测的 "猫鼠游戏",才刚刚开始。

给文本“烙印”

具体来说,Claude主要用两种方式给生成的内容打上来源标记,两套机制互相配合。

第一种是藏在文字里的隐形水印。模型输出文字的时候,会悄悄把水印揉进文本当中,人眼完全看不出来,也不会影响文章的意思和阅读体验。只要复制粘贴这段文字,水印会跟着一起走,就算做一些简单修改,水印也还有机会保留下来。这种情况下,不管用Claude哪个功能页面生成文字,模型都会统一加上这个水印。

第二种是带签名的溯源信息,只针对图片、SVG这类文件。Claude产出这类文件时,会给文件附上一套遵循C2PA行业标准的溯源数据。有了这份数据,既能看出这份文件是Claude处理过的,还能检查文件有没有被人篡改过。

Claude还表示,未来官方还会开放检测工具,不管是普通用户还是第三方,都可以去查验文字或者文件有没有Claude的标记,如果查到标记就说明这份内容很可能出自Claude。


而根据Claude在官网发布的公告,上述标记覆盖全球所有Claude提供服务的地区。

用户无论是在Claude网页、API 接口、Claude Code、Cowork、Tag,还是通过AWS、谷歌云、微软Foundry等第三方云平台调用模型,只要是支持该功能的模型,产出的内容就会带上标记。

不同的是,用来证明内容是AI产出的溯源凭证不一样,只有用户上传文件直接通过Claude相关处理时才会生效,部分第三方云平台调用Claude时,隐形水印会正常存在,但可能拿不到这份溯源凭证。

事实上,Claude(Anthropic)并不是首个提出赋予AI生成文字“DNA”的公司。此前,谷歌DeepMind和马里兰大学的研究团队就已经在文本水印领域取得了突破。

2023年4月。美国马里兰大学的研究团队在论文《A Watermark for Large Language Models》中,首次提出了一种针对大语言模型的统计水印方法。学术界视其为给AI文本打“DNA”的开创性工作之一。

2024年10月,谷歌DeepMind在《自然》杂志上发表了关于 SynthID-Text 的研究。这项技术通过一种“锦标赛采样算法”,将水印直接整合到大语言模型生成文本的步骤中,是首次在现实世界中大规模部署的文本水印技术,已经应用在了Gemini聊天机器人上。

上述技术的原理,是通过调整模型在生成过程中选择词语的概率分布,让生成的文本在统计特征上带有某种特定的规律。这种规律对人类读者完全不可见,但可以通过特定密钥检测出来,就像给文本打入了AI“烙印”一样。

不过,目前Claude暂时还未公布加隐性标识背后的具体技术原理。

“猫鼠游戏”?

尽管Claude有办法给文字加上自己的专属标记,但其可靠性仍有待验证。

根据Claude官方的阐述,首先,查到标记≠就是AI写的。用户使用Claude改稿子、翻译、总结别人的内容,输出内容后,照样会带上标记,而且在AI输出之后,人还可以改、剪、拼接别的内容,标记只能证明AI碰过这份内容,不能保证现在看到的全部都是AI原生产出。

其次,就算查不到标记,也不代表没用过Claude。涉及到老版本模型、文字被大改翻译、文字太短、部分平台不支持标记等等,这些情况都可能会导致标记消失。

目前,市面上涌现出不少可以测AI率的工具,如腾讯朱雀AI检测、XYZ SCIENCE、Decopy AI、Wordvice AI等。查阅它们的官网介绍,这些工具多先使用大量AI写的、真人写的各类内容训练模型,专门揪出AI行文的固定句式、用词套路等内在特点,并且跟着新AI模型更新算法,最后量化算出文本AI生成占比,识别AI写作痕迹。


有意思的是,这些AI检测网页中,同时伴有的功能是——降AI率。用AI检测AI,再用AI降低AI,玩了一把“以子之矛,攻子之盾”。

在电商平台上,也不乏降AI率的生意,开机实验室选取销量较高的商家问询。



从收费上来看,开机实验室参考几家报价,万字文本的价格在28、29元上下,实现方式主要有两种:一是是通过自助软件降AI,支持整文上传或分段修改,宣称可将AI率降至 20% 以下;另一种是后台算法批量改写,商家称能降到知网10%以下。


不过,这些商家都不约而同地提到了一点——目前暂无法去除Claude生成的标识。

看不见的水印和看得见的监管

不过无论是给AI文本打上“烙印”还是为AI文本“去AI味”,背后都是同一个动因。

近年来,AI模型智能化水平快速跃进催生了全球监管需求。其中欧盟《人工智能法案》第50条第2款关于AI生成内容强制透明标记的合规规定。该条款明确要求生成式AI厂商为AI产出文本、音视频等合成内容增设机器可读、可溯源检测标记。

在国内,2025年9月1日,国家网信办、工业和信息化部、公安部、国家广播电视总局联合制定的《人工智能生成合成内容标识办法》(下称《办法》)正式生效。该办法也提出了强制添加显式和隐式标识等规范要求,其中,显式标识是指在生成合成内容或者交互场景界面中添加的,以文字、声音、图形等方式呈现并可以被用户明显感知到的标识。


针对文本内容,《办法》明确要求添加的显式标识是在文本的起始、末尾或者中间适当位置添加文字提示或者通用符号提示等标识,或者在交互场景界面、文字周边添加显著的提示标识。

而对于隐式标识,《办法》要求在生成合成内容的文件元数据中添加,要包含生成合成内容属性信息、服务提供者名称或者编码、内容编号等制作要素信息。所谓文件元数据指的是,按照特定编码格式嵌入到文件头部的描述性信息,用于记录文件来源、属性、用途等信息内容。

这也就意味着,只有获取到原始的AI生成文件,才能通过技术手段读取到隐藏在文件头部的这些描述性信息。由于它并非直接呈现在画面或文字表面,一旦文件经过截图、录屏、格式转换或二次编辑,这些元数据就极易丢失或被抹除,从而导致标识失效。

《办法》也表示,鼓励服务提供者在生成合成内容中添加数字水印等形式的隐式标识。

从国内厂商侧来看,各模型厂在显示标识上多采用水印,如“XXAI生成”、”XXAI“等字样,一般见诸于AI生成的视频和图片,放置于画面角落。文本则较少添加提示标识。

而目前抖音、B 站、小红书等内容社交平台,以及豆包、即梦等 AI 生成工具平台,均依据《办法》建立了AI内容双标识管理体系:一方面要求创作者、使用者主动添加文字、角标、文案备注等可直观感知的显式标识,平台配套提供一键打标、发布声明等功能辅助用户合规标注;另一方面平台与AI生成工具会在文件元数据内嵌包含生成来源、编号等信息的隐式AI标识,同时明确禁止任何人删除、篡改、隐匿AI标识。

相关内容

热门资讯

ETF今日收评 | 科创成长E... 8月17日,市场全天震荡反弹,沪指涨超1%,科创50指数涨超4%。从板块来看,算力硬件概念走强,医药...
科创板迎来年内最贵新股!186... 2026年8月18日,科创板迎来年内最贵新股,频准激光以186.88元/股的发行价挂牌上市,中一签需...
震裕科技:18.8亿可转债落地... 8月17日,“震裕转02”申购,申购代码370953。几天前,震裕科技(300953.SZ)18.8...
收盘|创业板指涨3.14% 算... 8月17日,四大股指集体收涨,上证指数报收3982.65点,涨1.41%,深成指报收14704.27...
打着 "公益&quo... 一场精心策划的 "公益复出秀",刚开场就草草收场。近日,网红歌手那艺娜(本名翟革英)现身河南参加线下...