AI Safety2026-09-10IEEE Spectrum AI

AI模型开始给文本加水印,Claude也加入了

为了打击虚假信息的传播,Anthropic最近宣布,未来所有版本的Claude模型在生成文本时都会嵌入一种肉眼看不见的水印。这一举动让Anthropic跟谷歌和OpenAI站在了同一条战线上,后两家公司早就在各自的AI系统上用了类似技术,尤其是谷歌的Gemini。 这种水印技术,Anthropic的方案也是基于它,原理是对AI模型产出的词汇选择和句子结构做细微的、统计上可检测的改动。这些模式人眼根本察觉不到,但专门的软件能可靠地识别出来。目标就是建立一套靠谱的方法,把AI生成的内容跟人类写的文字区分开,应对大家对线上信息真实性的担忧。 这个进展来得正是时候,因为AI写作工具越来越聪明,机器生成的文章、评论或社交媒体帖子越来越难分辨。滥用的可能性太大了,从自动化的宣传到学术造假都有。通过在输出里嵌入数字指纹,这些公司希望能给平台和监管机构提供一个安全网,让他们能核实文本的来源。当然,这技术不是万无一失的,高手可能找到办法绕过,但它确实朝着问责制迈了一大步。整个行业都开始用水印,说明大家承认了一个事实:AI的创作能力越强,确保数字生态透明和信任的机制也得跟着变强。

相关资讯