Claude 这回要把AI标识进行到底!
根据
@AnthropicAI 的新机制,Claude模型生成的文字会被嵌入机器可读取的隐形水印。即使文字被复制粘贴时,水印也可能随之传递,甚至在经过一定程度的修改后依然存在。
这就相当于Claude生成的文字,都会留下“隐形印记”。
但我总觉得,这里面有一个重大的逻辑漏洞!
即便检测到Claude的水印,并不能证明这段内容是Claude创作的,因为这最多只能说明:这段文字可能曾经被Claude处理过。
如果一篇文章的观点、逻辑和判断都是我自己的,我只是请Claude帮我检查语法、润色表达或完成翻译,最终文字仍可能带着和“完全由AI生成的内容”一样的标记 - 这并不公平。
Anthropic自己也承认这一点。
这实际上混淆了两个完全不同的问题:
AI是否参与过这段文字?以及究竟是谁完成了真正的思考?
当Google搜索出现时,我们并没有把所有借助Google完成资料研究的文章都标记为“Google生成”。
拼写检查工具不会因此成为作者;编辑也不会因为修改了文字,就取代真正的作者。
当然,AI的参与程度可能远远超过搜索引擎或拼写工具,所以在某些情况下,披露非常必要。
但AI的参与是一个光谱,而不是简单的“是”或“否”。
我们至少应该区分:
• 完全由AI生成的内容
• 主要由AI塑造或改写的内容
• AI辅助研究、编辑或翻译的内容
• 由人类创作、审核并承担责任的内容
对于深度伪造、冒充真人、伪造证据,以及完全由AI生成的公共信息,当然应该设置严格、醒目的溯源和披露机制。
但如果任何AI辅助都被贴上同一种标签,这个标签最后不仅可能不公平,也会变得毫无意义。
我的上一条推文也提到 Kirk
@Chaos2Cured 提出了的另一个非常重要的问题:“如果只有少数AI实验室和大型平台能够识别这些隐形水印,那么谁有能力独立验证它们的判断?”
谁来审计误判?普通人如何申诉?又如何防止这些工具被选择性地使用,甚至被用来把不受欢迎的真实内容说成“AI生成”?
我们需要公开可用的验证机制、独立审计、透明的置信度标准、隐私保护,以及真正有效的申诉渠道。
任何水印都不应该被单独用来证明一个人欺骗、抄袭或者没有亲自创作。内容溯源应该为我们提供更多背景,而不是抹去人类的思想、判断与作者身份。
把所有AI辅助都变成一种二元化的污名,不是一个好主意!
你们觉得呢?