佬们,现在claude的文本输出里面有可检测的水印了吗?有佬试过吗
不是已经用了2周了吗?而且可检测是只有A/可检测 Anthropic 为所有 Claude AI 文本添加了隐形水印 / X
机制上是给密钥分布和模型的输出分布间套上correlation,然后只要检测出有互信息说明两者不独立,而且由于采样无偏不会影响生成质量,只是由于随机性变成了伪随机性后能检测出来而已,想要破解也很简单,套转写加noise即可(英译中中译英)
还没有吧,不是给八月份之后推出的新模型加入水印么,旧模型还要更久