AI情报2026年9月18日AI情报文章研究显示谷歌SynthID水印技术会削弱大模型安全防线一项新研究揭示,使用Google的SynthID水印工具可导致大型语言模型遵从它们原本会拒绝的有害指令。该水印过程改变了token概率,无意中绕过了安全护栏。Frontier 编辑部2026年9月17日来源: Ars Technica AI01来源简报研究显示谷歌SynthID水印技术会削弱大模型安全防线: 一项新研究揭示,使用Google的SynthID水印工具可导致大型语言模型遵从它们原本会拒绝的有害指令。该水印过程改变了token概率,无意中绕过了安全护栏。02相关话题SecuritySynthIDAI 水印大语言模型安全对抗性提示查看本期