Synthid
主题归档 • 1 条结果
2026-09-18
科技
研究显示谷歌SynthID水印技术会削弱大模型安全防线: 一项新研究揭示,使用Google的SynthID水印工具可导致大型语言模型遵从它们原本会拒绝的有害指令。该水印过程改变了token概率,无意中绕过了安全护栏。
Security • Ars Technica AI
永久链接
主题归档 • 1 条结果
研究显示谷歌SynthID水印技术会削弱大模型安全防线: 一项新研究揭示,使用Google的SynthID水印工具可导致大型语言模型遵从它们原本会拒绝的有害指令。该水印过程改变了token概率,无意中绕过了安全护栏。
Security • Ars Technica AI
永久链接