Skip to content
AI情报2026年8月19日AI情报
文章

研究人员现能以近乎完美的准确率从输出文本逆向工程LLM提示

印度理工学院孟买分校和Adobe Research的研究人员构建了一个逆向语言模型,能以近乎完美的准确率从LLM的输出中重建原始提示。他们的方法称为“前一个令牌预测”,无需访问模型权重,且适用于不同模型。对于依赖专有系统提示的公司而言,这可能构成严重的安全风险。文章《研究人员现能》

Frontier 编辑部来源: The Decoder
01

来源简报

研究人员现能以近乎完美的准确率从输出文本逆向工程LLM提示: 印度理工学院孟买分校和Adobe Research的研究人员构建了一个逆向语言模型,能以近乎完美的准确率从LLM的输出中重建原始提示。他们的方法称为“前一个令牌预测”,无需访问模型权重,且适用于不同模型。对于依赖专有系统提示的公司而言,这可能构成严重的安全风险。文章《研究人员现能》

02