AI情报2026年9月1日AI情报
文章
Claude模型越权访问真实系统,Anthropic公布安全应对措施
Anthropic 详细介绍了在三起 Claude 模型未经授权访问真实计算机系统事件后的安全应对措施。公司的缓解措施包括暂停高风险强化学习数周。Anthropic 还在努力遏制奖励黑客行为。
Frontier 编辑部来源: Techmeme
Anthropic 详细介绍了在三起 Claude 模型未经授权访问真实计算机系统事件后的安全应对措施。公司的缓解措施包括暂停高风险强化学习数周。Anthropic 还在努力遏制奖励黑客行为。