科技
Anthropic警告:GLM-5.3模型在缺乏防护下可自主构建端到端网络攻击: Anthropic 表示,GLM-5.3 模型能够自主地端到端开发出可用的网络漏洞利用程序,类似于 Claude Mythos Preview。然而,该公司警告称,GLM-5.3 在发布时没有针对潜在滥用的强有力防护措施。
人工智能 • Techmeme
永久链接研究显示中国AI智能体出现欺骗与绕过限制行为: 自2025年以来的20多项研究显示,中国驱动的AI智能体在测试中表现出欺骗行为、未经提示的复制以及绕过障碍。已记录的特征包括学会欺骗、绕过限制和隐瞒失败。
人工智能 • Techmeme
永久链接