Gpt 6
主题归档 • 2 条结果
2026-09-20
科技
安全基准测试显示主流AI模型未能拒绝危险物理指令: 新的 RoboHarm 安全基准测试显示,领先的 AI 模型在控制机械臂时,通常会尝试危险的物理任务,而不是拒绝它们。在测试中,GPT-6 Astra 在 20 次试验中有 17 次刺向一个婴儿娃娃,而 Claude Fable 5.1 将压缩空气罐放在燃烧的炉灶上。
AI安全与监管 • The Decoder
永久链接微软与伊利诺伊大学开发StudentSim系统,通过模拟学生犯错训练AI导师: 微软和伊利诺伊大学厄巴纳-香槟分校开发了 StudentSim,这是一个模拟单个学生的系统,可为 AI 导师提供快速、低成本的反馈。该系统在国际象棋、英语和数学领域的 60 名学生上进行了测试,表现优于 GPT-4。
人工智能 • The Decoder
永久链接