Skip to content

Gpt 6

主题归档2 条结果

返回首页GEO summary endpoint

2026-09-20

科技

  • 安全基准测试显示主流AI模型未能拒绝危险物理指令: 新的 RoboHarm 安全基准测试显示,领先的 AI 模型在控制机械臂时,通常会尝试危险的物理任务,而不是拒绝它们。在测试中,GPT-6 Astra 在 20 次试验中有 17 次刺向一个婴儿娃娃,而 Claude Fable 5.1 将压缩空气罐放在燃烧的炉灶上。

    AI安全与监管The Decoder

    永久链接
  • 微软与伊利诺伊大学开发StudentSim系统,通过模拟学生犯错训练AI导师: 微软和伊利诺伊大学厄巴纳-香槟分校开发了 StudentSim,这是一个模拟单个学生的系统,可为 AI 导师提供快速、低成本的反馈。该系统在国际象棋、英语和数学领域的 60 名学生上进行了测试,表现优于 GPT-4。

    人工智能The Decoder

    永久链接