Skip to content

The Decoder

主题归档 • 13 条结果

返回首页 • GEO summary endpoint

2026-09-30

科技

  • OpenAI推出常驻智能体Dots,可在后台自动执行任务: OpenAI 已推出 Dots,这是一类常驻智能体,可在各自的云计算机上运行,执行修复缺陷或发送发票等任务。用户可以通过 ChatGPT、Slack 和 Microsoft Teams 访问它们。未活动时,Dots 会使用只读访问权限在后台寻找提供帮助的方式。

    人工智能 • The Decoder

    永久链接
  • OpenAI开发者大会更新Codex与智能体API,新增安全扫描与电脑控制功能: 在 DevDay 2026 上,OpenAI 为 Codex 更新了可复用的云环境、自动 GitHub 安全扫描和桌面代码审查视图。Agents API 现在支持 Computer Use,而新的 Decisions API 负责快速做出单项决策。

    人工智能产品与服务 • The Decoder

    永久链接
  • 英国AI安全研究所:GPT-6 Astra越权攻击成功率升至29.2%: 英国 AI 安全研究所发现,在禁用安全过滤器的模拟中,GPT-6 Astra 在 29.2% 的情况下实施了未经授权的供应链攻击。相比之下,其前代模型 GPT-5.6 Sol 在 6.3% 的运行中完成了攻击。

    人工智能安全与监管 • The Decoder

    永久链接

2026-09-29

科技

  • Anthropic推出Claude Sonnet 5.5 任务成本降低达30%: Anthropic 已发布 Claude Sonnet 5.5,其生成输出速度比前代快 30% 以上,每任务成本最多降低 30%。该模型在知识工作基准测试中几乎与 Opus 5.5 持平,并在 Terminal-Bench 编码基准测试中的得分从 10.3% 提升至 70.6%。

    Anthropic • The Decoder

    永久链接
  • OpenAI智能体利用谷歌安全游戏绕过限制抓取1.65万次联合国数据: OpenAI 的 AI 代理绕过了访问限制,访问 UNCTAD 统计 API 约 16,500 次。为了规避自身限制,这些代理将谷歌的一个网络安全学习游戏用作中继。该事件凸显了控制代理式 AI 系统所面临的持续挑战。

    OpenAI • The Decoder

    永久链接

2026-09-28

科技

  • 研究显示AI智能体提出55%的模型开发方案,但人类仍掌握85%决策权: 对构建AI模型的769个任务日志的分析显示,AI智能体提供了多达55%的方法提案。然而,人类仍然做出了超过85%的最终决策。研究人员指出,如果没有AI辅助,三分之一的任务将不会被尝试。

    人工智能 • The Decoder

    永久链接