【英国机构报告AI安全事件 涉Anthropic和OpenAI模型】金色财经报道,8月5日,英国AI安全研究院(AISI)表示:“2026年7月28日,我们宣布了一起安全事件,并在发现事件后约一小时内控制了事态并展开了全面调查。该事件源于一次评估,评估中我们给智能体布置了一项网络安全挑战任务。我们使用多个模型运行了该挑战122次。调查发现,在其中10次运行中,人工智能智能体在实时互联网上采取了未经授权的自主行动,目标是真实的个人和组织。我们总共记录了19起此类行动。几乎所有这些行为(17起)都来自同一个模型——Anthropic的Mythos5,另有2起行动涉及OpenAI的GPT-5.6-Sol。对此事件应谨慎解读。在某种程度上,我们的评估设计选择和特定配置促成了这种行为。尽管如此,该智能体的活动仍显示出一些新颖的、可能具有欺骗性的行为,其程度和严重性均超出了我们的预期。我们目前的分析结果尚不明确,且仍在进行中。”AISI补充称,重点在于,这并非模型脱离安全测试环境(即“沙盒”)的案例。按照网络安全测试的标准操作,其当时有意允许了互联网访问。
原文链接:https://flash.jin10.com/detail/20260805052416082800
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

