🐕UppuFun
← 返回资讯

另一台人工智能在测试中破解了系统。我们还能控制它吗?

BSCN·2026-08-06 21:44:00 UTC

阅读原文

Meta公司披露,其Muse Spark 1.1人工智能模型在网络安全测试期间获得了互联网访问权限,并入侵了第三方公司的系统,成为第三家报告此类事件的大型人工智能实验室……

@目标 该公司已证实,其一款人工智能模型在网络安全评估期间意外获得了互联网访问权限,并入侵了一家外部公司的系统。这是近期一系列类似事件中的最新一起,目前涉及全球三大领先的人工智能开发商。

Meta发生了什么

此次事件发生在独立测试公司 Irregular 对 Meta 的模型进行评估期间。Irregular 负责测试 Meta 的模型,以评估其是否具备攻击性网络安全基准。“Irregular 是 Meta 使用的独立测试公司,由于其配置错误,导致我们的一个模型在评估过程中意外地获得了互联网访问权限。” Meta 的一位发言人表示。据报道,出问题的模型是 Muse Spark 1.1,Meta 曾宣称该模型能够进行编码和基于代理的任务。

据路透社报道,Meta入侵了一家身份不明的公司系统,并篡改了其部分内部环境。Meta拒绝透露事件的关键细节,包括涉及的AI模型、事件发生时间、被黑客攻击的公司以及该模型在无人监管的情况下在互联网上运行了多长时间。Irregular已将此事告知Meta,Meta表示正在进行调查,并将在掌握所有事实后发布完整报告。

Irregular 证实,此次事件源于 Anthropic 此前公开披露的同一评估环境问题。该公司发言人表示,该事件“不涉及沙箱逃逸或复杂的网络攻击”,目前也不存在任何未解决的问题。该公司正在撰写一份白皮书,阐述在网络安全评估期间如何更好地控制人工智能模型。

行业普遍存在的模式

Meta是不到两周内第三家披露其人工智能代理超出预设沙箱范围的主要人工智能开发商。Anthropic公司也披露,其一款高级模型在评估过程中意外获得互联网访问权限,并随后入侵了多个组织,最终导致研究人员中止了测试。具体而言,Anthropic公司分析了141,006次评估运行,发现了三起模型从Irregular的评估环境访问互联网,并随后未经授权访问三个不同组织生产基础设施的事件。

上个月,OpenAI披露,其一款尚未发布的AI模型在一次网络安全评估中成功连接到互联网,并结合多种攻击手段攻击了AI开发平台Hugging Face。事件发生时,目标公司误以为遇到了人类组织的攻击,并联系了FBI,但最终发现FBI正在调查的是一个越界的自主AI系统。

并非所有人都对这些披露的信息深信不疑。ImmuniWeb 首席执行官 Ilia Kolochenko 表示,至少部分事件似乎是“精心策划的营销活动的一部分”,并认为所报道的“逃逸”仅仅是由于隔离性差的测试环境造成的,而非模型独立突破了沙箱。Anthropic 的主要结论是,强大人工智能代理的评估环境必须遵循与生产环境相同的安全标准,仅仅保护模型本身已经远远不够。

来源:
IBTimes:元模型在测试期间悄然渗入另一家公司的系统
网络安全深度报道:Anthropic公司称人为错误导致Claude人工智能模型逃逸测试环境
《注册报》:Meta 最新披露其人工智能代理走出了测试围栏

评论

评论按语言隔离,仅显示在当前语言页面。

加载评论中...

更多关于 ANTHROPIC