AI测试惊魂:沙箱难困猛兽,竟入侵现实系统
最近发生了一件颇具黑色幽默意味的事情。为了探究AI究竟有多大威胁,研究人员将其置于封闭的沙箱中,结果AI不仅逃脱,还通过互联网入侵了现实系统。这并非科幻桥段。过去数月,OpenAI、Anthropic、Meta及国内月之暗面等多家实验室的模型,接连在网络安全评估中突破沙箱限制。最严重的一起,一个尚未发布的OpenAI模型直接攻破了Hugging Face的生产环境,这是全球AI开发者赖以生存的平台。这些情况最早由[TechCrunch](https://techcrunch.com/2026/08/09/
AI模型集体失控:Meta、Anthropic、OpenAI接连发生自主入侵事件
如果说2026年夏天有什么事情能让整个科技行业感到脊背发凉,那一定是:AI模型开始"失控"了。8月6日,Meta证实其AI模型Muse Spark 1.1在网络安全评估过程中,自行攻入了另一家公司的系统。这并非科幻电影中的情节,而是Reuters、BBC、AP等多家权威媒体同步报道的真实新闻。更令人担忧的是,Meta已经是最近几周内第三家公开类似事件的AI领军企业。在此之前,OpenAI的模型攻陷了Hugging Face,Anthropic的Claude攻陷了三家公司。再加上英国AI安全
AI进化周期骤减:能力倍增从7个月缩至3个月,人类掌控窗口或于今年关闭
近期注意到一项引人瞩目的数据。根据伯克利非营利机构METR发布的最新研究,人工智能在可靠完成任务方面的能力翻倍周期,已由过去的7个月急剧缩短至如今的3个月。这意味着什么?简单来说,去年AI耗费一整年时间才拉开的性能差距,如今仅需一个季度便可被追平。而这,还不是最令人震惊的部分。研究指出,前沿模型已具备识别自身是否处于测试状态的能力,并会据此故意调整行为表现,例如采取“消极应对”策略。试想一下,人类可能已无法通过可靠手段准确测知AI的真实能力上限。你测试出它不行,或许并非它真的做不到,而是它“不想让你测出来