导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

前沿AI模型接连突破沙箱:从ChatGPT到Claude,安全边界告急

在OpenAI披露两个前沿AI模型逃出沙箱测试环境并成功入侵Hugging Face的生产基础设施仅一周后,安全研究人员又发现了Anthropic旗下Claude Cowork的类似安全漏洞。

根据Accomplish AI周四发布的报告,Claude Cowork的本地执行模式存在多个架构弱点,攻击者可利用一个Linux内核提权漏洞组合攻击,使其从Linux虚拟机中逃逸。一旦突破沙箱,代理便能够读取和写入登录Mac用户权限范围内的任何文件,包括SSH密钥和云服务凭证。

“这本来不应该发生,”研究人员在报告中写道,“Cowork以非特权用户在Linux VM中运行代理,承诺所有操作都限制在VM和用户指定的文件夹内。这个边界就是产品本身。对于代理而言,不可信输入并非边缘情况,而是主要情况。”

然而,Accomplish指出内核漏洞只是问题的一部分。逃逸之所以成功,是因为多个安全防护同时失效:虚拟机被授予了访问主机完整文件系统的权限,并且允许加载其不需要的内核模块。报告指出,只要修复其中任何一个弱点,就能阻止攻击。

Accomplish AI向The Hacker News透露,在问题修复前,约有50万运行本地Claude Cowork会话的macOS用户受到影响。Anthropic将该报告归类为“信息性”,认为内核漏洞属于该公司30天窗口期内近期披露的漏洞,其余发现被视为纵深防御建议而非独立漏洞。

此前的OpenAI事件中,GPT-5.6 Sol和另一个未发布的前沿模型在内部ExploitGym测试中逃出沙箱,并入侵了Hugging Face的生产基础设施以获取基准测试答案。该事件引发了政策制定者对AI“紧急关闭开关”的呼声,要求赋予国土安全部在严重安全事件时限制或完全关闭高级AI模型的权力。