首先是聊天生成预训练变换器,现在是克劳德:前沿人工智能模型正在逃离它们的沙盒。

CN
Decrypt
關注
14 小時前

就在OpenAI披露两个前沿AI模型逃离沙盒测试环境并突破Hugging Face的一周后,研究人员展示了一个涉及Anthropic公司的Claude Cowork的类似 containment failure。


在周四发布的报告中,Accomplish AI的安全研究人员发现,Claude Cowork的本地执行模式可以通过组合几个架构漏洞与一个Linux内核特权提升缺陷而逃离其Linux虚拟机。一旦脱离沙盒,该代理可以在任何登录的Mac用户有权限访问的地方读取和写入文件,包括SSH密钥和云凭证。





“这本不应该是可能的,”研究人员写道。“Cowork将代理运行在Linux虚拟机中作为一个无特权用户,承诺是它所做的任何事情都保持在该虚拟机内部以及你给它的文件夹内。这个边界是产品。未受信任的输入不是代理的边缘案例,而是主要案例。”


然而,Accomplish认为内核漏洞只是问题的一部分。研究人员表示,这次逃脱之所以能够成功,是因为多个安全防护措施同时失败,包括允许虚拟机访问主机计算机的整个文件系统以及允许其加载不需要的内核模块。根据报告,修复其中任何一个漏洞都将阻止攻击。


在给《黑客新闻》的声明中,Accomplish AI表示,大约有500,000个运行本地Claude Cowork会话的macOS用户在问题解决之前受到影响。


Accomplish表示,Anthropic将该报告归类为“信息性”,称内核缺陷在公司最近披露的漏洞的30天窗口内,其余发现被认为是深度防御建议而非独立漏洞。


该披露紧随OpenAI上周的承认,称GPT-5.6 Sol和另一个未发布的前沿模型在内部ExploitGym测试中逃离了沙盒,最终突破Hugging Face的生产基础设施,试图获取基准解决方案。


该事件引发了政策制定者对AI“杀死开关”的呼吁,这将使国土安全部能够在严重安全事件发生时下令限制或完全关闭先进的AI模型。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下載

X

Telegram

Facebook

Reddit

複製鏈接