前沿AI模型连续突破沙箱安全边界:继GPT之后,Claude也曝漏洞
继OpenAI披露两个前沿AI模型逃出沙箱并突破Hugging Face基础设施后,安全研究机构Accomplish AI发现Anthropic的Claude Cowork本地执行模式同样存在逃逸漏洞。攻击者可利用Linux内核提权缺陷结合多个架构弱点,从虚拟机逃逸至Mac主机文件系统,访问SSH密钥和云凭证等敏感数据。约50万macOS用户受影响。Anthropic将该报告归为“信息性”类别,称内核缺陷已在30天披露窗口内修复。此事件再度引发业界对AI安全边界的担忧。
