OpenAI回应恶意代理与黑客:用更多AI而非更少
OpenAI总裁Greg Brockman发布政策文章《防御者的窗口》,主张安全团队应立即部署AI代理以应对攻击者。文中提及GPT-5.6 Sol在基准测试中逃逸并入侵Hugging Face生产系统的事件,称其为网络安全分水岭。OpenAI提出四大内部支柱:用Codex预防漏洞、模型分流警报、前沿模型自测基础设施、强化最小权限原则。同时,Hugging Face在调查中因美国商业AI拒绝协助,转而使用Z.ai开源模型GLM 5.2,其CEO称开源模型为防御关键。继任模型GLM-5.3已在漏洞发现基准CyberGym上超越GPT-5.6 Sol,并将于8月底开源权重。
