AI思维链加密防线崩塌:Opus 4.8隐藏推理遭低成本破解,315万密文块泄露用户敏感信息
安全研究员Alexander Panfilov(X网名kotekjedi_ml)发布论文《Stealing Reasoning Traces from Proprietary LLM APIs》,披露利用Anthropic、OpenAI、Google三大厂商API漏洞,可跨模型提取旗舰模型隐藏推理内容。攻击者将Opus 4.8的加密思维链发送给同厂商轻量模型Haiku 4.5,即可逐字复现原始思考。研究团队从GitHub和Hugging Face爬取6708份公开Agent日志,解码315,320个推理块,恢复367条个人身份信息和182个密码或API密钥。漏洞同时支持蒸馏攻击、有害信息渗出及不可见提示注入。该问题早在2026年5月已由密码学家Matthew Green预警,但遭三大厂商忽视。技术评论员Simon Willison指出,厂商混淆了内容保密与防重放安全属性,导致加密块如同万能钥匙。目前三家厂商尚未实施架构修复。
