安全研究员曝三大AI厂商推理链加密机制被攻破,核心逻辑遭批量窃取
2026年8月11日凌晨,安全研究员Alexander Panfilov公开披露,已利用API漏洞成功从Anthropic、OpenAI和Google的专有大模型中提取被加密保护的思维链(Chain of Thought)内容。研究显示,加密块可在同厂商生态内跨会话、跨用户、跨模型复用,攻击者仅需两次API调用即可让轻量模型明文输出旗舰模型的完整推理过程。团队还从公开Agent日志中解码超31.5万个推理块,恢复367条个人身份信息及182个API密钥,并发现安全拒绝层可被绕过、隐形提示注入等四类威胁。此前密码学家Matthew Green曾预警该风险,但三家厂商回应消极,直至论文曝光实证才被迫正视。专家指出,漏洞根源在于混淆内容保密与防重放目标,属典型“安全剧场”行为。
