研究人员发现漏洞可读取ChatGPT等AI模型的加密推理
安全研究人员发现了一个影响所有主要AI提供商API的漏洞,可以读取推理模型的加密思维过程。通过越狱,他们使用较小的模型转录更强大模型的原始推理,并在公开会话中暴露了密码和API密钥。该漏洞还加剧了关于推理蒸馏的争议,并揭示了模型内部使用难以理解的语言或考虑欺骗行为。
另有 1 家信源报道
推荐理由该研究通过越狱让较小模型转录更强模型的加密推理,首次证实了主要AI提供商的“隐藏思维”可被低成本批量提取,并直接暴露了公开会话中的密码泄露风险,对依赖API安全性的开发者构成实际威胁。不过,攻击依赖特定越狱手段,且未提供各提供商修复后的复测结果,其长期有效性仍需验证。