研究团队披露大模型推理块泄露漏洞:可借小模型还原隐藏思维链
一支来自 MATS Research、图宾根大学和马克斯·普朗克智能系统研究所等机构的团队在论文《Stealing Reasoning Traces from Proprietary LLM APIs》中称,Anthropic、OpenAI 和 Google 的模型家族曾存在可被同厂小模型复述加密推理块的问题。研究称,团队从 6708 条公开 Agent 轨迹中恢复出 315320 段隐藏推理,并识别出 API Key、密码、访问 Token、私钥等敏感信息。论文还估算,按当时 Haiku 4.5 的 API 定价,解码 1 万条推理轨迹的名义成本约为 720 美元。研究人员表示,相关厂商在收到披露后已采取措施,论文发布时原方法已无法复现。








