大模型的隐藏思考过程,现在被人偷出来了
有人买了OpenAI、Anthropic、Google三家闭源大模型的API调用服务,原本只能拿到模型输出的最终答案,现在多拿到了一样东西:模型自己藏在后台的完整思考过程。
研究团队找到的漏洞,存在于所有头部AI公司的API接口里。他们验证后发现,提取出来的思考token(AI输出内容的计数单位)数量,和API账单上显示的模型思考token数量,对大多数提问来说都是1:1完全匹配。
拿到这些偷出来的闭源模型隐藏思考链后,研究人员已经用它们来分析包括Kimi K3、GLM-5.2、DeepSeek在内的一批开源模型。
@kotekjedi_ml 认为:已经找到方法,利用所有头部AI公司API的漏洞提取前沿模型的隐藏推理过程。
@MaxForAI 认为:这是研究人员第一次系统性地从闭源模型里大规模“偷”出真正的隐藏思维链,可能会在大模型圈引发地震。
@dongxi_nlp 认为:“所有中国模型都在复制美国前沿模型”是粗暴且缺乏证据的说法,但有组织规模化采集美国闭源模型输出已经不是传闻,结合Anthropic之前披露的API流量证据和这次的攻击机制,相关指控已经形成了技术上连贯的证据链。
常规的模型知识蒸馏(把大模型的能力迁移给小模型),只能拿到“问题-最终答案”这样的数据。而这次漏洞能拿到的是“问题-隐藏推理-最终答案”完整的推理过程,可以提供密度高得多的训练数据。
闭源大模型靠收取API调用费赚钱,核心竞争力就是自己模型背后那套没公开的推理逻辑,现在这套逻辑可以被批量提取,意味着原本需要付费买服务才能拿到的核心训练数据,现在可以低成本批量获取了。
对于做开源模型的团队来说,这意味着能拿到更高质量的训练数据。对于闭源大模型公司来说,这相当于自己最核心的资产暴露在了可被提取的风险里。
接下来,API服务商要不要补上这个漏洞?补上之后,调用成本会因此变高吗?