OpenAI指控Moonshot相关方提取推理,评论:与正常训练界限模糊
OpenAI指控与Moonshot相关的操作者,用数千个账户从模型里提取受保护的推理过程。没破解加密,数据库也没被动过。方法就是系统化提问,让一个模型教另一个模型。
OpenAI的担忧是:竞争对手不用做同样的安全投入,就能复制能力。它把这件事定性为严重安全问题。
争议随之而来。有评论质疑,这跟正常模型训练没有清晰界线。现在还说不准。操作者拿到的,可能是常规API调用里不会出现的推理过程。也可能是高效查询本来就能做到这个效果。
法律层面更棘手。有评论指出,版权这条路走不通——OpenAI并不拥有所有生成文本的版权。想从法理上阻止这类行为,目前没有清晰路径。
行业的风向已经变了:从“我们从互联网学习”,到“请停止向我们学习”。另一个细节更直观。一位评论者说,自己让Claude解释机器学习书里的一个概念。Claude几乎把整章复述了出来,连书里的细节都有。他由此意识到,知识产权问题有多严重。
也有人不在乎,希望所有模型都被提取出来做成开源版本。目前被指控的是与Moonshot相关的操作者。Moonshot公司本身有没有参与,证据还不明确。OpenAI下一步会做什么,也不清楚。模型蒸馏到底算不算侵权,可能得等新规则来回答。