导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

OpenAI称与Moonshot有关人员试图大规模提取隐藏AI推理,AI蒸馏争端升级

导语:OpenAI表示,已关闭一项协调性行动,该行动试图大规模复制其AI模型的“思考”过程,并称已将核心活动集群追溯到与Moonshot AI有关联的人员。Moonshot AI是中国初创公司,开发了Kimi聊天机器人。

事件规模与时间线

根据OpenAI说法,相关活动始于7月1日。仅在7月24日和25日,OpenAI就记录到来自4000多名用户的16000次提取请求,这些用户属于一个规模超过15000人的更大集群。OpenAI称,到7月28日,已完全破坏该活动。

目标不是答案,而是推理

OpenAI指出,攻击目标不是模型给出的答案,而是答案背后的工作过程。现代AI模型在回复前会先“推理”,在内部草稿区逐步处理问题,然后输出干净结果。OpenAI将该草稿区加密,并表示提取它可能泄露最终答案未包含的信息。

OpenAI强调:“操作者没有破解我们的加密、入侵数据库,也没有直接访问存储的用户对话。相反,他们通过协调、规模化的方式操纵模型交互,使受保护的推理以请求者可见的形式被复现,违反我们的服务条款。”

OpenAI称,一种方法是将加密推理从一个对话中复制出来,再要求模型在另一个对话中解码。

与Moonshot的关联及OpenAI回应

OpenAI的帖子没有将此活动与K3直接关联,但留下了疑问。OpenAI表示:“尚不清楚相关时间段内观察到的所有操作者是否来自单一行为者。不过,我们将核心活动集群归因于与Moonshot AI有关的个人,Moonshot AI是Kimi的开发商。”

OpenAI还称,已关闭一条路径,该路径允许已经拥有另一用户加密推理的人重放并恢复其内容。

为什么隐藏推理成为目标

隐藏推理之所以被觊觎,是因为蒸馏——用更强AI的输出训练新AI——可以在不进行大量训练的情况下改进较小模型。未经授权的蒸馏被OpenAI称为“对抗性蒸馏”,即“系统性、未经授权地使用一个模型的输出或推理,以帮助训练、复制或改进另一个模型”。

AI行业争议背景

该争端是AI公司一系列丑闻中的最新一起。最明显且常见的问题,是未经授权或非法使用受版权保护数据训练模型。蒸馏则不同。AI输出不受版权保护,因此公司会在服务条款中写入禁令和保障措施,防止竞争对手使用这些输出。

OpenAI此前已有类似经历。2025年1月,OpenAI称正在审查DeepSeek可能蒸馏其模型的迹象,当时华盛顿正评估国家安全风险。2月,Anthropic指控中国实验室使用约24000个欺诈账户,与Claude生成超过1600万次交互。网络批评者则反击称,Claude本身是在开放互联网上训练的。

到4月,白宫称外国实体,主要在中国,正在进行工业规模蒸馏活动。一周后,马斯克在法庭上承认,xAI曾使用蒸馏方法在OpenAI模型上训练Grok。6月,Anthropic向国会请求对大规模模型提取实施处罚。8月,研究人员显示,OpenAI、Anthropic和Google各自用单一提供商范围加密密钥保护推理,攻击者可诱导模型以明文输出隐藏想法。三家公司披露后部署了服务器端补丁,但早前共享的会话日志仍可解码。

Moonshot动态

Moonshot尚未回应OpenAI的帖子。该公司正寻求在香港进行30亿美元IPO,目标估值500亿美元。

Myriad: Which company IPOs next? Click to make your prediction.