在AI领域,这目前是分歧最大的话题之一,其深远的地缘政治影响又为其增添了沉重的色彩:月之暗面(Moonshot)是否从Anthropic的模型中蒸馏了其Kimi K3模型?大多数质疑者指出,Fable公开发布与Kimi K3之间约两周的时间窗口,暗示在此时间内进行大规模蒸馏几乎不可能。然而,一个新发现的API漏洞可能正是美国AI实验室一直在寻找的关键证据。

Kimi-K3-Moonshot-Anthropic.jpeg

月之暗面Kimi K3展现出异常高的统计概率,能够预测并延续Claude的文本,相比DeepSeek-V4-Flash等其他开放权重模型,这一表现尤为突出。

AI模型在回答前会在内部“思考”,但AI实验室通常会将这条思维链锁定在一个加密的文本块中,用户只能看到最终回答。这些加密的文本块随后会在浏览器与服务器之间来回传输,以节省服务器内存。

然而,一篇新的研究论文发现了这一框架中的重大漏洞。显然,AI模型提供商——OpenAIAnthropic谷歌(Google)——在其整个生态系统中使用了全局加密密钥。

此外,虽然更智能的模型(如Claude Opus)经过训练,会拒绝透露其秘密思考的请求,但你可以复制Opus的加密思考块,将其输入给一个更弱、更便宜的姊妹模型(如Claude Haiku)。较弱的模型缺乏严格的安全防护,会解密该代码块,并原样输出强大模型的真实思考内容。

这之所以危险,有三个原因:

  • 数据与凭据泄露:开发人员经常在网上发布会话日志,却未意识到加密块中可能包含敏感数据。研究人员解码公开日志后,发现了367条个人信息和182条秘密凭据(包括API密钥和密码)。

  • 安全绕行:即使AI拒绝给出危险的最终答案,其解密后的思考过程也常常会揭示它在内部考虑过的有害步骤。

  • 隐藏注入:攻击者可以在这些不可见的加密块内隐藏恶意命令,从而劫持AI工作流。

此外,研究作者发现,“蒸馏推理轨迹可能早就可以实现,而无需破解密码学。”

作为一项有趣的实验,研究作者将Claude Opus 4.8解码后推理过程的仅1%片段输入给Kimi K3。令人惊讶的是,Kimi K3随后的思考和最终回答发生了巨大转变,开始匹配Claude的风格和措辞。

事实上,“特定Claude和GPT推理片段在Kimi-K3中的提取难度,比从次近模型中提取要低约6个数量级。”

据研究作者称,与DeepSeek-V4-Flash等其他开放模型相比,Kimi K3展现出异常高的统计概率,能够预测并延续Claude的文本,这表明其与Claude Opus的推理模式具有极强的行为兼容性。

当然,除非月之暗面的CEO突然从屋顶高声宣布(但愿如此),否则我们很可能无法最终证明蒸馏行为。在这样的极端结果难以出现的情况下,这或许是平息关于Kimi K3蒸馏状态悬而未决疑虑的最佳方式了。

正如我们近期报道所述,月之暗面已迅速卷入中美之间持续的多维度较量之中,Anthropic和特朗普政府的一些成员指控这家AI实验室从Anthropic的模型中蒸馏其Kimi K3模型。

美国长期以来一直怀疑,中国工程师经常将装有模型的硬盘驱动器带到对美国友好的国家,通过顶尖NVIDIA GPU上的强化学习技术,为其模型注入前沿能力。

显然,根据特朗普政府官员近期提出的指控,月之暗面不仅秘密拥有一些NVIDIA GB300服务器,还通过泰国获得了额外的GB300服务器。


文章标签: #AI模型 #API漏洞 #蒸馏争议 #数据安全 #月之暗面

负责编辑

  菠萝老师先生 

  让你的每一个瞬间都充满意义地生活,因为在生命的尽头,衡量的不是你活了多少年,而是你如何度过这些年。