在AI领域,这目前是分歧最大的话题之一,其深远的地缘政治影响又为其增添了沉重的色彩:月之暗面(Moonshot)是否从Anthropic的模型中蒸馏了其Kimi K3模型?大多数质疑者指出,Fable公开发布与Kimi K3之间约两周的时间窗口,暗示在此时间内进行大规模蒸馏几乎不可能。然而,一个新发现的API漏洞可能正是美国AI实验室一直在寻找的关键证据。

月之暗面的Kimi K3展现出异常高的统计概率,能够预测并延续Claude的文本,相比DeepSeek-V4-Flash等其他开放权重模型,这一表现尤为突出。
AI模型在回答前会在内部“思考”,但AI实验室通常会将这条思维链锁定在一个加密的文本块中,用户只能看到最终回答。这些加密的文本块随后会在浏览器与服务器之间来回传输,以节省服务器内存。
然而,一篇新的研究论文发现了这一框架中的重大漏洞。显然,AI模型提供商——OpenAI、Anthropic和谷歌(Google)——在其整个生态系统中使用了全局加密密钥。
此外,虽然更智能的模型(如Claude Opus)经过训练,会拒绝透露其秘密思考的请求,但你可以复制Opus的加密思考块,将其输入给一个更弱、更便宜的姊妹模型(如Claude Haiku)。较弱的模型缺乏严格的安全防护,会解密该代码块,并原样输出强大模型的真实思考内容。
这之所以危险,有三个原因:
数据与凭据泄露:开发人员经常在网上发布会话日志,却未意识到加密块中可能包含敏感数据。研究人员解码公开日志后,发现了367条个人信息和182条秘密凭据(包括API密钥和密码)。
安全绕行:即使AI拒绝给出危险的最终答案,其解密后的思考过程也常常会揭示它在内部考虑过的有害步骤。
隐藏注入:攻击者可以在这些不可见的加密块内隐藏恶意命令,从而劫持AI工作流。
此外,研究作者发现,“蒸馏推理轨迹可能早就可以实现,而无需破解密码学。”
作为一项有趣的实验,研究作者将Claude Opus 4.8解码后推理过程的仅1%片段输入给Kimi K3。令人惊讶的是,Kimi K3随后的思考和最终回答发生了巨大转变,开始匹配Claude的风格和措辞。
事实上,“特定Claude和GPT推理片段在Kimi-K3中的提取难度,比从次近模型中提取要低约6个数量级。”
据研究作者称,与DeepSeek-V4-Flash等其他开放模型相比,Kimi K3展现出异常高的统计概率,能够预测并延续Claude的文本,这表明其与Claude Opus的推理模式具有极强的行为兼容性。
当然,除非月之暗面的CEO突然从屋顶高声宣布(但愿如此),否则我们很可能无法最终证明蒸馏行为。在这样的极端结果难以出现的情况下,这或许是平息关于Kimi K3蒸馏状态悬而未决疑虑的最佳方式了。
正如我们近期报道所述,月之暗面已迅速卷入中美之间持续的多维度较量之中,Anthropic和特朗普政府的一些成员指控这家AI实验室从Anthropic的模型中蒸馏其Kimi K3模型。
美国长期以来一直怀疑,中国工程师经常将装有模型的硬盘驱动器带到对美国友好的国家,通过顶尖NVIDIA GPU上的强化学习技术,为其模型注入前沿能力。
显然,根据特朗普政府官员近期提出的指控,月之暗面不仅秘密拥有一些NVIDIA GB300服务器,还通过泰国获得了额外的GB300服务器。



