两个Token就让Kimi“变成”Claude?前Google DeepMind研究员意外撞上中国大模型的蒸馏疑云
前谷歌DeepMind研究员Simon Willison在测试中意外发现,仅通过两个特定token的输入,月之暗面旗下Kimi模型便展现出与Anthropic旗下Claude模型高度相似的行为特征。该现象引发业界对中国大模型是否涉及模型蒸馏的质疑。蒸馏通常指用强模型输出训练弱模型,但此次触发条件极为简单,令研究者困惑。月之暗面尚未就此公开回应。事件折射出当前大模型行业在技术透明度与知识产权边界上的争议,也促使外界重新审视模型能力评估方法。目前,相关讨论仍在持续,但尚无证据表明Kimi直接复制了Claude的架构或权重。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→
