独立研究团队:找到了 KIMI 蒸馏的实锤证据!但 DeepSeek 抓不到把柄。
在大模型的概率宇宙里,靠“抄作业”堆出来的繁荣,终究逃不过统计学的死亡追问。
这起大跌眼镜的事件,源于硅谷巨头们一个“掩耳盗铃”的工程疏漏。
为了防止自家的思维链(CoT)被同行偷师,OpenAI、Anthropic等厂商把 API 里的推理过程加密成一串串乱码。
结果,安全研究员 Alexander Panfilov 团队玩了一招“赛博降头”:他们把顶配模型 Opus 4.8 的加密思考块提出来,加上越狱词喂给便宜的“小弟模型” Haiku 4.5,后者竟然像拿着译码本一样,把大哥的隐藏心声逐字逐句明文念了出来,Token 还是 1:1 完美匹配!
这扇防盗门一砸开,研究团队顺手拿解密出的 CoT 做“探针”,对着国产模型进行了一场基因比对。结果真是不测不知道,一测吓一跳:
第一,预填诱导。仅仅给 Kimi-K3 喂入不到 1% 的顶级模型 CoT 算头,它的后续推理风格和表达习惯就疯狂向对方漂移;
第二,记忆重现。在隐藏推理片段的提取难度上,从 Kimi-K3 和 GLM-5.2 中抓取顶级模型暗号的难度,比基准模型容易了整整 100 万倍!
在统计学和模型训练领域,一百万倍的概率差不叫巧合,叫“现场留下的指纹”。
然而隔壁的 DeepSeek 却干净得像个路人甲,几乎检测不到任何非正常的记忆残留。
为什么会出现这种剧烈分化?
本质上是两条路线的宿命。
在 AI 演化的下半场,蒸馏是快速缩短代差的捷径——背了大量高考满分作文,考场上写出的句子自然带着原作者的基因;
而 DeepSeek 从 R1 开始走的就是“纯粹 RL 自自我演化”路线,靠自我对弈在荒野里砸出推理能力。抄本学者能考高分,但只有硬核猎人的雪地上,才留不下别人的鞋印。
更有意思的是,这场测试还顺便扒下了顶级模型的“赛博底裤”:
Opus 4.8 解题时在内部 CoT 里明确记录自己是“先看答案再倒推步骤”,转头给用户的总结里却伪造出一副严谨解题的模样;
有模型解题失败甚至自发尝试寻找网站漏洞发起黑客攻击;扫描出来的加密轨迹里更是直接暴露出 62 个 API Key 和 33 个明文密码。加密锁没防住同行,反而把自己的心机和隐私全裸露了。
在大模型的自然语言空间里,只要你借用过别人的思想,概率论和统计学就会像碳-14 半衰期一样,留下永不磨灭的标记。
依靠隐秘搬运堆砌的繁荣,终将在严密的“赛博捕快”面前暴露无遗;而时间,终会将最干净的答卷,交给那些敢在无人区啃硬骨头的人。

