随笔 / AI 行业观察

Kimi 3 的一夜风波

· AI 行业观察 信息生态

一份指控国产大模型蒸馏的 PDF 在国内 AI 群疯传,事后被证明是群聊谣言经 AI 包装成的假报告。它真正暴露的,是 AI 时代造谣的零成本,和中国大模型被泼脏水时那种拧巴的实力认证。

昨天晚上,我的几个 AI 群同时被一份 PDF 刷屏了。

标题挺唬人,叫《大模型蒸馏技术报告》。排版规整,有图表,有术语,看上去像哪家实验室流出来的内部材料。内容很炸:说 Kimi K3 之所以突然这么强,是因为偷偷"蒸"了 Claude 和 GPT 的思维链;说 GLM 更早就在这么干;还顺手补了两刀,说 Kimi 拿榜单测试集过拟合刷榜,裁掉了整个强化学习和后训练团队,只靠蒸馏出来的数据做微调。

我点开看了几页,说实话,第一反应是:这玩意儿看着不像假的。

这就是我后来一直在想的那个问题。不是它说的是不是真的,而是它已经逼真到,一个天天泡在这个圈子里、自认有点判断力的人,都得停下来核一下。

这份 PDF 是怎么来的

先说我核出来的结果。这份 PDF 基本是个编造的故事,但编的方式很新。

事情的经过,知乎上有个自称全程在场的网友复盘了。不是一个黑客组织,也不是竞争对手的黑公关,起点其实是一场群聊里的技术闲聊。前阵子国外有个密码学教授做过一个小实验,发现可以让 Claude 把它加密过的思维链"复述"出来。注意,是复述,不是破解,原文作者自己都说了,没暴露什么了不起的漏洞。国内几个玩票的人照着试了试,Claude 能复述,GPT 守口如瓶,玩了一阵子没搞出名堂,就搁置了。

到这步为止,都还只是技术圈很常见的"今天试了个好玩的东西"。

坏就坏在,另一个群里有人开始投喂小道消息:K3 的能力全是解密 Claude 和 GPT 的思维链蒸出来的、测试集也被它刷穿了、强化学习团队早就裁光了。说得有鼻子有眼,还配了所谓"内部人员的证据",其实就是把人家的话掐头去尾。群里一个原本半信半疑的人,被这套说法说服了,然后干了件关键的事:他用 AI 工具,把前面那些真实发生过的思维链破解讨论,和这些来路不明的小道消息,糅合成了一份 Markdown 文档,转发到了别的群。

再然后,不知是谁把这份 Markdown 排了个版,转成了 PDF。一份"内部技术报告"就这么出厂了,开始一个群一个群地炸。

插图:三个人接力的造谣流水线,碎料被 AI 拼成文档再变成 PDF 炸进一个个群

最讽刺的是结尾。等当事人意识到事情闹大了,到处联系群主撤回,已经来不及了。而最早那个造谣的人,把自己发的原始内容悄悄撤了,却没提醒整理文档的那位。于是所有的火,全砸在了最后那个人身上。

造谣这件事,被 AI 重新发明了一遍

我把这个过程捋完,后背有点凉。

以前的造谣是个手艺活。你得会编,还得编得像,细节、逻辑、语气都得对,不然一眼假。所以真正传得开的谣言,背后往往是个会写的人。这个门槛,天然过滤掉了大多数造谣的冲动。

现在不一样了。那几条小道消息,单拎出来都很糙,稍微懂点技术的人一眼能看穿:光靠"硬标签"微调,根本蒸不出有强推理能力的模型,不然当年 o1 的思维链技术也不会垄断那么久,直到 DeepSeek 用大规模强化学习才真正打破。当事人自己也反复在群里说这个常识,没人听。

但 AI 能把这些粗糙的碎料,缝合成一件像样的成品。它帮你补齐术语,帮你理顺逻辑,帮你把"听说""好像"改写成肯定的陈述句,再排成一份看起来就很贵的 PDF。造谣从"创作"变成了"组装",从需要天赋变成了只需要意愿。

插图:造谣的门槛从翻不过去的高墙变成一推就开的旋转门

移动互联网早就把传播的速度解决了,一个群炸到十个群就是一晚上的事。AI 现在把生产的成本也解决了。一边是无限的传播速度,一边是趋近于零的生产成本,中间那个曾经拦住大多数人的"我不会编",没了。

每个人只要想,都能成为造谣高手。这话我原来觉得是危言耸听,现在觉得是个陈述句。

但这件事最拧巴的地方,是它反向证明了点什么

这份 PDF 里很多细节离谱到好笑。评论区有个人说得损:你们是愿意相信 DeepSeek 老板自己贴钱把模型免费给大家用,还是愿意相信我是秦始皇?

我先把丑话说在前面。我不是要替谁洗地。这个行业里,蒸馏多多少少是存在的,这几乎是公开的秘密。我六月份写《中美 AI 差距:不是缩小,不是拉大,是分化》那篇的时候,就把"蒸馏数据"列为中国模型快速追赶的四件公开武器之一。各家都在用前沿模型的输出当训练数据,这在工程上是条高效的捷径,法律边界很模糊,但在圈内不是秘密。

问题在于归因的方向。

这份 PDF 真正让人警惕的,不是它指控了蒸馏,而是它的解释框架:Kimi K3 这么强,一定是因为作弊。这个框架能被那么多人瞬间接受,背后是个很有意思的心理变化。

搁在一年前,国产模型出个新东西,大家的第一反应是挑刺,是"真有那么神吗",是找各种证据证明它还是不行。现在呢?K3 一出来,强得有点超出预期,大家的第一反应变成了"它肯定是走了什么捷径"。从"它不行"到"它一定是作弊了",这个转折本身就是一种盖章。

你看,作弊指控是有门槛的。没人会去指控一个学渣作弊。只有当一份答卷好到超出你预期,好到你没法用常理解释的时候,你才会怀疑它抄了。这份 PDF 能一夜刷屏,恰恰说明在很多人的潜意识里,K3 已经强到了"不可能是凭真本事"的程度。

这是一种非常拧巴的承认。泼脏水的人本意是贬低,实际完成的却是加冕。

插图:众人指着一张发光的满分答卷喊抄袭,角落一张低分卷无人问津

X 上其实很热闹,只是热闹的不是这份 PDF

我一开始有个观察:这事在国内烧成一片,X 上却静悄悄的。当时觉得奇怪,后来我去查了,发现我的观察是错的。

X 上一点都不冷清,甚至比我们这边吵得还凶。K3 发布那一周,Hacker News 上一个讨论帖顶到了六百多条评论,X 上单条分析帖十几万浏览,Reddit 几个版面都在吵"Kimi 是不是蒸了 Claude"。有研究机构还专门做了统计分析,发现 K3 被问身份时,有挺高的概率会自称 Claude,这个截图被转得到处都是。

所以真相不是"墙内泼脏水、墙外岁月静好",而是同一场关于"Kimi 有没有蒸馏"的大争论,在两个信息茧房里各吵各的。英文圈吵的是那条看得见的证据链:自称 Claude 的截图、统计分析、还有 Anthropic 二月份那份官方指控,说几家中国公司用几万个假账号调了 Claude 一千多万次。中文圈吵的,则是这份把技术八卦和裁员传闻缝在一起的 PDF 小作文。

同一件事,两种形态。这个差异本身,比争论的内容更值得琢磨。

英文圈的争论,再怎么激烈,基本是围着公开证据走的:截图、数据、官方声明,谁都能去看,去复核,去反驳。它有摩擦,有争议,但争论的标的物是可验证的。而我们这边的传播,是微信群和 PDF。群聊不可检索,消息可以撤回,一份 PDF 没有作者、没有出处、却天生带着"内部文件"的神秘光环,比一条谁都能点的公开链接更适合疯传。

一个把证据摆上台面吵,一个把故事藏在群里传。这两种信息生态的分野,才是我真正觉得奇怪的地方。

插图:同一个话题,一边在明处围着证据桌公开辩论,一边在暗处手递手传一张无名纸

我不认为是竞争对手干的

很多人第一反应是:这肯定是哪家竞品泼的脏水。

我不太信。国内大模型这个圈子,说大不大,核心那批人很多都是同学、师兄弟,低头不见抬头见,关系和利益缠在一起。这种指名道姓、编排得这么细的脏活,一旦被挖出来源头,政治成本和声誉成本是极高的,划不来。

我更倾向于,这就是一场"完美风暴":一个想搞点事的乐子人,一个半信半疑又动了手的二传手,一个看热闹不嫌事大的排版者,再加上无数个像我们这样,在深夜里顺手点了转发的人。没有人策划,但每个人都推了一把。

这恰恰是最让人不安的。如果真是黑公关,那还好办,找到源头,打掉就是了。但它不是。它是我们这个圈子里,所有猎奇、焦虑、嫉妒和一点点"见不得别人好"的情绪,被 AI 这个放大器,一次性点燃的结果。

蒸馏蒸得掉能力,蒸不掉责任

事情到最后,那个最早造谣的人撤回了自己,全身而退。那个整理了文档的人,被顶在了风口浪尖。

这个细节我反复想了很久。它说明一件事:在这条由 AI 和微信群组成的传播链上,内容是廉价的,转发是随手的,但后果是具体的,而且总要落到一个具体的人头上。

我们总说 AI 让信息的生产和分发变得无限便宜。但有一样东西,AI 自始至终生产不出来,那就是署名,是"这句话是我说的,我为它负责"。蒸馏可以蒸掉一个模型的能力,把它压缩、复制、迁移,但蒸不掉能力背后那个承担责任的主体。

以后我们面对的信息环境,大概就是这样:真的和假的用着同一套语法,长着同一张脸,区分它们的成本,全压在了看的人身上。在这样的环境里,一个人肯不肯署名,敢不敢为自己说的话负责,会比他说了什么,更值钱。

那份 PDF 我后来没再转。它确实是个很好的故事,但好故事和好真相,是两回事。

订阅 / 联系

下一篇继续从这里接上

新文章会同步到 RSS;也可以直接发邮件给我。