|
|
哈喽大家好!各位每天蹲守在LMSYS Chatbot Arena榜单和各种AI模型评测页面、一有新模型放出就第一时间跑去注册账号亲自上手测推理能力、连API调用每百万token的价格波动都了如指掌的深度AI发烧友,手头握着整个技术团队的模型选型决策权、正在几个主流大模型之间反复比对性能和成本、生怕一个不留神选错了方向就被竞争对手甩开好几条街的创业公司CTO和技术负责人,看到Kimi K3冲进全球前三的消息之后在微信群里连着转发了七八条相关报道、恨不得让身边所有人都知道国产大模型这回是真的站起来了的国产AI铁杆支持者,过去两三年里眼睁睁看着美国那边一轮接一轮地收紧对华先进制程芯片的出口管制规则、心里一直憋着一股劲儿、就想看看咱们在算力被卡脖子的不利局面下到底能不能搞出点名堂来的半导体和人工智能产业长期观察者,还有那些纯粹是因为看到“OpenAI总裁公开夸奖中国AI模型”这种八百年都难得碰上一回的稀罕标题觉得新鲜又好奇、忍不住点进来看看到底发生了什么事儿的吃瓜网友——今天咱要好好聊一聊的这个事儿,可以说是这个礼拜全球AI圈子里最有嚼头、最耐人寻味的一场隔空交锋了。故事的一方,是国内这两年声量越来越大、用户基数迅速膨胀的AI初创公司月之暗面,也就是大伙儿熟悉的那家做出Kimi的公司;另一方,则是全球AI领域公认的头号玩家OpenAI的联合创始人兼总裁、在公司内部地位仅次于CEO萨姆·奥尔特曼的格雷格·布罗克曼。两边这一来一回的几个回合,里头的信息量可以说是相当密集,既有客客气气的场面话和表面上的认可,也有绵里藏针的试探和不动声色的敲打,中间还夹着白宫那边半路杀出来的一记重锤,整个事件的戏剧性可以说是拉满了。
事情得从这个礼拜早些时候说起。月之暗面这家公司,正式对外发布了他们的新一代大型语言模型,取名叫作Kimi K3。这款模型一亮相,就在好几个业界公认的关键基准测试指标上,跟OpenAI和Anthropic这两家美国顶级AI公司的当家旗舰产品打成了平手,甚至在个别单项上还实现了小幅反超。具体来说,根据AI评估机构Artificial Analysis发布的一份综合智能指数排行榜,Kimi K3最终拿下了57分的总成绩,稳稳地坐在了全球第三的位子上。排在它前面的是谁呢?头一名是Anthropic家的“Fable 5”,拿到了60分;第二名是OpenAI家的“GPT-5.6 Sol”,拿到了59分。也就是说,Kimi K3跟第一名和第二名之间的差距,拢共就那么两三分的事儿,这在两三年之前几乎是没人敢想象的一个局面。要知道,前年也就是2024年那会儿,国产大模型跟美国头部模型之间的差距还是肉眼可见的一大截,在很多业内人士的印象里,咱们至少有一年到一年半的追赶距离。可现在倒好,Kimi K3直接一步到位挤进了全球前三的席次,把不少海外知名度很高的模型都给结结实实地压了下去。
这个消息一传出来,国内外的舆论反应可以说是冰火两重天,反差极大。国内这边自然是欢欣鼓舞,社交媒体上到处都是“国产AI雄起了”、“终于等到这一天”的声音,朋友圈里相关的文章转发量也是蹭蹭往上涨。但在大洋彼岸,特别是在美国的科技界和华盛顿的政策圈子里,反应就要复杂和微妙得多了。一方面,有一部分人不得不承认Kimi K3确实是有两把刷子的,性能数据摆在那里,你不服气也不行;但另一方面,质疑的声音也随之而起,而且这股质疑的矛头,直指一个在业内非常敏感、非常容易引发争议的话题——蒸馏。
说到蒸馏这个概念,我得先给不太了解内情的朋友稍微掰扯掰扯这到底是个什么东西。所谓蒸馏,在人工智能领域指的是一种模型优化的技术路线:简单来说,就是用别人家已经训练好的、性能非常强悍的大模型来充当“老师”的角色,让这个“老师”模型生成海量高质量的问答数据、推理链条或者代码片段,然后再拿这些现成的数据去训练自家的“学生”模型。这样做的好处是显而易见的——你不需要从零开始投入天文数字级别的算力资源和海量的标注数据去训练一个大模型,而是直接站在巨人的肩膀上往上攀爬,效率高、成本低、出成果的速度快得不是一星半点。但问题在于,这种做法在行业内部一直处在一个相当微妙的灰色地带。如果你是用自己的大模型去蒸馏自己的小模型,那完全没有问题,顶多算是内部优化的一种技术手段而已。但如果你用的是别人的模型,特别是直接竞争对手的模型来进行蒸馏,那就涉及到知识产权侵权和服务条款违约的问题了。绝大多数AI公司,包括OpenAI和Anthropic在内,都在自己的开发者服务条款里白纸黑字写得清清楚楚:不允许任何人利用它们的API输出结果来训练与之存在竞争关系的模型。所以蒸馏这个东西,说白了就是你偷偷干了没人抓到证据就没事,一旦被人逮到把柄,那就是另一码事了,轻则被发律师函,重则可能面临法律诉讼和政府制裁。
巧就巧在,Kimi K3发布之后没过几天,白宫那边就有人站出来放了一番措辞相当严厉的话。根据韩国经济新闻的详细报道,美国白宫科技政策办公室的主任迈克尔·克拉齐奥斯,在当地时间7月22日这天公开发表了一番针对性极强的言论。克拉齐奥斯说,他们已经收到了一些情报信息,显示月之暗面在对Anthropic的“Fable 5”模型进行蒸馏操作。他的原话是这么讲的:“我们已经收到了相关信息,表明月之暗面对Anthropic的‘Fable 5’进行了蒸馏。”这还没完,他又紧跟着补了一句分量更重、火药味更浓的话:“窃取美国的专有技术、破坏美国的研究工作,这是完全不可接受的。”而且他还在话语中话里有话地暗示,美国政府可能会因此采取进一步的制裁措施。要知道,这位克拉齐奥斯可不是什么随随便便的无名小卒,他是白宫在科技政策方面的核心决策人物之一,他的公开表态在很大程度上就代表了美国行政当局在这个问题上的官方立场和态度基调。
那么,作为被指控“被蒸馏”的那个“受害者”一方的直接同行和竞争对手,OpenAI这边又是如何看待和处理这件事的呢?这就回到了咱们今天这篇文章的核心人物——OpenAI的总裁格雷格·布罗克曼身上。布罗克曼在当地时间7月22日这天接受了彭博社的专访,记者自然不会放过这个绝佳的机会,直接就Kimi K3的实际表现以及围绕它产生的蒸馏争议向他连环发问。而布罗克曼在整个采访过程中的回答,可以说是相当有水平、相当老练,既没有完全抹杀Kimi K3的真实实力,也没有在那个极其敏感的话题上轻易松口或者露出破绽,分寸拿捏得相当精准老道。
先说说他对Kimi K3这款模型本身的评价。布罗克曼的原话是这么说的:他把Kimi K3称为一款“相当扎实的模型”,英文原文用的是“a pretty solid model”。而且他还进一步补充了一句分量不轻的评价,说Kimi K3“毫无疑问是一款具有竞争力的模型”,英文原文是“without a doubt a competitive model”。你仔细品一品这个措辞的分量,其实已经是一个相当不低的评价了。能让OpenAI的二号人物在公开的媒体采访中亲口承认一个来自中国初创公司的AI模型“有竞争力”,这本身就是一件值得单独拿出来大书特书的稀罕事儿。要知道,OpenAI这帮人平时的姿态可是相当高的,眼界也相当挑剔,能让他们嘴里蹦出“不错”、“扎实”这样的字眼,说明Kimi K3在性能上确实是拿出了真材实料的,不是那种靠营销吹出来的花架子。
但是,当记者巧妙地把话题转到蒸馏这个问题上的时候,布罗克曼的态度立刻就变得谨慎和圆滑了起来,跟刚才评价模型时的爽快形成了鲜明对比。他说,现在就急着去判断月之暗面到底有没有通过蒸馏的技术手段来提升Kimi K3的性能表现,“还为时过早”,英文原文是“It‘s too early to tell”。这句话你仔细琢磨一下,里头的潜台词可以说是相当丰富、相当耐人寻味:一方面,他没有直接指控月之暗面干了什么见不得光的勾当,给自己留下了充分的回旋余地和外交辞令般的缓冲空间;但另一方面,他也丝毫没有主动替月之暗面澄清或者辟谣的意思,没有说“我相信他们没有这么做”之类的话。说白了,他就是把这个滚烫的烫手山芋往旁边不轻不重地一拨,既不点头也不摇头,既不肯定也不否定,让你们外界自己去猜、自己去琢磨。
除了针对Kimi K3本身的评价之外,布罗克曼在采访中还聊到了一个格局更大、视野更广的话题——中美两国在整个人工智能领域的整体实力差距到底有多大。他说他曾经看到过一个业内的估算数据,认为目前中国AI模型的开发水平大概比美国落后四个月左右的时间,而且他还特意提到,有一些AI领域的权威专家认为,这个实际差距可能比四个月还要更小一些。这个判断如果基本属实的话,那就意味着中美在AI基础大模型层面的整体实力差距,已经从几年前人们普遍认为的“一年以上甚至两年”,急剧缩短到了“仅仅几个月”的量级。这个追赶的速度,说句实话,确实是相当惊人、相当出乎很多人意料之外的。
不过,布罗克曼在抛出这个判断之后,紧接着就话锋一转,着重强调了一件事:OpenAI之所以能够维持住自身的领先地位和市场统治力,靠的是早期在计算基础设施上砸下去的海量资金和资源投入,以及多年来持续不断、从未有过中断的AI前沿研究工作所积累下来的深厚技术功底和人才储备。他的言下之意其实已经表达得非常清楚了:就算你们中国人追得再快、再猛,我们手里攥着的牌也比你们多得多、厚实得多,想要翻盘、想要超越,没有那么容易。
除此之外,布罗克曼还在采访中顺便纠正了一个他在外界观察到的普遍误解。他说,有些人觉得像Kimi K3这样的中国开源权重模型是免费的,这其实是一种完全错误的认知。他的原话是这么说的:“这些同样是需要消耗巨大计算资源的大型模型,而计算资源本身是非常昂贵的。”他还接着补充了一句很有前瞻性的话:“展望未来,如何构建出最高效、同时性能又足够出色的模型,将会成为AI竞争的核心所在。”这段话其实点出了一个很容易被普通大众和围观群众忽略的现实问题:就算模型本身的权重参数是开放的、你可以从网上下载下来,但要让这个模型真正跑起来、为你产生实际价值,你依然需要花钱去租服务器、买显卡、交电费、雇工程师来维护部署,这笔运营成本算下来,未必就比直接调用商业API便宜到哪里去。免费下载不等于免费使用,这个道理很多人其实并没有真正想明白。
所以,把整件事情从头到尾仔仔细细捋一遍,你会发现一个相当有意思、相当耐人寻味的局面:中国这边的AI初创公司月之暗面,在先进制程芯片供应受到严格限制、算力基础设施建设处于明显劣势的不利条件下,硬是靠着算法层面的一系列优化和创新,搞出了一款能够在全球顶级水平上跟美国最强对手正面较量的产品,一举冲到了综合智能指数排行榜的第三位。而美国这边,从白宫的科技政策办公室到OpenAI的最高管理层,态度可以说是既矛盾又复杂——一方面,他们不得不公开承认对方的产品确实有实力、确实有竞争力;但另一方面,他们又忍不住要从技术手段的正当性和合规性角度提出质疑和挑战,甚至搬出了“可能实施制裁”的威胁来给对方施加压力。至于蒸馏这个事情到底是真是假、月之暗面到底有没有干过这种所谓的“偷师”行为,恐怕在短期内很难有一个确切的、一锤定音的结论。毕竟这种事情,除非你能拿出铁板钉钉的、无可辩驳的确凿证据,否则永远都会陷入公说公有理、婆说婆有理的拉锯状态。但不管最终的结论到底是什么,Kimi K3的诞生和它所取得的亮眼成绩,至少已经铿锵有力地证明了一件事:在全球AI这场没有硝烟的大赛跑中,中国公司绝对不是只能跟在别人屁股后面默默吃灰的那个配角。
|
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
x
|