根据《路透社》、《金融时报》等多家外媒近日报道,字节跳动竟然正在训练一个参数规模达到10万亿的人工智能大模型。参数规模是衡量一个人工智能大模型的最关键指标,通常情况下参数规模越大,其性能也就更加优异。
《金融时报》更是指出,即便是目前全世界最先进的人工智能大模型,也就是Anthropic研发的Mythos,参数规模也不过8万亿,也就是说字节跳动这一款大模型一旦研发出来,其性能将直接登顶全球第一。
这与之前的Kimi K3等大模型完全不是一个概念,Kimi K3等大模型的主要特点,是在价格优惠的同时,性能也逼近Anthropic的顶尖大模型,因此从市场角度对美国的顶尖大模型构成了极大挑战,但是字节跳动这一款正在研发的大模型,则是将直接从最根本的性能层面对这些全球顶尖大模型发起挑战。
那么为什么字节跳动能够突然拿出这么一个惊人的成绩?要知道,在这之前字节跳动虽然开发出豆包等产品,但是在大模型的表现上,与其他公司一直有着一定差距,不温不火。
之所以如此,关键还是在于张一鸣的发展思路,他拒绝“蒸馏”。这一点在业内已经不算是秘密,根据科技博主“阑夕”8月6日爆料,很久之前DeepMind的创始人姚顺宇在接受采访时就说,在国内大模型公司中蒸馏最少的就是字节跳动,也正是因为蒸馏很少,所以字节跳动的模型一直非常独特。
前不久有两位字节员工也对“The Information”爆料过,说张一鸣上个月在Seed的团队全员大会上,还专门进行过一番强硬地表态:“字节跳动不会把蒸馏当做提升AI模型能力的捷径,即便这意味着公司眼下落后于国内竞争对手。”
之所以如此,还是因为“蒸馏”虽然是一个捷径,但是容易“知其然不知其所以然”,长远来看会损害自身发展潜力,适合追赶难以领先。而张一鸣想要做的则是彻底的领先。
由此来看,现在字节跳动突然被爆料说正在训练一款参数规模达到10万亿的大模型,也就不足为奇了,张一鸣信奉一种长期战略,并不在意短时的落后,而现在蛰伏了这么久,或许终于到了要出成果的时候,相信到时这个成果一旦拿出来,将会震动整个全球AI界。



