俄罗斯初创企业 Mostik(桥)利用菲尔兹奖得主Smirnov等数学家成果,实现AI模型间通过权重直接“心灵感应”通信,无需文本交换,大幅提升效率。
测试中,GLM-5.2(753B)与 Qwen-3.5(4B)桥接,结果测试大概可以简单理解为,这个混合模型拥有了一个 700 B 模型一半的能力,
但是,混合系统算力成本,降至原1/20 !!!
其实这也合理,只要小模型明确的知道自己擅长干什么不擅长干什么,并且和大模型的交流效率足够高,那么很多杂事小模型自己在本地就干了。。。大模型能节省大量 token。
9 月份苹果将要发布的 Siri AI ,就是本地小模型 + 云端大模型的方式。如果运用了这种模型之间不通过人类语言交流的方式,那么苹果的确可能给用户提供不限量的token 。。。
本来, iPhone 18 Pro/Pro Max 我们拿到后发现和 17 Pro Pro Max 不能说天差地别吧,也只能说一模一样(就差几个丝)。
但是看来,iPhone 18 Pro / Pro Max 发布的真正看点是端侧 AI 和苹果用户的 Token 自由啊。。。