智谱发布GLM5.3Flash智谱今天这手“牛来”变“Flash”,玩得挺溜。匿名上架OpenRouter钓了一周开发者反馈,回头直接甩出MIT开源协议,320B总参数只激活18B,推理成本已经打下来,更多人也跑得起。
原生多模态加100万上下文,混合注意力架构也是冲着长视频理解去的。45层深度配合稀疏注意力,长上下文服务成本大幅降低——这话从智谱嘴里说出来,比某些厂“理论成本下降”的PPT有说服力得多。
关键是当晚就放权重,这节奏对开发者比较友好。GLM-5系第一枪没搞期货,没搞邀请制,开源协议也干净。接下来就看社区能用这18B激活参数玩出什么花了。反正OpenRouter上那批测试的人已经爽了一周。

