[DeepSeek V4.1 Flash 9月10日发布,采用552B MoE模型,Causal-Encoder-Decoder非对称架构,输入激活仅8B,输出16B。原生支持多模态视觉理解,无需额外模块,图文处理效率提升明显。性能全面超越V4 Pro,KV Cache压缩后HBM需求降到1/4。价格下调,空闲时段输入缓存命中仅0.02元/百万Token,降幅60%。接口改成deepseek-flash,以前V4 Pro请求会静默路由到新模型,按新单价计费。这对开发者是重大好消息,成本更低,性能更好。] DeepSeekV4.1Flash发布
