铭鸿体育资讯网

DeepSeek官宣明日flash系列AI模型降价,行业里确实不多见 Deep

DeepSeek官宣明日flash系列AI模型降价,行业里确实不多见
DeepSeek今天早上发了个公告,说从明天中午12点开始,他们家Flash系列模型的价格要往下调。这个事儿挺有意思的。缓存命中这部分的输入价格,原来是每百万token收5分钱,明天开始变成2分钱,降了60%。 缓存没命中的地方,从1块5降到1块,降了33%。 输出最贵的那块,从4块5降到4块,降了11%。 这组数据如果放在一起看,60%的降幅放在整个行业里,确实不多见。
但有个细节值得注意,公告里特意区分了空闲时段和高峰时段,高峰时段的价格是空闲时段的两倍。 也就是说,你白天工作时段用,价格翻倍,晚上或者周末用,价格更便宜。 这个操作倒不是什么新鲜事,跟电商搞的闲时流量优惠一个逻辑。说到具体哪些模型降价,这次涉及的是deepseek-v4-flash和deepseek-v4-flash-vision-exp这两款。
再往前翻一翻,8月13号DeepSeek刚把V4 Pro正式版上线的时候,价格其实是往上调的,当时不少开发者还在抱怨。 结果一个月之后,Flash系列突然降价,市面上有的分析说这是在安抚市场情绪,有的说是在为新模型铺路。
9月8号,也就是降价公告前两天,DeepSeek开始内测V4.1 Flash,官方说法是能力更强、速度更快、成本更低。 这一下就说得通了,新技术迭代之后,旧技术的成本结构会变得更可控,降价的空间也就自然出来了。
在开发者的圈子里,大家对这次降价反应挺热闹的。 有人算了一笔账,如果一个Agent工作流每天调用量在千万级别,综合成本可能下降40%左右。 这不是小数目,对于做AI应用的公司来说,调用成本一直是个头疼的问题,尤其是那些需要频繁调用API的产品。
不过也有程序员在讨论,降幅最大的那块是缓存命中场景,这说明DeepSeek在引导开发者优化调用逻辑。 简单说,就是提示你尽量复用之前的计算结果,这样可以省更多钱。 如果调用逻辑不优化,缓存命中率低,那享受的降价幅度就小很多。这种精细化的定价策略,在之前的AI模型市场里其实不太常见。 以前大家更关注的是参数规模、推理能力这些指标,现在越来越多人开始关心每百万token的价格了。
说白了,模型技术本身在进步,成本在下降,这是降价的客观基础。 但更关键的是,整个行业正在从“拼参数”转向“拼成本”。 对于企业用户来说,API价格降下来,意味着他们做AI产品的门槛也跟着降了。
一个听起来有点反常识的事儿是,大模型价格越降,整个行业反而可能越有活力。 因为价格低,更多中小企业敢用,应用场景就更多,数据反馈也就更多,反过来又能推动模型本身变得更好。
当然,这只是一个角度。 另一面是,价格战如果真的打起来,那些没有成本优势的公司可能会比较难受。 毕竟Flash系列本身就属于DeepSeek里性价比很高的产品线,这次降价之后,同价位段的竞争对手面临的压力会更直接。
有个开发者在技术论坛上写了一句评论,说“这才是AI该有的样子,用得起,才用得开”。 这个评价挺实在的,不过也暴露了一个问题,如果AI模型的价格一直降,会不会让一些用户觉得,越便宜的AI越不值得信任?
这个问题的答案可能不需要急着下结论。 明天中午12点一到,价格一更新,用的人自然会给出答案。
优质好文激励计划