3 美分能干什么?
买不了一根棒棒糖,但够让 AI 帮你干完一项正经任务。
美国研究机构 Artificial Analysis 测了个数,DeepSeek-V4-Flash 完成一项智能指数任务的加权平均成本,3 美分。
什么概念?
Anthropic 的旗舰模型 Claude Fable 5,干同样的活,成本是它的 100 倍往上。
OpenAI 的 GPT-5.6 Sol,1.86 美元,贵了 60 倍。
就是这个把智能卖出白菜价的家伙,8 月 6 日突然发公告:API 要涨价了,涨幅还不小,“请合理安排使用”。
公告很短,水面下的动静很大。
先看它 7 月 31 日刚干了什么。
V4-Flash 正式版上线公测,架构和参数跟 4 月的预览版一模一样,就靠后训练优化,Agent 能力暴涨,官方基准测试比 V4-Pro 预览版强了 6 倍还多。
总参数 2840 亿,激活只用 130 亿,支持 100 万 Token 上下文。
价格呢?
输入命中缓存 0.02 元每百万 Token,没命中 1 元,输出 2 元。
OpenAI 那边同水平的 GPT-5.6 Luna,咬牙降价 80%,成本还是它的将近两倍。
价格战打到这个份上,已经不是卷了,是把地板打穿了。
那为啥才公测一周,就急着涨价?
业内人士的判断出奇一致:算力不够用了。
新加坡无限对齐创始人宋斐说得直白,V4-Flash 上线后日处理量冲到万亿 Token 量级,这个体量上调价,更像产能跟不上,跟定价策略关系不大。
有科技博主算了笔账,V4-Pro 名义毛利率能到 90%以上,把免费流量和折扣都算进去,真实毛利率也有 72%到 81%。
也就是说,原来的价格完全能覆盖成本,涨价图的是另一件事:调用量疯涨,新算力得砸钱,价格得跟未来的资本开支匹配上。
说到底,这是幸福的烦恼。
需求太猛,锅里的饭不够盛了。
这事真正的门道,不在涨价本身,在涨价谁也奈何不了它。
DeepSeek 用极致低价,把“智能该卖多少钱”这颗心理锚,狠狠钉进了市场的脑子里。
从此以后,用户衡量一切 AI 服务,都会下意识拿它当尺子。
你说你的模型好?
先回答一个问题:你比 DeepSeek 贵几倍,好在哪里?
宋斐有个看法,跟主流唱反调。
大家都说涨价伤用户,他说 DeepSeek 自己涨价反而最轻松,先发信用摆在那。
真正难受的是后面那批厂商,价格认知没立住,成本结构又跟不上,往上走没底气,往下走扛不住。
这话说得扎心,但在理。
锚是人家抛的,船可不是人家的。
顺便提一句细节,涨价公告出来的同时,API 文档里此前预告的峰谷定价悄悄撤了。
能调时段分布,调不了总量,这又从侧面印证了那个判断:算力是真紧。
不过要说这半月里 DeepSeek 最重要的一步棋,我倒觉得不是模型,也不是价格。
是 8 月 1 日那条不太起眼的消息:Harness 内测招募。
Harness 是个脚手架,把大模型变成真正能干活儿的 Agent,让它会调工具、接多步任务、记住干过的活、一路干到完。
宋斐的原话:“8 月 1 号这条消息,我觉得比任何降价都重要。”
道理在哪?
Harness 对外开放,第三方进来用同一套环境,官方跑分和外部复现就能当面对账。
再进一步,如果它真开源,行业统一脚手架这个位置,DeepSeek 就有机会先坐进去。
定标准的人,从来比卖产品的人走得远。
把这几步连起来看,一个互相喂养的循环就浮出来了。
Flash 低价铺量,海量调用产出带验证结果的轨迹数据,筛出来喂给 Pro 做后训练;Pro 的高质量输出再蒸馏回 Flash。
用的人越多,轨迹越多;轨迹越多,模型越强;模型越强,人越多。
飞轮一旦转起来,涨价三五个点,不过是给这架机器添点燃料。
低价是心理锚,涨价是现实,飞轮是长期故事。
人家从一开始就没打算只卖便宜货,它想做的,是让智能变成白菜价的工业流水线,然后自己当那个开工厂的人。
你们瞧这一次,连涨价的通知单都透着底气。
