你已经用了这个预览版好几个月。今年4月起,DeepSeek-V4就挂在你的API面板上——开放权重,谁都能拿来试,能力也摆在那里,但始终贴着一个让人不敢完全放心的标签:预览版。这周,这个标签要摘掉了。
6月29日,DeepSeek把接下来要做的事挑明了:7月中旬——也就是本周——V4系列全面转正,而且一次上两款模型。V4-Pro,总参数1.6万亿,单次推理激活490亿参数;体量更轻的V4-Flash,总参数2840亿,激活130亿参数。两款模型现在默认支持100万token上下文——这条消息36氪当时只发了条简短快讯,短到不会单独成为西方媒体的头条。
但真正会成为头条的,是账单出来之后。DeepSeek这次引入了峰谷定价:北京时间上午9点到12点、下午2点到6点是高峰时段,同样的API调用,价格直接翻倍;平峰时段维持原价。翻倍是全线覆盖——缓存命中、缓存未命中、输出,三档价格一起涨。新浪财经原文写道:"API高峰时段价格将是平时价格的2倍"。 这句话背后的意味值得琢磨。一家靠"卷低价"闻名、当年直接打乱了西方定价体系的实验室,如今在告诉自己的客户:几点调用,本身就是一项成本。电有峰谷电价,现在推理也有了。 具体到数字,V4-Pro高峰时段报价为每百万token缓存命中0.05元、缓存未命中6元、输出12元——正好是平峰0.025/3.00/6.00元的两倍。V4-Flash则从平峰的0.02/1.00/2.00元涨到高峰的0.04/2.00/4.00元。中文报道里反复出现的官方说法是,这么做是为了"更合理地配置资源、提升服务稳定性"。
这句话值得多停留一秒,因为它真的在说明问题。这是电力公司才会用的措辞,不是一家还在拼命把价格打到底的实验室会说的话。从去年1月那场"DeepSeek时刻"到今天,算盘已经从"抢地盘"变成了"管负载"。这就是一条模型产品线从demo变成基础设施之后必然要经历的:基础设施必须被计量,否则它会在所有人最需要它的那几个小时崩掉。 西方科技媒体这次几乎全都盯着定价角度写——explainx.ai和DeepInfra的定价指南都把这条新闻当成一篇给开发者算账、帮他们决定该把调用路由到哪家的成本对比稿。这么写没错,如果你正是那个要付账单的人,这确实有用。但这样写漏掉了这次"转正"更有意思的另一面:一个本来要把智能做到近乎零成本的模型,如今主动给自己的产品重新引入了稀缺性——因为稀缺,恰恰是让服务器在所有人都想用的那几个小时还撑得住的办法。 100万token的上下文窗口悄悄变成默认配置、而不是拿来当头条讲,这本身就说明DeepSeek认为真正的竞争已经不在标价上了,而在于模型脑子里能装下多少你的"世界"。峰谷定价才是那个信号:价格战已经见底了。你正在看着一家曾经亲手写下这个行业"通缩篇章"的实验室,写下自己的第一章"自律"。这不是退步,这是当免费的钱花光、服务器还得喘气时,成熟该有的样子。