
昨天,一个叫DeepSeek-V4-Pro-0813的AI模型在硅基流动平台悄悄上线了,没有大张旗鼓的发布会,但懂行的人已经连夜开始测了。它最狠的不是智力,而是价格——缓存命中的情况下,每处理100万个token,只要0.44美元,折合人民币三块二。什么概念?你给AI发一大段话让它分析,它读完你这段文字花的成本,比一瓶矿泉水还便宜。
而且它不光便宜,记性还特别好。1M的上下文窗口,意味着它一次能记住约70万个汉字的对话内容,相当于三本《三体》的体量。以前AI聊天聊到一半忘事、断片儿的毛病,在这个版本里基本治好了。
三个档位的思考力度,从“快嘴”到“慢脑”自己挑
这次V4 Pro给了用户一个很有意思的选择:低、高、最大三档推理强度。你用低档,它回复飞快,适合那些不用动脑子的活儿;你调成高档或最大档,它会在回答前多想一会儿,适合啃硬骨头——比如复杂的编程题、逻辑推理、多步骤工具调用。这就像请了两个级别的厨师,一个负责快速出餐的日常简餐,一个负责慢慢雕琢的精品料理,价钱还不一样。
方向也变了。这次更新明显把重心压在了编码和智能体工作流上,翻译成人话就是:写代码、替你去操作其他软件、自动跑多步骤任务。以前AI模型更像个聊天选手,现在它更像个干活选手。
开源没变,但“快模型”和“重模型”分家了
最让开发者松口气的是,开源协议还是MIT,没收紧,你可以放心拿去商用、改成自己的版本。同系列的另一个型号DeepSeek-V4-Flash-0731也摆在那里,定位走得是完全不同的路线——它天生为速度而生,适合那些每天要调用几十万次、追求省钱的日常任务。V4 Pro则负责“重脑力劳动”。两个型号一快一重,把生产线的两头都堵上了,以前那种“又要马儿跑又要马儿不吃草”的矛盾,现在算是有了标准解。
对整个AI行业来说,这次定价释放的信号很明确:以Agent为主流的AI应用,长文本场景的算力成本已经被压到了一个新的临界点。以前跑一跑长上下文就烧穿预算的时代,可能真的过去了。