
8月21日,DeepSeek把旗下大模型工具链狠狠升级了一版,最新版本号来到0.1.1-rc.1。这次更新的重头戏,是在原有V4Flash和V4Pro两款模型之外,新增了一个视觉模型体验版——V4Flash Vision-Exp。简单说,就是AI不光能读文字,还能“看懂”你发的图片了。
其实就在前一天,v0.1.0-rc.8版本已经悄悄打通了多模态能力的基础。当时系统就支持配置原生图片请求,/goal、/plan这些指令也能接收图文混合输入了。这意味着什么?过去你让AI干活,得把需求一条条打出来,现在直接把工作截图丢给它,再加上一句“按这个改”,AI就能自己看图办事,开发流程一下子短了一大截。
要说的是,DeepSeek网页端的识图功能早就有,体验也不差。但这次不一样——视觉能力被真正塞进了开发工具链里,成了开发者手里顺手就能用的工具,而不再是一个单独的网页功能。这一步,等于把多模态处理的最后一块短板补齐了。
对开发者来说,上手也没什么门槛,一条npm命令就能升级到新版本,立刻体验V4Flash Vision-Exp在速度和识别精度上的表现。从行业角度看,DeepSeek这一轮更新节奏相当快——前一天刚打通基础能力,第二天就推出体验版视觉模型,这种迭代速度在AI大模型赛道里并不多见。可以预见,接下来的竞争重心,已经从“谁能聊”转向“谁更能看、更能干”了。
精选评论
评论加载中…