腾讯挖来OpenAI研究员,多模态AI大战再添猛将

作者: 智享AI发布日期: 2026/7/9阅读时间: 2分钟
腾讯挖来OpenAI研究员,多模态AI大战再添猛将 封面图

OpenAI又走了一位研究员,这次去了腾讯。6月18日,前OpenAI研究员田永龙正式入职腾讯大语言模型部,主攻视觉语言模型(VLM)研发。这个让AI“看懂”图片和视频的技术,正成为大模型军备竞赛的下一个焦点。

田永龙在AI圈并不陌生。他曾在OpenAI参与视觉模型研究,发过不少高水平论文,算得上视觉语言领域的“老手”。如今他加入腾讯,业内普遍认为是腾讯在多模态方向上的关键引援——多模态就是让AI不仅能读文字,还能理解图像、声音甚至手势。想想看,你给AI一张照片,它直接读出照片里的故事,或者根据一段视频生成字幕,这就是视觉语言模型的魅力。

为什么腾讯要抢这个人?因为多模态技术太“吃”人才了。今年上半年,国内外头部大模型公司都在疯狂招人,尤其是能打通“视觉+语言”的科学家。谷歌、微软、百度、阿里,全在布局。腾讯此前已经在混元大模型上投入不少,但多模态这块还缺一个能带队打仗的人。田永龙来了,正好补上短板。

对普通用户来说,这事意味着什么?未来你刷抖音、用微信、玩腾讯游戏,背后很可能是田永龙参与训练的AI在帮你识别内容、推荐视频、甚至生成解说。比如你随手拍张猫的照片,AI能瞬间判断品种、年龄、心情,还能推荐相关商品——这离不开视觉语言模型的进步。

科技巨头的人才争夺战,从来不只是为了挖几个人。它背后是对下一个技术浪潮的押注。谁先搞定“看懂世界”的AI,谁就能在自动驾驶、智能硬件、元宇宙这些赛道上抢得先机。腾讯这步棋,下得挺准。

aitech
精选评论
评论加载中…
发表讨论 »