微信开源新模型,日调用量十亿级的“AI翻译官”长这样

作者: 智享AI发布日期: 2026/9/7阅读时间: 2分钟
微信开源新模型,日调用量十亿级的“AI翻译官”长这样 封面图

腾讯微信视觉团队最近把自己的通用多模态嵌入模型WeMM-Embedding开源了。简单说,这就是一个能让AI同时看懂文字和图片的“翻译官”。

它会把一张猫的照片和“胖橘猫”这三个字,翻译成电脑能读懂的数学语言,放进同一个“语义空间”里。这样一来,AI就能判断这两者是不是在说同一件事。模型说白了,就是帮AI搞懂“这张图和这句话配不配”“这段文字和这个视频像不像”的核心工具。

这次开源的WeMM-Embedding一共给了三个身材:2B、4B和9B版本。B指的是参数量,数值越大,模型越“聪明”,但也越“能吃”。2B版身轻如燕,适合塞进手机App或小设备里跑;9B版脑子更灵活,适合放在服务器上处理高难度任务。同一个技术架构,剪出三个尺码,让开发者各取所需。

这次放出来不是实验室里没经过考验的玩具。这个大模型早就已经混进了微信的推荐和搜索系统里,每天被调用十亿次级别,相当于你每次刷朋友圈、搜聊天记录,背后可能都有它的身影。

微信这次愿意把压箱底的看家本事搬出来,对AI开发者来说是个实在的利好。垂直行业里那些想做图搜、做商品推荐、做视频理解的人,不用再从零训练底模了,直接拿去用就行。

多模态模型的趋势已经很明确:以前大家拼谁的参数多,现在拼谁更实用、更便宜、更接地气。微信这一步走得很务实,别忘了,它可是在几十亿用户的产品里实战磨出来的。

aitechtoolproduct
精选评论
评论加载中…
发表讨论 »