牛来就是智谱GLM-5.3-Flash:模型能自己看着画面改代码,价格还不到同行四十分之一

作者: 智享AI发布日期: 2026/8/27阅读时间: 4分钟
牛来就是智谱GLM-5.3-Flash:模型能自己看着画面改代码,价格还不到同行四十分之一 封面图

智谱AI今天扔出一颗“炸弹”:此前在开源社区传得神乎其神、代号“牛来”的神秘模型,正式揭晓真身——它就是智谱最新发布的GLM-5.3-Flash。这是GLM-5系列第一个原生多模态模型,性能直接对标全球顶级旗舰,价格却低到让同行后背发凉,而且它跑在纯国产芯片上。

这个模型最狠的一点,是它长了一双“眼睛”。过去写代码,AI生成完交给人类去运行、去看效果、去报错,全程单向。GLM-5.3-Flash不一样,它把视觉能力直接嵌进了写代码的循环里:写完代码,自己截个图看看渲染得对不对;搭个3D场景,自己盯着画面调整细节;做个游戏,自己看交互反馈再改。等于从“埋头写”变成了“边看边写边改”,形成了一套“生成—观察—修正”的闭环。

官方给了一个很直观的测试案例:让GLM-5.3-Flash在Blender这款专业3D软件里从零搭房子,它竟然自己跑了整整16个小时,最后搭出一个约400平方米的专业主厨自宅加测试厨房。注意,全程没有人类在旁边指点,全靠它自己“看”着渲染画面一步步迭代修正。这个细节足以说明,视觉判断和自主改进能力已经不是演示级别,而是能扛住长时间真实任务的水平。

性能上,GLM-5.3-Flash在Artificial Analysis Intelligence评分中拿到57分,比上一代旗舰GLM-5.2高出一截,也把DeepSeek V4 Pro正式版的53分甩在后面,而同类模型的中间值只有18分。如果光看这个分差,很多人会以为价格肯定也“旗舰”——恰恰相反,它打破了“参数越大越贵”的老规矩:每百万Token输入只要0.8元,输出2.8元,缓存命中更是低到0.23元。这是什么概念?综合成本大约只有Claude Opus 4.8的四十分之一。以前用顶级模型得“抠抠搜搜省着用”,现在基本可以放开手脚随便造。

更值得留意的是背后那层东西。支撑这款模型跑全球真实线上流量的算力,已经全面转向国产芯片。在OpenCode和OpenRouter这些国际平台上,它的推理靠的是国产集群承载,配合专用的SGLang推理引擎、ReplaySSM、混合缓存量化和EPD分离式架构等一系列优化手段,硬生生把内存和带宽的瓶颈给顶过去了。这意味着国产芯片不只是能“跑通”前沿大模型,而是能在真实大规模流量下稳定扛住,还能做到成本可控。

目前GLM-5.3-Flash的模型权重已经用MIT许可证在Hugging Face等平台开源,API同步向全球开发者开放。这算是把高性能、低成本、国产化这三件事拧到了一起。过去我们总在谈“国产替代”,多半是应急方案;现在这个节奏更像是正面竞争——大模型行业的游戏规则,正在被改写。

aitechtoolupdate
精选评论
评论加载中…
发表讨论 »