讯飞这次玩真的:两款端侧大模型要开源,1M上下文一秒读懂整本《三体》

作者: 智享AI发布日期: 2026/8/31阅读时间: 3分钟
讯飞这次玩真的:两款端侧大模型要开源,1M上下文一秒读懂整本《三体》 封面图

9月1日,科大讯飞把星火X2.5系列的两款端侧模型——4B和1.7B版本,直接开源了。这两款模型主打一个“轻装上阵”,参数不大,但能一口气读完1M token的文本量。什么概念?相当于一次塞进几十万字的内容,模型照样接得住、记得住。更关键的是,它们在智能体交互、数学计算和通用理解上做了专项强化,分明是冲着车载系统、智能音箱、IoT设备这些“跑在边缘”的场景去的。

你没看错,端侧大模型正在成为下一站。过去大家的注意力全在云端大模型上,千亿参数、万亿参数,卷得飞起。但问题也明显——响应慢、成本高、用户隐私还得绕一圈传到服务器。讯飞这次开源端侧模型,等于给行业递了一把钥匙:小模型也能干大事,离线也能玩转AI。对开发者来说,这意味着可以在没有网络的环境下,把AI塞进手边的设备里,让它自己动起来。

紧接着,9月7日,讯飞还要放出大招:一个293B参数的星火X2.5基座模型。规格拉满,重点升级代码生成和智能体协同。这说明讯飞的节奏很清晰——端侧抢落地,云端拼能力,两条腿一起走。

值得留意的是,讯飞此前在业绩说明会上透露,全球1024开发者节上还会推出基于全国产算力的主力通用大模型。这个信号比参数更耐人寻味。在AI算力被“卡脖子”的背景下,用国产算力把大模型跑起来,已经不是选择题,而是必答题。

说白了,AI的竞争正从“谁的模型大”转向“谁能让模型用起来”。讯飞这步棋,既务实又前瞻——先在端侧给开发者提供趁手的工具,再往基座模型上加码,最后押注国产算力闭环。如果你还在犹豫 AI 到底能落到哪里,这两款开源模型,就是最直接的答案。

aitechtool
精选评论
评论加载中…
发表讨论 »