腾讯开源大模型Hy4来了:能读百万字文档,还能解困扰数学家数年的难题

作者: 智享AI发布日期: 2026/8/30阅读时间: 4分钟
腾讯开源大模型Hy4来了:能读百万字文档,还能解困扰数学家数年的难题 封面图

腾讯今天甩出了一张开源牌——混元Hy4 preview正式上线,总参数高达770B(激活参数49B),上下文窗口做到1M。1M是什么概念?相当于一次性能塞进三体三部曲的体量,让AI一口气读完再回答你的问题。

这次发布的模型不只是“大”。腾讯方面的说法是,预训练和后训练一起升级,智能水平再次跃升,稳居开源第一梯队。目前模型已经在HuggingFace、GitHub、ModelScope、Gitcode四个平台同步上线,也接入了腾讯云TokenHub和OpenRouter,开发者想用随时能用。

更值得注意的是它在实际干活上的表现。腾讯拉来163名内部专家,设计了203个贴近真实工作的任务做盲测,Hy4 preview平均得分2.99(满分4.00),压过了GLM-5.3的2.92和Kimi K3的2.94。这分数看着差距不大,但在模型评测里,零点零几的提升往往意味着质变。

这些任务覆盖了软件工程、办公分析、游戏开发、科研等多个领域。软件工程方面,它擅长理解长程开发任务,能规划代码结构并自我验证;办公场景里,给它一堆原始数据,它能从头到尾把图表、文档、演示文稿全部交付;游戏开发更夸张,你只说一句“我想要个什么玩法”,它直接生成一个可玩的原型。科研方向也有进展,分子动力学、凝聚态物理这些专业领域都有涉及。

真正让人意外的是它在数学上的表现。配合腾讯的Hyra框架,Hy4 preview在三维Blaschke–Lebesgue问题上取得突破——这是一个百年几何难题,此前的最佳下界是0.380799,Hy4把它推进到了0.41104,距离数学界长期猜测的理想值0.41986只差大约2%。换句话说,这个模型离彻底攻克一个百年难题只差一步。

腾讯也没回避问题。官方坦承Hy4 preview只是Hy4的早期迭代版本,预训练和后训练都还有提升空间,已知问题包括复杂任务上思考过久、过度自我验证等。团队表示会持续快速迭代。

目前Hy4 preview已经和腾讯的CodeBuddy、WorkBuddy深度协同,普通用户也能在元宝、ima等产品里直接体验。

开源大模型的竞争已经不只是比参数大小了。Hy4 preview这次展示的,是开源模型在硬核生产力场景和前沿科研领域都能打的能力。当开源模型开始解百年数学难题,闭源模型的优势还能保持多久?这个问题值得整个行业想一想。

aidesigntechtoolupdate
精选评论
评论加载中…
发表讨论 »