
8月20日,拉萨。一场以“数启纳金·智汇高原”为主题的数字经济论坛上,一款名叫“阳光清言”的通用藏语大模型正式亮相。这是西藏本土研发的千亿级参数大模型,由拉萨市纳金数智研究院和中国工程院院士尼玛扎西团队共同推进。
很多人会问:千亿参数是什么概念?可以把模型想象成一个学生的大脑,参数越多,脑容量越大,能记住和理解的知识就越丰富。“阳光清言”的千亿参数,意味着它不仅能处理通用的语言任务,还专门学习了海量藏语数据,对藏语文、西藏历史文化和相关知识体系,有更深入的理解和生成能力。
这款模型的研发时间线挺长。早在2025年11月19日,它就曾首次公开亮相,随后通过了中央网信办的备案。之后又经历了近两个月的内部测试和两个多月的公开测试,直到8月20日才正式宣布发布。
尼玛扎西院士在主旨报告里说得很坦诚:目前模型训练用的大规模算力和高质量数据还不够,“阳光清言”的整体表现,离设计目标还有提升空间。未来,研究院会继续加大在算力基础设施和数据规模上的投入,推动技术快速迭代,还会针对不同应用场景,推出不同参数规模的“阳光清言”系列模型。
同日揭牌的拉萨市纳金数智研究院,由拉萨市柳梧新区管委会与西藏大学共建。它的定位很明确:面向拉萨乃至整个西藏的数字产业和高原特色产业,做一个AI创新平台。从关键技术研发到成果落地转化,研究院想做的,是打通科研创新与产业发展的“最后一公里”。
论坛现场还展示了不少相关成果,比如面向文旅的三维重建、互动体验、数字人产品。另有联合实验室签约仪式,多位专家学者和企业代表坐在一起,聊人工智能怎么帮企业做数字化转型。
藏语大模型的出现,意味着AI不只在汉语、英语世界里热闹。但要让少数民族语言大模型真正好用,数据、算力、场景落地,每一步都是硬仗。
精选评论
评论加载中…