
今天,阿里联合中国人民大学搞了个大动作——开源了一个叫LOGOS的科学大模型。这模型参数只有1B,但性能却超过了微软参数高达8×7B的NatureLM模型,相当于用五十六分之一的参数就干翻了对手。它到底牛在哪?简单说,以前搞科研,研究蛋白质、小分子、化学实体这些东西,得用不同模型来回切换,麻烦又费钱。LOGOS直接发明了一套“科学语法”,把蛋白质、化学分子等7大类异构对象,全编码成统一的数字序列,让大模型像读文章一样理解它们。更绝的是,它不需要输入复杂的3D坐标,靠预测序列就能在脑子里构建出分子间的空间互作规律。而且,LOGOS的训练数据和实际应用场景完全对齐,预训练时学的是什么格式,下游任务直接用,省去了大量微调步骤。阿里这次连模型权重、推理代码和技术报告都一并开源了。可以看出,科研AI正在从“专用工具”走向“通用底座”,以后科学家可能不再需要为每个问题单独训练模型,一个LOGOS就能搞定生物、化学、材料等多个领域的基础任务。
精选评论
评论加载中…