大豆垂直大模型丰菽2.0发布
「8月16日,安徽农业大学王晓波教授在南宁发布大豆领域垂直大模型“丰菽”2.0。该模型实现多模态数据融合,新增多模型协同分析机制,整合超1000万字专业文本、1万篇文献及8000份基因组重测序数据,可辅助开展病害诊断、亲本筛选等育种工作。」
在广西南宁召开的第32届全国大豆科研生产研讨会上,安徽农业大学王晓波教授代表研发团队正式发布了大豆领域垂直大模型“丰菽”2.0。这一版本在初代基础上实现全面升级,通过多模态数据融合与多模型协同分析,显著降低单一模型回答偏差,推动大豆数据辅助育种进入新阶段。
大豆是我国重要的粮、油、饲兼用作物,其育种研究具有重大的经济价值和战略意义。今年2月,安徽农业大学联合中国农业科学院作物科学研究所共同完成了“丰菽”大模型的构建,该大模型定位为面向大豆全生命周期的生成式AI育种平台。近期,两家单位基于实际科研需求对模型进行了迭代升级,推出了“丰菽”2.0版本。
据研发团队介绍,“丰菽”2.0整合了大豆种质资源、基因组与编码序列、蛋白质、转录本、基因表达、病害样本、育种试验记录及中外文献资料,构建起面向大豆科研的结构化知识体系。尤为值得关注的是,新版本新增了多模型协同分析机制:模型嵌入了部分通用大模型接口,这些接口可分别回答同一大豆专业问题,再由“丰菽”2.0的总结模块结合领域知识、私有数据和结构化比对规则,对各模型回答中的共识、差异及证据完整性进行综合分析,最终形成更加清晰可靠的专业结论。
在功能层面,“丰菽”2.0集成豆百科、豆分子、豆文献、豆病害、豆表型、豆育种六大功能模块,覆盖知识图谱与文献数据、基因组与多组学数据、表型组数据、育种实践数据等多维数据体系。具体来说,模型整合了超过1000万字专业文本基础、超过1万篇科研文献与专利数据,构建了包含2万个实体、10万条关系的大豆领域知识图谱,并融合8000份基因组重测序数据、约4万份大豆种质资源和3000份以上品种表型数据。
目前,“丰菽”2.0已可围绕大豆重要农艺性状,辅助开展病害诊断、育种亲本筛选、虚拟组合设计、表型数据解析、分子标记辅助育种和候选基因功能分析。这一垂直大模型的迭代升级,不仅为大豆科研工作者提供了高效的知识服务工具,也为AI驱动作物育种探索了新的技术路径,展现了生成式AI在农业领域深度应用的广阔前景。
来源:Heooo AI工具导航