“丰菽”2.0是由安徽农业大学联合中国农业科学院作物科学研究所共同研发的大豆领域垂直大模型,在广西南宁召开的第32届全国大豆科研生产研讨会上正式发布。该模型构建了我国首个面向大豆全生命周期的生成式AI育种平台,旨在推动大豆育种从传统的经验驱动模式向数据辅助决策模式转变,为破解大豆单产提升难题提供智能化技术路径。其初代版本于2026年2月完成构建,2.0版本在此基础上围绕大豆产业关键瓶颈进行了全面迭代升级。

丰菽2.0特点
- 多模型协同验证:2.0版本最核心的升级在于引入多模型协同分析机制。系统嵌入多个通用大模型接口,对同一专业问题进行并行解答,再由”丰菽”的总结模块结合领域知识、私有数据和结构化比对规则,对各模型回答中的共识、差异及证据完整性进行交叉验证,显著降低单一模型”幻觉”带来的偏差。
- 超大规模专业数据底座:整合超过1000万字专业文本、1万篇以上科研文献与专利,构建包含2万个实体、10万条关系的大豆领域知识图谱,并融合8000份基因组重测序数据、约4万份种质资源和3000份以上品种表型数据,数据清洗与标注准确率达98%。
- 高预测准确率:据研发团队测试,模型对大豆抗倒伏、抗病、蛋白含量等关键农艺性状的预测准确率超过90%,数据处理效率较传统方式提升40%以上。
- 全流程覆盖:从基础研究到育种实践形成完整闭环,涵盖知识查询、基因分析、文献检索、病害诊断、表型解析、育种设计六大环节。
丰菽2.0技术原理
“丰菽”2.0的技术架构可从数据层、模型层和应用层三个维度理解:
数据层——多模态知识融合
系统整合了八大类核心数据:种质资源数据、基因组与编码序列、蛋白质结构、转录本信息、基因表达图谱、病害样本库、育种试验记录及中外文献资料。这些数据经过清洗、标注与结构化处理后,形成面向大豆科研的统一知识体系。底层知识图谱包含2万个实体和10万条关系,将分散的基因型、表型、文献知识连接为可推理的网络。
模型层——多模型协同分析机制
这是2.0版本的核心技术创新。当用户提出一个专业问题时,系统同时调用多个通用大模型分别生成答案;随后,”丰菽”的总结模块介入,结合大豆领域私有知识库和结构化比对规则,对各模型输出进行三方比对:提取共识点、分析分歧点、评估证据完整性,最终综合输出经交叉验证的专业结论。这一机制有效过滤了单一模型可能产生的错误推演,大幅提升专业结论的可靠性。
应用层——深度学习辅助决策
在育种预测环节,模型通过深度学习算法自动识别与抗病、高产、高蛋白等重要性状关联的基因位点,预测其组合效应。在虚拟育种试验中,系统可在数秒内完成传统方法需要数月才能完成的亲本筛选与组合设计,大幅缩短育种周期。
丰菽2.0功能
“丰菽”2.0集成了六大核心功能模块,覆盖大豆科研全链条:
- 豆百科:提供大豆基础知识查询,涵盖品种特性、栽培要点、产业概况等结构化知识服务;
- 豆分子:进行分子标记辅助育种和候选基因功能分析,自动识别与重要农艺性状关联的基因位点;
- 豆文献:实现科研文献智能检索与解读,从海量中英文育种文献中快速提取关键信息;
- 豆病害:完成病害智能诊断,支持田间影像识别大豆花叶病、根腐病等常见病害并给出防控方案;
- 豆表型:解析表型数据,支持手机拍摄植株照片即可实现表型自动提取与”随拍随诊”;
- 豆育种:辅助育种亲本筛选、虚拟杂交组合设计与后代性状预测,优化育种方案。
丰菽2.0应用场景
- 科研院所育种团队:利用虚拟杂交组合预测试验,AI提前淘汰大量无潜力的杂交组合,科研人员集中资源投入高潜力材料,将传统6—10年的育种周期显著压缩,降低田间重复试验成本。
- 种质资源挖掘:从约4万份种质资源库中,根据育种目标(高油、高蛋白、抗倒伏、抗病等)自动智能匹配潜力亲本,实现优异等位基因的高效挖掘。
- 田间病害防控:基层农技人员通过移动端拍摄大豆植株照片,即可快速完成病害识别与防控建议获取,解决传统依赖专家经验、响应滞后的问题。
- 种业企业品种选育:结合不同大豆主产区(黑龙江、黄淮海、南方等)的气候、土壤及种植模式,定制优化育种方案,助力培育高产、优质、抗逆的大豆新品种。
- 科研数据分析与文献管理:自动化处理多组学数据、归纳试验结果、辅助撰写育种方案,减少科研人员的重复性工作,将精力集中于核心决策环节。
“丰菽”2.0的出现,标志着我国大豆育种正式迈入”AI辅助+数据驱动”的新阶段。研发团队下一步将在国内大豆主产区推进田间试点验证,持续扩充区域数据并优化算法,推动人工智能从实验室真正走向田间,为我国大豆产能提升和粮油安全保障提供科技支撑。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...



