Mejora del modelado de plantas con aprendizaje automático

[ad_1]

La integración del aprendizaje automático y el modelado de cultivos puede optimizar las predicciones sobre el crecimiento y el rendimiento de los cultivos.

A medida que empeora el cambio climático, los científicos están trabajando para encontrar los métodos, algoritmos o modelos más potentes para simular los efectos de las altas temperaturas y/o la disponibilidad limitada de agua en el crecimiento, desarrollo y productividad de las plantas. La complejidad de las interacciones planta-entorno complica esto, pero una nueva investigación ha demostrado que la integración del aprendizaje automático y el modelado de plantas puede proporcionar las respuestas necesarias.

dr. Ioannis Droutsas, investigador de la Universidad de Leeds, y los coautores han integrado algoritmos de aprendizaje automático (ML) en un modelo de cultivo basado en procesos para crear un nuevo marco de modelado de cultivos/ML con alto rendimiento en la representación de la respuesta del cultivo a una amplia gama para crear una variedad de entornos, incluidas condiciones estresantes.

Los autores modificaron el modelo de cultivo existente basado en procesos GLAM-Parti incorporando algoritmos de aprendizaje automático para estimar variables que normalmente eluden la capacidad predictiva del modelo de cultivo. . ML se utilizó para las predicciones diarias de la eficiencia del uso de la radiación, la tasa de cambio del índice de cultivo y la etapa fenológica.

Para la evaluación del nuevo marco GLAM-Parti-ML, los autores utilizaron un conjunto de datos existente para una variedad de trigo cultivada en un amplio rango de temperatura, radiación solar y humedad, incluido el estrés por calor. La mitad de los datos se utilizó para entrenar los algoritmos de aprendizaje automático y la otra mitad para probar el modelo.

El modelo se ejecutó con los datos meteorológicos de temperatura, radiación solar y déficit de presión de vapor, los determinantes climáticos clave del crecimiento del trigo en condiciones de riego y buena fertilización. Los resultados de rendimiento de biomasa y grano, así como los días de floración y madurez, se compararon con las mediciones de campo al final de la temporada.

Un diagrama de flujo que muestra la metodología para integrar ML en GLAM parti. El conjunto de datos se divide en tratamientos de entrenamiento y de prueba. Los datos de cosecha de los tratamientos de entrenamiento se utilizan para hacer coincidir las series temporales de biomasa y rendimiento, que luego derivan las variables objetivo RUE y dHI/dt para el entrenamiento de Random Forests (RF) y XGBoost. Los tratamientos de prueba se utilizan al evaluar fiestas GLAM con RF y XGBoost respectivamente.
Metodología para integrar ML en GLAM parti.

El equipo aplicó Random Forests y Extreme Gradient Boost. Ambos modelos ML mostraron una alta eficiencia en el aprendizaje de los patrones entre los insumos y el rendimiento de la planta (en términos de eficiencia en el uso de la radiación) durante la temporada de crecimiento. Esto dio como resultado una buena capacidad de modelado para la biomasa vegetal; GLAM-Parti-ML reprodujo el 98 % de la varianza observada tanto en biomasa como en rendimiento de grano, y el error del modelo fue inferior al 20 %. Además, el modelo reprodujo al menos el 98 % de la variación observada en días hasta la floración y madurez con menos del 11 % de error. Sin embargo, se subestimó el inicio de ambas etapas fenológicas, prediciendo la antesis y la madurez antes de lo observado.

Se muestran cuatro figuras. Los gráficos de barras emparejados comparan la biomasa observada y prevista, el rendimiento de grano, la emergencia hasta la antesis y la emergencia hasta la madurez. Todos tienen 12 cepas en el eje x y una línea vertical roja en el medio que indica que 6 de las cepas se usan para entrenar bosques aleatorios y las otras 6 son tratamientos que se usan para probar modelos. El eje y del panel A es la biomasa en toneladas por hectárea de 0 a 20. La biomasa de tres de las variedades de entrenamiento y una variedad de prueba es de alrededor de 5 toneladas por hectárea, mientras que la cifra para otras variedades es de alrededor de 10 toneladas por hectárea. Los valores de predicción de entrenamiento se sobreestiman y subestiman uniformemente, mientras que los valores de prueba indican predicciones subestimadas. El eje y de la Figura B es el rendimiento de grano en toneladas por hectárea de 0 a 8. La biomasa de dos de las variedades de entrenamiento y una variedad de prueba es de alrededor de 1 tonelada por hectárea, mientras que la cifra para otras variedades es de alrededor de 5 toneladas por hectárea. Los valores de predicción de entrenamiento se sobreestiman y subestiman uniformemente, mientras que los valores de prueba indican predicciones subestimadas. El eje y de la figura C es la emergencia hasta la antesis de 0 a 100 días. La fecha de antesis varía tanto para las variedades de entrenamiento como para las de prueba, oscilando entre 50 y 100 días. Los valores predichos de entrenamiento son iguales a los valores observados, mientras que los valores de prueba muestran predicciones subestimadas. El eje Y para el Panel D es el período inicial hasta el vencimiento de 0 a 150 días. La fecha de maduración varía tanto para las variedades de entrenamiento como para las de prueba, entre 75 y 150 días. Los valores predichos de entrenamiento son iguales a los valores observados, mientras que los valores de prueba muestran predicciones que en su mayoría están subestimadas.
Comparación entre los valores observados y los simulados por GLAM-Parti para una variedad de trigo cultivada en un amplio rango de temperaturas, insolación y humedad, incluido el estrés por calor. Las líneas rojas verticales separan los tratamientos para el entrenamiento de bosque aleatorio (a la izquierda de la línea roja) y los tratamientos para la prueba del modelo (a la derecha de la línea roja).

A continuación, GLAM-Parti se comparó con su predecesor GLAM, un modelo de recolección basado en procesos sin integración de aprendizaje automático. GLAM se calibró con el 100% de los datos y GLAM parti con solo el 50%. Aún así, GLAM-Parti-ML tuvo valores de error más bajos para biomasa, rendimiento y días hasta la madurez y antesis, lo que indica que las parametrizaciones de aprendizaje automático mejoraron el modelo a pesar de que solo se entrenó con la mitad de los datos.

Para evaluar más a fondo GLAM-Parti-ML, los autores utilizaron un segundo conjunto de datos de tres variedades de trigo cultivadas en muchos ensayos de campo en seis países. Nuevamente, la mitad de los datos se usaron para entrenar los algoritmos de aprendizaje automático y la otra mitad para probar el modelo.

Se muestran cuatro figuras. Los diagramas de dispersión comparan la biomasa observada y prevista, el rendimiento de grano, la emergencia hasta la floración y las fechas de emergencia hasta la madurez para el trigo cultivado en 4 países. Los ejes de la Figura A son la biomasa en toneladas por hectárea de 0 a 15. El valor de R cuadrado es 0,73. Los ejes Y del Panel B son rendimientos de grano en toneladas por hectárea de 0 a 7,5. El valor de R cuadrado es 0,76. Los ejes para el panel C son de emergencia a antesis de 0 a 100 días. El valor de R cuadrado es 0,66. Los ejes de la figura son desde la emergencia hasta la madurez de 0 a 120 días. El valor de R cuadrado es 0,79.
Comparación entre los valores observados y simulados por GLAM-Parti para tres variedades de trigo cultivadas en muchos ensayos de campo en seis países.

Una vez más el modelo mostró un excelente desempeño. Reprodujo el 73% de la variación de biomasa entre sitios y variedades con 15% de error y el 76% de la variación de rendimiento de grano con 16% de error. La fenología de la planta fue más precisa para los días hasta la madurez (9,9 % de error) que para la antesis (13,2 % de error). Nuevamente, hubo un sesgo negativo en la predicción de ambas etapas fenológicas.

Droutsas concluye: “Usar un conjunto de datos de entrenamiento más grande mejoraría significativamente las simulaciones del modelo. Sin embargo, solo hay unos pocos conjuntos de datos con las medidas requeridas”.

LEER EL ARTÍCULO:

Ioannis Droutsas, Andrew J Challinor, Chetan R Deva, Enli Wang, Integración del aprendizaje automático en el modelado basado en procesos para mejorar la simulación de respuestas complejas de cultivos, in silico Plants, 2022, diac017, https://doi.org/10.1093/insilicoplants /diac017

[ad_2]

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Subir