Financiado por Airbus Defence and Space S.A.U
Este proyecto pretende desarrollar un sistema de planificación de trayectorias basado en el aprendizaje para UAVs que operen en entornos complejos con múltiples agentes, obstáculos dinámicos y obstáculos estáticos. Los planificadores tradicionales basados en la optimización, aunque precisos, suelen ser costosos computacionalmente y frágiles en entornos dinámicos. Para abordar estas limitaciones, el enfoque propuesto aprovecha el aprendizaje por imitación para inicializar una política de aprendizaje por refuerzo, combinando la eficiencia de los comportamientos aprendidos con la adaptabilidad del aprendizaje por refuerzo. Este método híbrido permite una planificación de trayectorias rápida, robusta y escalable, capaz de manejar la incertidumbre y la compleja dinámica de los UAV en tiempo real.
Resumen divulgativo: Este proyecto enseña a los drones a volar con seguridad alrededor de obstáculos dinámicos y estáticos, y de otros drones, aprendiendo de los ejemplos y la práctica. El objetivo es tomar decisiones rápidas e inteligentes en entornos complejos y cambiantes.
Técnicas utilizadas: Aprendizaje por refuerzo, optimización de trayectorias, splines
Airbus_AI