Visión general
De qué trata este proyecto.
Implementarás PPO en Isaac Gym para entrenar un cuadrúpedo con currículo de terreno y superar al baseline MPC. Obtienes un certificado verificable.
El escenario
El grupo de I+D (28 personas) busca diferenciarse en mercados latinoamericanos de inspección minera; cada terreno donde fallan limita su mercado direccionable.
El Briefing
Lo que harás y lo que demostrarás.
Entrenar una política de locomoción RL que supere al baseline MPC en terrenos irregulares y demuestre readiness para sim-to-real.
Earning criteria — what you'll demonstrate
- Diseñar entrenamientos RL en simuladores paralelos modernos
- Aplicar currículos de dificultad para acelerar convergencia
- Usar domain randomization para mejorar transferencia sim-to-real
- Evaluar políticas de control con métricas operativas, no solo recompensa
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
Alineación con asignaturas próximamente.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Reinforcement Learning
Apply reinforcement learning to solve real industry problems and demonstrate production-level capability.
- Learning Based Control
Apply learning based control to solve real industry problems and demonstrate production-level capability.
- Isaac Gym
Apply isaac gym to solve real industry problems and demonstrate production-level capability.
- Pytorch
Apply pytorch to solve real industry problems and demonstrate production-level capability.
- Domain Randomization
Apply domain randomization to solve real industry problems and demonstrate production-level capability.
- Sim To Real
Apply sim to real to solve real industry problems and demonstrate production-level capability.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Research Scientist
Entrenar RL para locomoción cuadrúpeda en simulación paralela y compararla con MPC es el formato estándar de los papers recientes de RSS o CoRL en el área.
Este proyecto afina
- reinforcement-learning
- learning-based-control
- isaac-gym
ML Researcher
Diseñar currículos y randomizaciones que generalicen es exactamente lo que entrena el reto y se espera de quien publica en RL aplicado.
Este proyecto afina
- reinforcement-learning
- domain-randomization
- isaac-gym
AI Engineer
Llevar políticas RL a un plan creíble de despliegue en hardware es trabajo AI Engineer en robótica de campo.
Este proyecto afina
- pytorch
- domain-randomization
- sim-to-real