Optimiza el ruteo de un brazo robótico con Q-learning tabular
Visión general
De qué trata este proyecto.
Discretiza el espacio de configuración de un brazo robótico y entrena Q-learning tabular para superar una heurística greedy. Obtén un certificado verificable.
El escenario
La empresa (35 personas, factura ~5,8M EUR) vende cada integración como proyecto y cada hora de reprogramación reduce su margen; demostrar un PoC (Proof of Concept — prueba de concepto) creíble de aprendizaje por refuerzo le abre conversaciones con clientes Tier-1.
El Briefing
Lo que harás y lo que demostrarás.
Aprender trayectorias eficientes en un brazo simulado con Q-learning tabular, superando a una heurística en 12 piezas distintas.
Earning criteria — what you'll demonstrate
- Modelar un problema robótico como MDP (Markov Decision Process)
- Aplicar Q-learning tabular con epsilon-greedy y decay
- Comparar RL (Reinforcement Learning — aprendizaje por refuerzo) contra heurística
- Diagnosticar cuándo el espacio de estado es demasiado grande para tabular
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
Alineación con asignaturas próximamente.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Reinforcement Learning
Apply reinforcement learning to solve real industry problems and demonstrate production-level capability.
- Q Learning
Apply q learning to solve real industry problems and demonstrate production-level capability.
- Mdp Modeling
Apply mdp modeling to solve real industry problems and demonstrate production-level capability.
- Python
Write clean, efficient Python for data processing, automation, and backend services.
- Evaluation
Apply evaluation to solve real industry problems and demonstrate production-level capability.
- Simulation
Apply simulation to solve real industry problems and demonstrate production-level capability.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Ingeniero/a de Machine Learning
Aplicar Q-learning a un problema robótico real con comparación honesta contra heurísticas es exactamente el trabajo de un MLE junior en robótica industrial.
Este proyecto afina
- reinforcement-learning
- q-learning
- python
Científico/a Aplicado/a de IA
Modelar un MDP industrial y demostrar valor incremental sobre heurística es el día a día del applied AI scientist en robotics y manufactura.
Este proyecto afina
- mdp-modeling
- reinforcement-learning
- evaluation
Investigador/a de Machine Learning
Analizar sample efficiency y proponer siguientes pasos (DQN, function approximation) es la franja research-oriented del MLE.
Este proyecto afina
- reinforcement-learning
- evaluation
- simulation