Evaluación de Modelos
Si te gusta aplicar Evaluación de Modelos, cada reto aquí te da la oportunidad de practicarlo en un briefing industrial real.
- CodeIntermedioNuevo
Modelo de Riesgo de Mora para una Cooperativa de Crédito en Medellín
Recibes 80.000 expedientes históricos anonimizados con 24 features socioeconómicas y de historial crediticio, etiquetados con mora a 90 días. Construye un pipeline completo: spl…
- Classification
- Feature Engineering
- Model Evaluation
Multidisciplinar - AnalysisIntermedioNuevo
Modela rutas de pacientes con un HMM en aseguradora médica
Recibes 42.000 trayectorias de pacientes con diabetes tipo 2, cada una con secuencias mensuales de eventos categóricos (consulta primaria, urgencias, cambio de medicación, prueb…
- Hidden Markov Models
- Sequence Modeling
- Probabilistic Inference
Multidisciplinar - CodeIntermedioNuevo
Predice la demanda diaria para una distribuidora de aceite en Jaén
Recibes 36 meses de ventas anonimizadas (~2,1 millones de filas, SKU × tienda × día). Construye features de calendario (festivos andaluces, semana santa, fines de mes), variable…
- Time Series Forecasting
- Gradient Boosting
- Feature Engineering
Machine Learning - CodePrincipianteNuevo
MRF para segmentación de cultivos en agritech satelital
En equipo de 2-3, recibes 600 mosaicos Sentinel-2 (10m/píxel) con probabilidades por píxel del CNN (4 clases: sano, estrés hídrico, enfermo, suelo) y máscaras de verdad-terreno …
- Markov Random Fields
- Probabilistic Inference
- Image Segmentation
Probabilistic Graphical Models Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodeIntermedioNuevo
Adapta un clasificador few-shot para una startup biotech de Barcelona
Recibes un meta-train set de 60 tareas (clasificación binaria sobre cultivos similares, ~500 imágenes/tarea) y 10 tareas meta-test con solo 5 ejemplos por clase (5-shot) y query…
- Meta Learning
- Few Shot Learning
- Prototypical Networks
Meta-Learning, Transfer Learning, and Multi-Task Learning - CodeIntermedioNuevo
Diseña aprendizaje multi-tarea para una fintech en Bogotá
Recibes 250.000 clientes anonimizados con features compartidas (uso, antigüedad, saldo, demografía) y las 3 etiquetas. Construye una red multi-tarea con shared encoder + 3 cabez…
- Multi Task Learning
- Transfer Learning
- Loss Balancing
Multidisciplinar - AnalysisPrincipianteNuevo
Compara modelos de aprendizaje supervisado para predecir cancelaciones en un gimnasio
Recibirás el dataset (32.000 filas, 28 features, etiqueta cancelación en 30 días). Harás análisis exploratorio, ingeniería de features básica (no de juguete) y dividirás en trai…
- Supervised Learning
- Feature Engineering
- Model Evaluation
Multidisciplinar - AnalysisIntermedioNuevo
Auditoría de equidad de un modelo de scoring laboral
Recibes el modelo (en formato serializado), una muestra anonimizada de 50.000 candidaturas con su score y atributos sensibles (sexo, grupo de edad, origen). Mide al menos cuatro…
- Fairness Measurement
- Model Evaluation
- Ai Governance
Multidisciplinar - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- CodeIntermedioNuevo
Pronostica demanda con procesos gaussianos en bodega chilena
Recibes 5 años de ventas mensuales para 60 SKUs, precio promedio, mes y un indicador de evento promocional. Para los 20 SKUs principales ajusta un GP con kernel compuesto (RBF +…
- Gaussian Processes
- Bayesian Inference
- Time Series
Probabilistic Machine Learning - CodeSéniorNuevo
Política End-to-End de Conducción para un Reto de Karting Autónomo
Recibes 12 horas de demos del piloto humano (cámara frontal a 30 Hz + comandos), una pista replicada en CARLA y un baseline PID. Entrena una política de imitación (CNN ligera ti…
- Imitation Learning
- End To End Learning
- Pytorch
AI for Autonomous Vehicles - AnalysisSéniorNuevo
Modelo de Predicción de Defectos para un ERP en São Paulo
Extrae métricas por archivo Java (líneas, complejidad ciclomática, número de autores, frecuencia de cambio, edad, número de bugs históricos asociados) desde Git y Jira de los úl…
- Defect Prediction
- Feature Engineering
- Model Evaluation
Software Testing and Quality Assurance - CodeFundamentosNuevo
Detector de Defectos en Conservas para una Industria de Murcia
Recibes 1.500 imágenes etiquetadas (defectuosas / aceptables) de producto en el formato exacto antes del cierre. Construye un pipeline clásico: segmentación del producto vs fond…
- Image Processing
- Feature Extraction
- Classification
Computer Vision (Undergraduate) Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- CodeIntermedioNuevo
Plataforma de evaluación humana para LLMs en producto
Construye una plataforma web con backend en Python y frontend en React. Soporta tres tipos de evaluación: comparación pareada A/B, escala Likert sobre criterios definidos y libr…
- Software Engineering
- Human Evaluation
- Full Stack Development
AI Software Engineering Group Project - CodeIntermedioNuevo
Aplica privacidad diferencial a un modelo de scoring para una banca IBEX-35
Recibirás un dataset anonimizado de 800.000 solicitudes de crédito y un baseline (red neuronal entrenada normalmente). Implementa DP-SGD con Opacus sobre PyTorch para tres presu…
- Differential Privacy
- Dp Sgd
- Pytorch
Privacy-Preserving Machine Learning - CodeSéniorNuevo
Fusión LiDAR-cámara para detección de personas en mina autónoma
Recibes un dataset etiquetado con 8.000 cuadros de un tajo simulado y 2.000 cuadros reales grabados en una mina del norte de Chile, cada uno con nube de puntos LiDAR sincronizad…
- Sensor Fusion
- Lidar Processing
- Object Detection
Robot Perception and Autonomy - CodeIntermedioNuevo
Razonamiento visual para auditar etiquetado vial en delivery autónomo
Recibes 800 imágenes frontales de robot etiquetadas con respuestas a 12 preguntas estructuradas (¿hay rampa?, ¿hay peatón en la calzada?, ¿semáforo en verde?, etc.) y 200 imágen…
- Visual Question Answering
- Multimodal LLM
- Lora Fine Tuning
Visual Intelligence and Visual Reasoning - CodeIntermedioNuevo
Diagnostica fallos de prensa con una red bayesiana
Recibes una tabla con 38 sensores muestreados al minuto, etiquetas de defecto por bobina (4 clases) y 240 incidencias narradas por mantenimiento. Discretiza las variables contin…
- Bayesian Networks
- Structure Learning
- Probabilistic Inference
Probabilistic Graphical Models - CodeIntermedioNuevo
Construye un detector de fraude end-to-end para una neobanca mexicana
Recibirás un dataset anonimizado de 1,2 millones de transacciones (3 % positivas) con metadatos de dispositivo, comercio y velocidad. Debes construir el pipeline completo: inges…
- Supervised Learning
- Feature Engineering
- Model Evaluation
AI/ML Practicum and Hands-on Lab - CodeIntermedioNuevo
Clasifica reclamaciones de seguros con un modelo de lenguaje afinado
Recibirás 18.000 reclamaciones anonimizadas etiquetadas (urgencia 1-3, ramo en 12 categorías, flag fraude). Diseñarás el preprocesamiento de texto. Afinarás 2 modelos pre-entren…
- Deep Learning
- Transfer Learning
- NLP
Multidisciplinar - ResearchIntermedioNuevo
Evaluación end-to-end de un sistema LLM en producción
Recibes acceso a 2.000 conversaciones reales anonimizadas con su resolución, encuestas de satisfacción de clientes y métricas operativas (tiempo medio, escalado humano). Diseña …
- Model Evaluation
- Human Evaluation
- LLM Agents
AI Measurement and Evaluation - AnalysisPrincipianteNuevo
Auditoría de seguridad del módulo de detección de un vehículo autónomo
Recibes acceso al modelo de detección de peatones del cliente (caja negra: solo inferencia, no pesos), un dataset interno de 12.000 cuadros etiquetados y permiso para ejecutar p…
- Model Evaluation
- Adversarial Testing
- Safety Analysis
Robot Perception and Autonomy - ResearchIntermedioNuevo
Diseño de un benchmark interno para asistentes de código
Recibes una lista de 60 tareas reales recientes del backlog (15 por cuatro categorías: bugfix, feature pequeña, refactor, test). Diseña un protocolo con tres condiciones (asiste…
- Experimental Design
- Model Evaluation
- Benchmarking
Multidisciplinar - CodePrincipianteNuevo
Clasificador de Tickets de Soporte para una SaaS de Málaga
Recibes 40.000 tickets históricos en español con la categoría asignada por agentes humanos (con ruido conocido — la propia gerencia estima un 8% de errores de etiquetado). Limpi…
- Text Classification
- Embeddings
- Model Evaluation
Applied Machine Learning - CodeIntermedioNuevo
Etiquetado activo asistido por modelo para visión embarcada en AR/VR
Recibes un pool de 8.000 frames sin etiquetar de una sesión de mantenimiento real (anonimizada) y 500 frames etiquetados como semilla. Entrena un modelo base de detección 3D lig…
- Active Learning
- Object Detection
- Human In The Loop
Visual Intelligence and Visual Reasoning
Cómo funciona
Del briefing al certificado, en seis pasos.
Paso 01
Explora retos alineados con tus estudios.
Paso 02
Acepta el que encaja con tus metas.
Paso 03
Trabájalo con la guía del AI Copilot.
Paso 04
Envíalo para una evaluación estructurada.
Paso 05
Consigue una credencial verificada.
Paso 06
Añádela a LinkedIn con un solo clic.
Equipos del sector tras una década de briefings prácticos
¿Reclutando de este grupo?
Patrocina un reto y conoce candidatos a través de su trabajo real.
Los equipos de la industria pueden diseñar briefings en torno a las habilidades que buscan, y evaluar a los estudiantes por entregables puntuados con rúbrica — no por currículums.



















































































