Evaluación de Modelos
Si te gusta aplicar Evaluación de Modelos, cada reto aquí te da la oportunidad de practicarlo en un briefing industrial real.
- CodeIntermedioNuevo
Detección de Fraude en Pagos para una Pasarela Brasileña
Recibes 12 meses de transacciones anonimizadas (alrededor de 42 millones de filas) con etiqueta de fraude confirmado y un dataset adicional de chargebacks pendientes (etiqueta r…
- Fraud Detection
- Imbalanced Classification
- Feature Engineering
Applied Machine Learning - CodeIntermedioNuevo
Predecir rendimiento solar con kernels gaussianos
Dispondrás de 3 años de series horarias por planta (producción + meteorológicas + estado de inversores) y previsiones meteorológicas de un proveedor externo. Implementarás un pr…
- Kernel Methods
- Gaussian Processes
- Probabilistic Forecasting
Advanced Machine Learning - CodeIntermedioNuevo
Agente conversacional asistente para soporte interno con razonamiento
Recibes una base de 400 documentos internos y 80 preguntas reales con respuesta correcta etiquetada. Diseña un agente que combine recuperación (embeddings + búsqueda vectorial) …
- LLM Agents
- Retrieval Augmented Generation
- Prompt Engineering
Artificial Intelligence: Principles and Techniques - AnalysisPrincipianteNuevo
Inferencia variacional sobre tickets de soporte SaaS
Recibes ~84.000 tickets etiquetados solo por canal (chat, email, in-app). Limpia y tokeniza con preservación bilingüe (es/en), ajusta LDA con inferencia variacional para K en {1…
- Variational Inference
- Topic Modeling
- NLP
Probabilistic Graphical Models Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodeSéniorNuevo
Política End-to-End de Conducción para un Reto de Karting Autónomo
Recibes 12 horas de demos del piloto humano (cámara frontal a 30 Hz + comandos), una pista replicada en CARLA y un baseline PID. Entrena una política de imitación (CNN ligera ti…
- Imitation Learning
- End To End Learning
- Pytorch
AI for Autonomous Vehicles - ResearchSéniorNuevo
Bayesian deep learning para diagnóstico médico con incertidumbre
En equipo de 2-3, recibes 12.000 imágenes de fondo de ojo etiquetadas en 4 clases (sin retinopatía, leve, moderada, severa). Compara tres enfoques: (1) CNN base + softmax, (2) M…
- Bayesian Deep Learning
- Uncertainty Quantification
- Deep Learning
Probabilistic Machine Learning - CodeIntermedioNuevo
Entrenamiento distribuido del scoring de riesgo en banca minorista
Recibes un subconjunto anonimizado de 20 millones de operaciones y un cluster Spark con 8 nodos para los experimentos. Diseña la pipeline en dos fases: ingeniería de features di…
- Distributed Training
- Spark
- Xgboost
Machine Learning at Scale - AnalysisPrincipianteNuevo
Auditoría de seguridad del módulo de detección de un vehículo autónomo
Recibes acceso al modelo de detección de peatones del cliente (caja negra: solo inferencia, no pesos), un dataset interno de 12.000 cuadros etiquetados y permiso para ejecutar p…
- Model Evaluation
- Adversarial Testing
- Safety Analysis
Robot Perception and Autonomy - Browse challenges
Explore role
Marketing Analyst
Plan and measure campaigns that grow the business. Funnel analytics, attribution, segmentation, and the rigorous measurement that lets marketing defend its budget at the leadership table.
- CodePrincipianteNuevo
Clasificador de Tickets de Soporte para una SaaS de Málaga
Recibes 40.000 tickets históricos en español con la categoría asignada por agentes humanos (con ruido conocido — la propia gerencia estima un 8% de errores de etiquetado). Limpi…
- Text Classification
- Embeddings
- Model Evaluation
Applied Machine Learning - ResearchIntermedioNuevo
Reproducción de un resultado del estado del arte en visión
Elige (entre tres opciones proporcionadas) un paper reciente del estado del arte en clasificación de imágenes con código y datasets públicos. Reproduce el experimento principal …
- Reproducibility
- Model Evaluation
- Deep Learning
AI Measurement and Evaluation - CodePrincipianteNuevo
Predice la demanda de turnos en una clínica dental con XGBoost
Recibirás 24 meses de histórico anonimizado (turnos, especialidad, sede, marketing, festivos, clima). Construirás features temporales (lags, medias móviles, festivos), evaluarás…
- Supervised Learning
- Feature Engineering
- Model Evaluation
Machine Learning (CS Elective) - AnalysisIntermedioNuevo
Auditoría de equidad de un modelo de scoring laboral
Recibes el modelo (en formato serializado), una muestra anonimizada de 50.000 candidaturas con su score y atributos sensibles (sexo, grupo de edad, origen). Mide al menos cuatro…
- Fairness Measurement
- Model Evaluation
- Ai Governance
Multidisciplinar Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- CodeFundamentosNuevo
Entrena una red neuronal pequeña para clasificar dígitos manuscritos
Trabaja primero con MNIST (60.000 ejemplos de entrenamiento, 10.000 de test). Construye una red feed-forward de dos capas ocultas con activaciones ReLU (Rectified Linear Unit — …
- Neural Networks
- Backpropagation
- Model Evaluation
Machine Learning (Undergraduate) - CodePrincipianteNuevo
Segmentación de Hojas de Olivo Enfermas en Jaén
Recibes 2.400 fotos anotadas con máscara de zona afectada y etiqueta de enfermedad (tres clases + sana). Entrena un U-Net ligero (encoder MobileNetV3 small o ResNet18) para segm…
- Semantic Segmentation
- Cnn
- Deep Learning
Multidisciplinar - ResearchIntermedioNuevo
Diseño de un benchmark interno para asistentes de código
Recibes una lista de 60 tareas reales recientes del backlog (15 por cuatro categorías: bugfix, feature pequeña, refactor, test). Diseña un protocolo con tres condiciones (asiste…
- Experimental Design
- Model Evaluation
- Benchmarking
Multidisciplinar - CodeIntermedioNuevo
Adaptación de un reconocedor neuronal al español rioplatense para asistente bancario
Recibes un modelo base abierto (Whisper small en español o un Wav2Vec2 fine-tuneado al español), un dataset interno anonimizado de 60 horas de audio rioplatense con transcripcio…
- Speech Recognition
- Fine Tuning
- Lora
Multidisciplinar - CodeIntermedioNuevo
Benchmark estadísticamente honesto para clasificadores de texto en español
Recibes cinco modelos (regresión logística sobre TF-IDF, fastText, RoBERTa multilingüe, mBERT, modelo open-source español tipo BETO) y tres conjuntos en español de clasificación…
- Model Evaluation
- Statistical Testing
- NLP
Multidisciplinar - CodePrincipianteNuevo
Imitation learning para pick-and-place en línea de envasado
Recibes 200 demostraciones del operador (trayectorias estado-acción) sobre 4 variantes de frasco capturadas en simulación PyBullet calibrada. Implementa behavior cloning con red…
- Imitation Learning
- Behavior Cloning
- Robot Learning
Robot Learning - ResearchIntermedioNuevo
Diseño de evaluaciones de capacidad para un modelo open-source
Elige uno de los tres modelos open-source proporcionados. Diseña un conjunto de evaluaciones que cubra cinco capacidades: razonamiento numérico, generación y depuración de códig…
- LLM Agents
- Capability Evaluation
- Experimental Design
Multidisciplinar - CodeIntermedioNuevo
Detección de fraude por red de llamadas en una telco LATAM
Recibes una semana de Call Detail Records (CDR) anonimizados con cerca de 3.000 millones de aristas (origen, destino, marca de tiempo, duración) y un conjunto de etiquetas de fr…
- Graph Features
- Fraud Detection
- Xgboost
Multidisciplinar - AnalysisIntermedioNuevo
Modela progresión de diabetes para una aseguradora en Ciudad de México
Recibes histórico anonimizado de 80.000 asegurados con HbA1c, IMC, glucosa en ayunas, edad y comorbilidades en hasta 5 visitas. Construye dos modelos: (a) clasificador binario s…
- Survival Analysis
- Disease Progression
- Longitudinal Data
Machine Learning for Healthcare and Biomedicine - ResearchSéniorNuevo
Detección de retinopatía diabética con calibración de incertidumbre
Recibes 6.000 retinografías anonimizadas etiquetadas en la escala internacional de gravedad (0 a 4) y un conjunto de validación adicional de 800 imágenes. Entrena un modelo de c…
- Medical Image Classification
- Uncertainty Calibration
- Vision Transformers
Visual Intelligence and Visual Reasoning - CodeIntermedioNuevo
Etiquetado activo asistido por modelo para visión embarcada en AR/VR
Recibes un pool de 8.000 frames sin etiquetar de una sesión de mantenimiento real (anonimizada) y 500 frames etiquetados como semilla. Entrena un modelo base de detección 3D lig…
- Active Learning
- Object Detection
- Human In The Loop
Visual Intelligence and Visual Reasoning - CodeIntermedioNuevo
Predice la demanda diaria para una distribuidora de aceite en Jaén
Recibes 36 meses de ventas anonimizadas (~2,1 millones de filas, SKU × tienda × día). Construye features de calendario (festivos andaluces, semana santa, fines de mes), variable…
- Time Series Forecasting
- Gradient Boosting
- Feature Engineering
Machine Learning
Cómo funciona
Del briefing al certificado, en seis pasos.
Paso 01
Explora retos alineados con tus estudios.
Paso 02
Acepta el que encaja con tus metas.
Paso 03
Trabájalo con la guía del AI Copilot.
Paso 04
Envíalo para una evaluación estructurada.
Paso 05
Consigue una credencial verificada.
Paso 06
Añádela a LinkedIn con un solo clic.
Equipos del sector tras una década de briefings prácticos
¿Reclutando de este grupo?
Patrocina un reto y conoce candidatos a través de su trabajo real.
Los equipos de la industria pueden diseñar briefings en torno a las habilidades que buscan, y evaluar a los estudiantes por entregables puntuados con rúbrica — no por currículums.



















































































