Data Science
Científico de Datos
Entre una investigadora y una ingeniera de software se encuentra la científica de datos, la persona que responde preguntas que la empresa no sabía muy bien cómo formular. El trabajo combina estadística, programación y una negativa obstinada a aceptar explicaciones fáciles.
Una semana podrías diseñar un experimento para medir si una nueva característica realmente genera más uso, y la siguiente podrías construir un modelo de pronóstico que defina el plan de contratación del próximo año. Los estudiantes que disfrutaban tanto la clase de matemáticas como redactar ensayos suelen prosperar.
Herramientas como Python y PyMC se convierten en compañeras diarias, pero la habilidad más profunda es hacer la pregunta correcta. La excelencia se ve en una recomendación que se mantiene vigente seis meses después porque el razonamiento causal subyacente era sólido.
Problem framing + experimental design + defending methodology to non-technical audiences are exactly the parts of the role AI augments but doesn't replace.
US$134,855 salario mediano en United States¹
- AnalysisPrincipianteNuevo
Segmentación de clientes para banco minorista hispano
Diseña features comportamentales agregadas por cliente (frecuencia, recencia, monto, mezcla de categorías de gasto, estacionalidad). Aplica al menos 2 técnicas (K-Means + cluste…
- Clustering
- Feature Engineering
- Customer Segmentation
Data Mining and Information Retrieval - AnalysisIntermedioNuevo
Análisis de sentimiento y detección de riesgo reputacional en redes sociales para bodega exportadora
Diseña un prototipo de sistema de monitorización de reputación digital que procese menciones de la bodega en Twitter/X, Instagram y reseñas de Vivino en español, portugués e ing…
- Natural Language Processing
- Sentiment Analysis
- Multilingual Text Processing
Multidisciplinar - AnalysisSéniorNuevo
Resiliencia de la red eléctrica andina ante fallos en cascada
Modela el SEN como grafo dirigido ponderado a partir de topología y capacidad (datos provistos, anonimizados a nivel nodo). Implementa un modelo simplificado de cascada (Motter-…
- Network Science
- Cascading Failure Models
- Monte Carlo Simulation
Multidisciplinar - CodePrincipianteNuevo
Particle Swarm para Calibrar Modelo de Riego en Almería
Recibirás una temporada de datos (90 días, 12 invernaderos, sensores de humedad, transpiración, radiación) y la formulación del modelo de balance hídrico (9 parámetros). Impleme…
- Particle Swarm Optimization
- Metaheuristics
- Parameter Estimation
Evolutionary Computation and Metaheuristic Search Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodePrincipianteNuevo
Detecta churn predictivo para una telco mexicana de prepago
Recibirás un dataset anonimizado de 2 millones de clientes con 12 meses de historia (consumo de minutos, datos, SMS, recargas, cambios de plan, tickets de soporte). Define churn…
- Classification
- Feature Engineering
- Churn Prediction
Data Mining and Knowledge Discovery - CodeIntermedioNuevo
Sistema de alerta temprana de crisis reputacional para bodega exportadora
Tu equipo debe construir un prototipo funcional de monitorización de reputación que procese texto en español de múltiples países. El sistema debe incluir: un modelo de clasifica…
- Natural Language Processing
- Sentiment Analysis
- Dashboard Design
Social Media and Web Analytics - CodePrincipianteNuevo
Predicción de abandono para plataforma de pagos B2B en Ciudad de México
Construye un pipeline de analytics predictivo que, a partir de datos sintéticos de comportamiento de uso, transacciones, soporte y facturación, estime la probabilidad de churn p…
- Predictive Modeling
- Feature Engineering
- Python Programming
Business Analytics - CodePrincipianteNuevo
Recomendador editorial para un medio digital de Buenos Aires
Recibes seis meses de eventos anonimizados (lecturas y permanencia por artículo), el corpus completo de 18.000 artículos publicados y etiquetas temáticas existentes. Construye t…
- Recommender Systems
- Embeddings
- Diversity Metrics
Social Network Analysis and Web Science - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- CodeSéniorNuevo
Sistema de alerta temprana para churn en fintech B2B de pagos en Ciudad de México
Construye un modelo de clasificación de riesgo de churn en Python o R usando un dataset sintético de 10.000 registros mensuales que incluye: frecuencia de transacciones, monto p…
- Predictive Modeling
- Customer Lifetime Value
- Python Programming
Marketing Analytics - ResearchPrincipianteNuevo
Forecasting de demanda con RNNs/transformers para una bodega riojana
Recibirás 5 años de demanda mensual anonimizada por SKU × mercado, calendario de promociones y eventos exógenos (festivos, lanzamientos). Implementa: (1) baseline ARIMA + Holt-W…
- Time Series Forecasting
- Lstm
- Transformers
Deep Learning - CodeIntermedioNuevo
Ensemble jerárquico para predecir abandono escolar
Tendrás 28.000 registros estudiantiles de 3 cohortes históricas. Diseñarás un stacking de 3 modelos base (uno por familia de features: académicos, comportamentales, socioeconómi…
- Ensemble Methods
- Stacking
- Model Fairness
Advanced Machine Learning - CodeFundamentosNuevo
Extracción de entidades y resumen automático de contratos de suministro para startup logística portuaria
Construye un prototipo de sistema de extracción de información de documentos legales que: (1) convierta contratos de suministro en PDF a texto estructurado, (2) identifique y cl…
- Natural Language Processing
- Named Entity Recognition
- Document Processing
Text Analytics and Natural Language Processing Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- AnalysisPrincipianteNuevo
Detección de comunidades en cadenas de difusión de WhatsApp anonimizadas
Recibes una red de cerca de 65.000 mensajes con metadatos (hash de identificador anonimizado, marca de tiempo, grupo público origen, hash del contenido para detectar reenvíos de…
- Network Analysis
- Community Detection
- Data Visualization
Social Network Analysis and Web Science - CodePrincipianteNuevo
Predice el abandono mensual de una academia de idiomas online
Recibes un dataset anonimizado con 60.000 filas (una por persona-mes) y unas 25 features: minutos de clase, lecciones completadas, notas en evaluaciones, plan de pago y país. El…
- Supervised Learning
- Logistic Regression
- Gradient Boosting
Multidisciplinar - CodePrincipianteNuevo
Detección Anticipada de Pérdidas para Cooperativa Eléctrica en Lima
Recibirás 18 meses de consumos horarios anonimizados de ~140.000 clientes y el modelo en producción (LightGBM). Para cada predicción de anomalía produce: (1) explicación SHAP lo…
- Shap
- Explainability
- Anomaly Detection
Explainable and Interpretable AI - CodePrincipianteNuevo
Sistema de predicción de cosecha para bodega familiar en Mendoza
En equipo de 3 personas, debes desarrollar un sistema de predicción de cosecha que integre datos históricos de 5 campañas (rendimiento en kg/ha por parcela, fecha de cosecha, ca…
- Python Data Science
- Statistical Modeling
- Data Visualization
Multidisciplinar - CodePrincipianteNuevo
Clasificación automática de defectos en informes de calidad de proveedores Tier-1
Construye un modelo de clasificación de textos que procese informes de no conformidad en tres idiomas y los clasifique en las 12 categorías de defecto definidas por la empresa. …
- Natural Language Processing
- Text Classification
- Python Programming
Text Analytics and Natural Language Processing - ResearchIntermedioNuevo
Difusión de bulos sanitarios en grupos de WhatsApp (estudio)
Recibes el corpus anonimizado (cerca de 1,4 M mensajes, identificadores hash). Construye con Python una pipeline que: (1) detecte ocurrencias de los 12 bulos vía embeddings + re…
- Network Science
- Epidemic Models
- Embeddings
Network Science and Computational Social Science - AnalysisIntermedioNuevo
Detecta anomalías en transacciones de tarjeta para una procesadora chilena
Recibirás 90 días de transacciones (4 millones de filas, 22 features anonimizadas) con un subconjunto de 12.000 fraudes confirmados como gold-standard para evaluación. Procesará…
- Unsupervised Learning
- Anomaly Detection
- Deep Learning
Machine Learning (CS Elective) - CodeIntermedioNuevo
Política de pricing dinámico con bandidos contextuales en e-commerce
Recibes 6 meses de eventos (vistas + compras) sobre los 80 SKUs y 8 niveles de precio discretos por SKU. Implementa LinUCB con 12 features contextuales y úsalo en una validación…
- Contextual Bandits
- Reinforcement Learning
- Offline Evaluation
Reinforcement Learning - AnalysisPrincipianteNuevo
Comparativa de modelos de IA para un caso de uso de captación universitaria
Recibes un conjunto anonimizado con 30.000 solicitantes y 18 variables (canal, edad, programa de interés, interacciones previas, distancia geográfica, etc.) y la variable objeti…
- Classification
- Model Comparison
- Feature Engineering
Multidisciplinar - StrategyIntermedioNuevo
Optimización de rutas de distribución con datos de tráfico y demanda
Debes abordar el problema en dos fases: primero, un análisis descriptivo y predictivo de la demanda espaciotemporal (qué zonas, qué días, qué franjas horarias concentran más ped…
- Demand Forecasting
- Operations Research
- Geospatial Analysis
Data Science for Business - ResearchIntermedioNuevo
Diseña y ejecuta un capstone de detección de anomalías para una cooperativa olivarera
Recibirás 18 meses de telemetría minutal de 6 molinos (cerca de 45 millones de filas) más un registro de 38 incidentes etiquetados. Diseña el experimento: define qué es una anom…
- Anomaly Detection
- Time Series Analysis
- Pytorch
Multidisciplinar - AnalysisFundamentosNuevo
Segmenta clientes de una bodega del Penedès por valor y gusto
Recibes un dataset anonimizado con ~9.000 clientes activos y features RFM (Recency, Frequency, Monetary — recencia, frecuencia, valor monetario) más mezcla de producto (porcenta…
- Unsupervised Learning
- K Means
- Hierarchical Clustering
Multidisciplinar - CodePrincipianteNuevo
Detectar señales tempranas de abandono universitario
Recibirás 22.000 registros estudiantiles de 3 cohortes históricas con etiqueta de abandono al final del semestre. Construirás (1) un modelo predictivo de abandono entrenado solo…
- Learning Analytics
- Predictive Modeling
- Shap Explanations
Multidisciplinar - CodeIntermedioNuevo
Recomendación de Productos con GNN para Marketplace Hortícola en Almería
Recibirás 18 meses de órdenes históricas (~95.000 líneas) y catálogo de productos con metadatos (variedad, calibre, certificación bio). Construye el grafo bipartito comprador-pr…
- Graph Neural Networks
- Link Prediction
- Recommender Systems
Multidisciplinar - AnalysisIntermedioNuevo
Mapa de comunidades en red de cooperativas vitivinícolas
Recibes 3 datasets anonimizados: asistencia a 38 cursos técnicos en 5 años, transacciones intercooperativas (1.200 registros) y boletín técnico (740 co-publicaciones). Construye…
- Network Science
- Community Detection
- Graph Algorithms
Network Science and Computational Social Science - CodeIntermedioNuevo
Construye un grafo de propiedad accionarial para análisis de riesgo
Recibirás un subconjunto anonimizado del registro mercantil (alrededor de 200.000 empresas + sus directivos + tenencias accionariales) en formato CSV. Construye un grafo dirigid…
- Graph Analysis
- Neo4j
- Community Detection
Multidisciplinar - AnalysisFundamentosNuevo
Análisis de influencia para una agencia de marketing en Medellín
Recibes una red de 220.000 menciones públicas anonimizadas sobre cuatro nichos (gastronomía, moda sostenible, tecnología de consumo y viajes regionales) durante tres meses. Calc…
- Network Analysis
- Centrality Measures
- Data Visualization
Social Network Analysis and Web Science - AnalysisIntermedioNuevo
Optimización de cohortes y CAC para fintech B2B en Ciudad de México
Tienes dos semanas para entregar un análisis ejecutivo. Recibirás una base de datos anonimizada con 4.200 registros de clientes (fecha de alta, canal de adquisición, inversión p…
- Marketing Analytics
- Customer Lifetime Value Analysis
- Cohort Analysis
Multidisciplinar - CodeSéniorNuevo
Robo-advisor para optimización de liquidez en concesionaria de autopistas
Debes construir un prototipo funcional de algoritmo de asignación de liquidez que: reciba como input los flujos de caja históricos y proyecciones de tráfico; aplique un modelo d…
- Quantitative Finance
- Portfolio Optimization
- Defi Integration
Fintech and Digital Finance - AnalysisPrincipianteNuevo
Kernels y máquinas de vector soporte para clasificación de cosechas en agritech
Recibes un dataset de 18.500 espectros etiquetados con variedad (8 clases) y calidad (3 niveles), repartido por temporadas. Implementa SVM con tres kernels (lineal, RBF, polinóm…
- Support Vector Machines
- Kernel Methods
- Cross Validation
Statistical Machine Learning - AnalysisPrincipianteNuevo
Segmentación de clientes y predicción de abandono para bodega exportadora
Debes realizar un análisis completo de datos de clientes: limpieza de registros duplicados y transacciones anuladas, análisis de cohortes (grupos de clientes que compraron por p…
- Customer Segmentation
- Churn Prediction
- Cohort Analysis
Data Science for Business - CodeFundamentosNuevo
Clasificador de correos de incidencia para un ayuntamiento mediano
Recibes 12.000 correos anonimizados etiquetados en cinco categorías. Construye un pipeline de Natural Language Processing (NLP) básico (limpieza de texto, vectorización TF-IDF) …
- Text Classification
- NLP
- Python
Introduction to Artificial Intelligence - CodeIntermedioNuevo
Modelo de espacio de estados para previsión de tráfico portuario en Algeciras
Recibes 6 años de datos diarios de movimientos por terminal (4 terminales), calendario de festivos en España y Marruecos, y datos meteorológicos. Construye un modelo de espacio …
- State Space Models
- Bayesian Structural Time Series
- Seasonality
Multidisciplinar - AnalysisIntermedioNuevo
Detección de coordinación inauténtica en X durante elecciones locales
Procesa el dataset de 2 M tuits (provisto en parquet, anonimizado a nivel cuenta-hash). Construye con Python una pipeline que: (1) detecte similitud temporal anómala (cuentas qu…
- Network Science
- Anomaly Detection
- Computational Journalism
Network Science and Computational Social Science - AnalysisPrincipianteNuevo
Descubre association rules para optimizar el cross-sell de un marketplace
Recibirás 30 millones de líneas de pedido (alrededor de 5 millones de carritos) etiquetadas con categoría y SKU. Aplica algoritmos de frequent itemset (FP-Growth o Apriori en su…
- Association Rules
- Fp Growth
- Market Basket Analysis
Multidisciplinar - CodePrincipianteNuevo
Detección de puntos de cambio en demanda logística en Valencia
Recibes 4 años de series semanales por categoría (28 categorías, 200 puntos cada una). Implementa al menos dos métodos de detección: (a) Bayesian Online Changepoint Detection y …
- Change Point Detection
- Bayesian Methods
- Time Series Analysis
Time Series Analysis and Forecasting - AnalysisPrincipianteNuevo
Segmenta a los clientes de un retailer de moda gallego
Recibirás un dataset anonimizado de 500.000 clientes con transacciones de los últimos 12 meses, eventos de app y atributos demográficos. Aplica al menos dos algoritmos de cluste…
- Clustering
- Feature Engineering
- Customer Segmentation
Data Mining and Knowledge Discovery - AnalysisPrincipianteNuevo
Minería de patrones de compra en cadena de supermercados
Diseña un pipeline de minería de patrones frecuentes (FP-Growth o similar) sobre 12 meses de tickets. Genera reglas de asociación con métricas (support, confidence, lift) filtra…
- Frequent Pattern Mining
- Association Rules
- Market Basket Analysis
Data Mining and Information Retrieval - AnalysisPrincipianteNuevo
Predice la demanda diaria de SKU para una bodega de Rías Baixas
Recibirás 3 años de datos diarios de ventas por SKU (45 SKU activos), promociones, festivos y precios. Implementa una línea base con SARIMA (modelo estacional autorregresivo de …
- Time Series Forecasting
- Feature Engineering
- Model Evaluation
Multidisciplinar - CodeFundamentosNuevo
Clasifica reseñas de hoteles para una cadena en Canarias
Recibes 12.000 reseñas en español ya etiquetadas (3.000 por categoría). Construye un pipeline con TF-IDF (Term Frequency-Inverse Document Frequency — frecuencia de término inver…
- Text Classification
- Tf Idf
- Logistic Regression
Machine Learning (Undergraduate) - CodePrincipianteNuevo
Modelo logístico regularizado para scoring de pymes en banca cooperativa
Recibes un dataset interno con 28.000 expedientes de pymes (16 features financieras y 12 features sectoriales) y un objetivo binario de impago a 12 meses. Construye los tres mod…
- Regularized Regression
- Model Calibration
- Cross Validation
Multidisciplinar - AnalysisIntermedioNuevo
Modela rutas de pacientes con un HMM en aseguradora médica
Recibes 42.000 trayectorias de pacientes con diabetes tipo 2, cada una con secuencias mensuales de eventos categóricos (consulta primaria, urgencias, cambio de medicación, prueb…
- Hidden Markov Models
- Sequence Modeling
- Probabilistic Inference
Multidisciplinar - CodePrincipianteNuevo
Algoritmo Genético para Ruteo Diario de Flota en Valencia
Recibirás 10 días de paradas históricas (entre 1.500 y 2.000 por día, cada una con dirección geocodificada, ventana horaria y tiempo de servicio) y la flota disponible. Implemen…
- Genetic Algorithms
- Metaheuristics
- Vrp
Evolutionary Computation and Metaheuristic Search - AnalysisPrincipianteNuevo
Análisis espectral de carga eléctrica residencial en Lisboa
Recibes datos a 15 minutos de 8.000 puntos de suministro residencial anonimizados, agrupados en 12 barrios. Aplica análisis espectral (Fast Fourier Transform y wavelet continuo)…
- Spectral Analysis
- Wavelet Analysis
- Time Series Analysis
Time Series Analysis and Forecasting - CodeIntermedioNuevo
Modelar incertidumbre bayesiana en scoring crediticio
Recibirás 80.000 solicitudes históricas (12 meses) con features tabulares + etiquetas de impago a 90 días. Implementarás un modelo bayesiano (por ejemplo, regresión logística ba…
- Bayesian Learning
- Uncertainty Quantification
- Conformal Prediction
Advanced Machine Learning - CodeIntermedioNuevo
Predicción de fallos en aerogeneradores con aprendizaje supervisado
Construye un modelo de clasificación binaria que prediga si una turbina fallará en las próximas 60 horas de operación. Usa el dataset histórico de 18 meses con lecturas de 47 se…
- Machine Learning
- Python
- Time Series Analysis
Machine Learning and AI for Business - CodeIntermedioNuevo
Simulated Annealing para Layout de Centro de Distribución en Manaus
Recibirás el plano del CD (12.000 ubicaciones, 4 zonas de temperatura), 8.000 SKUs con datos de rotación, peso y afinidad (pares de SKUs que suelen pedirse juntos), y 60 días de…
- Simulated Annealing
- Metaheuristics
- Warehouse Optimization
Evolutionary Computation and Metaheuristic Search - AnalysisPrincipianteNuevo
Implementa segmentación no supervisada de clientes para una marca de moda online
Recibirás 18 meses de datos transaccionales y navegacionales anonimizados (1,2 millones de personas usuarias, 36 features). Construirás features RFM (Recency, Frequency, Monetar…
- Unsupervised Learning
- Clustering
- Feature Engineering
Machine Learning (CS Elective) - AnalysisPrincipianteNuevo
Análisis de movilidad urbana con datos de bicicleta compartida
Recibes 5 M registros de viajes (origen, destino, timestamp, tipo de usuario), anonimizados. Construye con Python + NetworkX la red estación-estación ponderada por flujo, detect…
- Network Science
- Community Detection
- Geospatial Analysis
Network Science and Computational Social Science - AnalysisPrincipianteNuevo
Diagnóstico de Abandono en una Plataforma de Streaming Hispanohablante
Recibes un volcado anonimizado de 180.000 cuentas con 18 meses de eventos (registros, sesiones, suscripciones, cancelaciones) y un diccionario de variables. Limpia el dataset (v…
- Data Wrangling
- Exploratory Data Analysis
- Feature Engineering
Applied Data Analysis and Practical Data Science - CodeIntermedioNuevo
Pronostica demanda con procesos gaussianos en bodega chilena
Recibes 5 años de ventas mensuales para 60 SKUs, precio promedio, mes y un indicador de evento promocional. Para los 20 SKUs principales ajusta un GP con kernel compuesto (RBF +…
- Gaussian Processes
- Bayesian Inference
- Time Series
Probabilistic Machine Learning - CodePrincipianteNuevo
Compara métodos kernel y boosting para clasificar fraude en pagos B2B
Recibes 14 meses de transacciones anonimizadas con 1,2 % de fraude marcado. Construye un pipeline reproducible que (a) maneje el desbalance vía class_weight o SMOTE, (b) entrene…
- Kernel Methods
- Ensemble Methods
- Model Evaluation
Machine Learning - CodeIntermedioNuevo
Pronóstico de generación eólica a 24 horas para parque en Pamplona
Recibes 3 años de generación horaria por parque y previsiones meteorológicas numéricas (viento a 10 m y 100 m, dirección, temperatura, presión) actualizadas cada 6 horas. Constr…
- Time Series Forecasting
- Arima
- Neural Forecasting
Time Series Analysis and Forecasting - AnalysisPrincipianteNuevo
Selección de features con Lasso y árboles para predicción de demanda hortícola
Recibes un dataset de 5 años con observaciones semanales para 12 productos y las 180 variables potenciales (con valores faltantes y multicolinealidad). Diseña dos pipelines de s…
- Feature Selection
- Lasso
- Permutation Importance
Statistical Machine Learning - AnalysisPrincipianteNuevo
Analizar patrones de rotación y proponer retención en startup fintech
Debes analizar un dataset simulado de 180 empleados (histórico de 3 años) para identificar momentos críticos de abandono, perfiles de riesgo y correlatos psicológicos (burnout —…
- Behavioral Data Science
- Organizational Psychology
- People Analytics
Business and Industrial Psychology - CodeIntermedioNuevo
Detecta fraude transaccional en una fintech bogotana
Recibirás 800.000 transacciones etiquetadas (1,4 por ciento fraude) con features de transacción, comerciante y dispositivo. Construye y compara al menos tres enfoques: Isolation…
- Anomaly Detection
- Xgboost
- Fraud Detection
Data Mining and Knowledge Discovery - CodeIntermedioNuevo
Predecir rendimiento solar con kernels gaussianos
Dispondrás de 3 años de series horarias por planta (producción + meteorológicas + estado de inversores) y previsiones meteorológicas de un proveedor externo. Implementarás un pr…
- Kernel Methods
- Gaussian Processes
- Probabilistic Forecasting
Advanced Machine Learning - ResearchIntermedioNuevo
Optimizar hiperparámetros con teoría del aprendizaje
Recibirás 5 datasets tabulares anonimizados (clasificación binaria, tamaños entre 1k y 20k). Diseñarás una metodología que combine: (1) Bayesian optimization con Optuna sobre fa…
- Bayesian Optimization
- Cross Validation
- Learning Theory
Advanced Machine Learning
Cómo funciona
Del briefing al certificado, en seis pasos.
Paso 01
Explora retos alineados con tus estudios.
Paso 02
Acepta el que encaja con tus metas.
Paso 03
Trabájalo con la guía del AI Copilot.
Paso 04
Envíalo para una evaluación estructurada.
Paso 05
Consigue una credencial verificada.
Paso 06
Añádela a LinkedIn con un solo clic.
Roles relacionados que podrías explorar
Ver todos los roles →Equipos del sector tras una década de briefings prácticos
¿Reclutando de este grupo?
Patrocina un reto y conoce candidatos a través de su trabajo real.
Los equipos de la industria pueden diseñar briefings en torno a las habilidades que buscan, y evaluar a los estudiantes por entregables puntuados con rúbrica — no por currículums.
¹ Salario mediano anual calculado a partir del histograma salarial de 50 ofertas de empleo actuales de Adzuna para «Científico de Datos» en United States, obtenido el mayo de 2026. Las habilidades provienen de las disciplinas etiquetadas en los retos activos de Ewance para este rol.
Retrato: Foto de Jake Nackos en Unsplash.



















































































