Diseño Experimental
Si te gusta aplicar Diseño Experimental, cada reto aquí te da la oportunidad de practicarlo en un briefing industrial real.
- AnalysisPrincipianteNuevo
Exploración vs. explotación para recomendación de cursos online
Recibes CTR (Click-Through Rate — tasa de click) histórico de los 6.000 cursos (con N de impresiones por curso, suficiente para tratar como prior fuerte) y construyes un simulad…
- Multi Armed Bandits
- Thompson Sampling
- Reinforcement Learning
Reinforcement Learning - ResearchIntermedioNuevo
Diseño de un benchmark interno para asistentes de código
Recibes una lista de 60 tareas reales recientes del backlog (15 por cuatro categorías: bugfix, feature pequeña, refactor, test). Diseña un protocolo con tres condiciones (asiste…
- Experimental Design
- Model Evaluation
- Benchmarking
AI Measurement and Evaluation - ResearchSéniorNuevo
Pre-entrenar un encoder auto-supervisado para imágenes médicas
Diseñarás un experimento controlado: (1) implementa o adapta un objetivo auto-supervisado moderno (DINOv2, MAE o SimCLR) sobre un ResNet-50 o un ViT-B/16; (2) pre-entrena sobre …
- Self Supervised Learning
- Pytorch
- Vision Transformers
Advanced Deep Learning - ResearchIntermedioNuevo
Red-teaming sistemático de un asistente conversacional regulado
Recibes acceso a un asistente equivalente open-source y una lista priorizada de categorías de daño (información peligrosa, manipulación, contenido sexualizado, sesgos, fuga de d…
- Red Teaming
- Jailbreak Defense
- LLM Agents
AI Safety and Alignment Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- ResearchSéniorNuevo
RL Basado en Modelo para Tienda con Recomendaciones en Bogotá
Recibirás un simulador construido sobre 6 meses de logs anonimizados (~3M eventos, 80k usuarios anonimizados) que reproduce probabilidades de clic e ingresos por sesión. Entrena…
- Model Based Rl
- Reinforcement Learning
- Off Policy Evaluation
Deep Reinforcement Learning - ResearchSéniorNuevo
Investigación de un benchmark de QA tabular en banca
En equipo de 2-3, recibes 30 tablas financieras anonimizadas (estados consolidados, P&L, cash flow) y 150 preguntas reales con respuesta-oro numérica/textual. Implementa: (A) ta…
- Question Answering
- Tabular Qa
- Evaluation
Question Answering and Conversational Systems - CodeIntermedioNuevo
Capstone de recomendador para una plataforma SaaS B2B en Bogotá
Recibirás 9 meses de datos anonimizados: 22.000 cuentas, 180.000 facturas y un catálogo de 140 plantillas. Implementa dos enfoques: (1) filtrado colaborativo basado en factoriza…
- Recommender Systems
- Embeddings
- Offline Evaluation
AI/ML Practicum and Hands-on Lab - AnalysisIntermedioNuevo
Mide el sesgo de un buscador de empleo en plataforma LATAM
Recibirás logs anonimizados de 5.000 búsquedas reales con sus top-20 resultados, además de atributos protegidos inferidos de CV (con disclaimer de incertidumbre). Diseñarás métr…
- Fairness Analysis
- Ranking
- Information Retrieval
Information Retrieval and Search - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- ResearchSéniorNuevo
Comparar arquitecturas de gran escala bajo presupuesto fijo
Definirás el protocolo experimental: mismo dataset de pre-entrenamiento (un subset abierto, p. ej. SlimPajama 50B tokens), mismo presupuesto en FLOPs, mismo tokenizer. Entrenará…
- Large Scale Training
- Transformer Architectures
- Mixture Of Experts
Advanced Deep Learning - ResearchPrincipianteNuevo
Estudio piloto de un robot guía en un museo regional
Trabajarás con el robot ya programado para guiar a 5 obras (no debes reprogramarlo de cero). Diseñarás un protocolo de estudio mixto: observación no participante de 40 sesiones …
- Experiment Design
- Human Robot Interaction
- Qualitative Analysis
Human-Robot Interaction - ResearchIntermedioNuevo
Diseño de evaluaciones de capacidad para un modelo open-source
Elige uno de los tres modelos open-source proporcionados. Diseña un conjunto de evaluaciones que cubra cinco capacidades: razonamiento numérico, generación y depuración de códig…
- LLM Agents
- Capability Evaluation
- Experimental Design
AI Safety and Alignment - AnalysisPrincipianteNuevo
A/B test de chain-of-thought para soporte técnico
Recibes 200 consultas reales del soporte telco (anonimizadas) clasificadas en simples (n=120) y complejas (n=80), con respuestas-oro escritas por un ingeniero senior. Implementa…
- Prompt Engineering
- Chain Of Thought
- Evaluation
Prompt Engineering Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- ResearchIntermedioNuevo
Reproducción de un resultado del estado del arte en visión
Elige (entre tres opciones proporcionadas) un paper reciente del estado del arte en clasificación de imágenes con código y datasets públicos. Reproduce el experimento principal …
- Reproducibility
- Model Evaluation
- Deep Learning
AI Measurement and Evaluation - StrategyPrincipianteNuevo
Diseño de nudges para reducir el abandono en suscripción de energía solar
Debes analizar el embudo de conversión actual de la empresa, identificar los puntos de fricción conductual mediante un mapa de decisiones del cliente, y proponer tres intervenci…
- Behavioral Economics
- Experimental Design
- Choice Architecture
Behavioral Economics - StrategyPrincipianteNuevo
Diseño de nudges para reducir el abandono en planes de pensiones
Debes analizar el customer journey de los participantes desde la adhesión hasta el abandono, identificar los puntos de fricción donde operan los sesgos cognitivos, y proponer tr…
- Behavioral Finance
- Data Analysis
- Experimental Design
Behavioural Finance - ResearchSéniorNuevo
Reproduce un experimento de escalado a pequeña escala
Entrenarás transformers GPT-style desde cero en 3 tamaños (1M, 10M, 100M parámetros) sobre subsets de OpenWebText o C4 en 3 tamaños (100M, 1B, 10B tokens). Ejecutarás los 9 cruc…
- Scaling Laws
- Transformers
- Pytorch
Large Language Models - ResearchSéniorNuevo
RAG agéntico con tool use sobre datos de un laboratorio foundation
En equipo de 2, recibes un corpus de 5.000 documentos enterprise simulados (PDF + tablas), 100 preguntas mixtas (40 retrieval puro, 30 cálculo puro, 30 mixtas) con respuesta-oro…
- Retrieval Augmented Generation
- Agent Design
- Tool Use
Retrieval-Augmented Generation - ResearchIntermedioNuevo
Diseña un protocolo de evaluación de retrieval para asistente RAG bancario
Recibirás acceso de lectura al índice y a un set inicial de 50 consultas reales con respuesta esperada. Diseñarás un protocolo de evaluación que cubra: (1) generación o curación…
- Evaluation
- Information Retrieval
- RAG Evaluation
Information Retrieval and Search - ResearchSéniorNuevo
Estudia comportamiento emergente en agentes de planificación cooperativa
Diseña un entorno de planificación cooperativa: 3 agentes deben repartir 10 tareas con dependencias y recursos limitados, sin que ningún agente vea el plan global. Implementa el…
- Multi Agent Systems
- Emergent Behavior
- Experiment Design
Multi-Agent Systems - AnalysisIntermedioNuevo
Diseñar un experimento de neuromarketing para optimizar packaging de aceite de oliva en Jaén
Debes diseñar un protocolo de investigación experimental que combine técnicas de neuromarketing de bajo coste (eye-tracking con webcams, análisis facial de expresiones emocional…
- Neuromarketing
- Experimental Design
- Consumer Psychology
Consumer Behavior - CodeIntermedioNuevo
DPO para Tono de Marca en E-commerce de Moda en Bogotá
Recibirás ~6.000 pares de preferencia anotados por equipo de marca (respuesta A preferida a respuesta B) y un modelo SFT base. Aplica DPO con parámetro beta adecuado, registra c…
- Dpo
- Preference Optimization
- LLM Alignment
Fine-Tuning Large Language Models - ResearchIntermedioNuevo
Investiga estrategias de negociación entre agentes para un marketplace anonimizado
Diseña un entorno de negociación bilateral (un agente comprador, un agente vendedor) con preferencias privadas. Implementa 3 protocolos: ultimátum simple, regateo alternante (al…
- Game Theory
- Multi Agent Systems
- LLM Applications
Multi-Agent Systems - ResearchPrincipianteNuevo
Evalúa la aceptación de un exoesqueleto asistivo en planta automotriz
Trabajarás con 12 personas operarias voluntarias durante 2 semanas. Combinarás cuestionario de aceptación tecnológica (UTAUT2, Unified Theory of Acceptance and Use of Technology…
- Human Robot Interaction
- Qualitative Analysis
- Evaluation
Human-Robot Interaction - ResearchIntermedioNuevo
Evaluación end-to-end de un sistema LLM en producción
Recibes acceso a 2.000 conversaciones reales anonimizadas con su resolución, encuestas de satisfacción de clientes y métricas operativas (tiempo medio, escalado humano). Diseña …
- Model Evaluation
- Human Evaluation
- LLM Agents
AI Measurement and Evaluation
Cómo funciona
Del briefing al certificado, en seis pasos.
Paso 01
Explora retos alineados con tus estudios.
Paso 02
Acepta el que encaja con tus metas.
Paso 03
Trabájalo con la guía del AI Copilot.
Paso 04
Envíalo para una evaluación estructurada.
Paso 05
Consigue una credencial verificada.
Paso 06
Añádela a LinkedIn con un solo clic.
Equipos del sector tras una década de briefings prácticos
¿Reclutando de este grupo?
Patrocina un reto y conoce candidatos a través de su trabajo real.
Los equipos de la industria pueden diseñar briefings en torno a las habilidades que buscan, y evaluar a los estudiantes por entregables puntuados con rúbrica — no por currículums.



















































































