Visión general
De qué trata este proyecto.
Ajusta un modelo NLP con DPO para el tono de marca en e-commerce de moda y diseña el protocolo de evaluación. Obtén tu certificado verificable.
El escenario
La marca (~80 empleados, ~280.000 clientes activos en Colombia, México y Perú) atiende ~12.000 chats al día; alinear tono reduce escaladas a humano del 14% actual hacia un objetivo del 8%.
El Briefing
Lo que harás y lo que demostrarás.
Alinea un modelo SFT al tono de marca con DPO sin degradar la utilidad de las respuestas, y deja un protocolo de re-evaluación trimestral.
Earning criteria — what you'll demonstrate
- Implementar DPO con TRL y elegir beta justificado
- Equilibrar alineamiento de tono y utilidad de respuesta
- Diseñar un protocolo de anotación reproducible por equipos no técnicos
- Detectar drift de marca en producción
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
Fine-Tuning Large Language Models
Master · Generative Ai
Strong alignment
This challenge maps to Fine-Tuning Large Language Models at the Master level. It sharpens the same practical skills your coursework expects — but in a real industry context with actual constraints and deliverables.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Dpo
Apply dpo to solve real industry problems and demonstrate production-level capability.
- Preference Optimization
Apply preference optimization to solve real industry problems and demonstrate production-level capability.
- Llm Alignment
Apply llm alignment to solve real industry problems and demonstrate production-level capability.
- Llm Evaluation
Apply llm evaluation to solve real industry problems and demonstrate production-level capability.
- Huggingface
Apply huggingface to solve real industry problems and demonstrate production-level capability.
- Experiment Design
Apply experiment design to solve real industry problems and demonstrate production-level capability.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Ingeniero NLP
Alinear un LLM con DPO al tono de marca es trabajo de día uno del NLP Engineer en e-commerce con IA generativa.
Este proyecto afina
- dpo
- preference-optimization
- llm-alignment
Ingeniero en Prompt
Definir criterios de tono y traducirlos a pares de preferencia es trabajo del Prompt Engineer cuando hay equipo de producto detrás.
Este proyecto afina
- llm-alignment
- llm-evaluation
- preference-optimization
Científico en IA Aplicada
Equilibrar alineamiento y utilidad, y diseñar el protocolo de re-evaluación, es trabajo central del Applied AI Scientist.
Este proyecto afina
- experiment-design
- llm-evaluation
- dpo