Diseña un eval set adversarial para un LLM de consejero financiero
Visión general
De qué trata este proyecto.
Diseña un eval set adversarial para un LLM financiero, mide fallos y propón guardrails. Obtén un certificado verificable.
El escenario
La neobanca (320 personas, 1.8 millones de personas usuarias activas) está bajo escrutinio regulatorio mexicano por las prácticas de educación financiera; cualquier consejo riesgoso es titular en medios.
El Briefing
Lo que harás y lo que demostrarás.
Construir un eval set adversarial para un LLM de educación financiera y demostrar mejora medible tras la introducción de guardrails.
Earning criteria — what you'll demonstrate
- Diseñar eval sets adversariales para LLMs en dominio sensible
- Aplicar técnicas básicas de red-teaming a un asistente conversacional
- Construir guardrails de prompt y filtros pre/post
- Medir mejora honestamente y reportar a un comité no técnico
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
Alineación con asignaturas próximamente.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Llm Evaluation
Apply llm evaluation to solve real industry problems and demonstrate production-level capability.
- Red Teaming
Apply red teaming to solve real industry problems and demonstrate production-level capability.
- Prompt Engineering
Apply prompt engineering to solve real industry problems and demonstrate production-level capability.
- Alignment
Apply alignment to solve real industry problems and demonstrate production-level capability.
- Evaluation
Apply evaluation to solve real industry problems and demonstrate production-level capability.
- Python
Write clean, efficient Python for data processing, automation, and backend services.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Investigadora de Seguridad de IA
Construir eval sets adversariales y demostrar mejora antes/después es el trabajo más solicitado para safety researchers en producto regulado.
Este proyecto afina
- red-teaming
- llm-evaluation
- alignment
Ingeniera de Prompts
Iterar guardrails de system prompt y validarlos contra eval set adversarial es el día a día de una prompt engineer sénior en fintech.
Este proyecto afina
- prompt-engineering
- llm-evaluation
- evaluation
Ingeniera de IA
Empaquetar evaluaciones y guardrails como pipeline automatizado es el trabajo de plomería que AI engineers entregan para sostener LLMs en producción.
Este proyecto afina
- python
- llm-evaluation
- prompt-engineering