Red-teaming sistemático de un asistente conversacional regulado
Visión general
De qué trata este proyecto.
Diseña ataques, ejecuta 200 intentos contra un asistente y propón 10 salvaguardas. Obtén un certificado verificable.
El escenario
El laboratorio espera lanzar el modelo a clientes regulados en seis meses; un red-teaming reproducible es requisito implícito de los contratos y de la próxima Ley de IA UE para sistemas de uso general.
El Briefing
Lo que harás y lo que demostrarás.
Diseñar y ejecutar un protocolo de red-teaming reproducible sobre un asistente conversacional con taxonomía, severidad y propuesta de salvaguardas priorizadas.
Earning criteria — what you'll demonstrate
- Diseñar campañas de red-teaming sistemático y reproducible
- Construir taxonomías útiles de modos de fallo en LLMs
- Estimar severidad con criterios trazables
- Conectar hallazgos con salvaguardas concretas en producto
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
AI Safety and Alignment
Master · Responsible Ai
Strong alignment
This challenge maps to AI Safety and Alignment at the Master level. It sharpens the same practical skills your coursework expects — but in a real industry context with actual constraints and deliverables.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Red Teaming
Apply red teaming to solve real industry problems and demonstrate production-level capability.
- Jailbreak Defense
Apply jailbreak defense to solve real industry problems and demonstrate production-level capability.
- Llm Agents
Apply llm agents to solve real industry problems and demonstrate production-level capability.
- Ai Governance
Apply ai governance to solve real industry problems and demonstrate production-level capability.
- Experimental Design
Apply experimental design to solve real industry problems and demonstrate production-level capability.
- Risk Assessment
Apply risk assessment to solve real industry problems and demonstrate production-level capability.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Investigador de Seguridad de IA
Diseñar protocolos de red-teaming reproducibles y proponer salvaguardas es trabajo nuclear del rol de AI Safety Researcher en laboratorios de modelos foundation.
Este proyecto afina
- red-teaming
- jailbreak-defense
- ai-governance
Ingeniero de IA
La implementación técnica de las salvaguardas propuestas cae sobre el rol de AI Engineer y exige la taxonomía clara producida en este reto.
Este proyecto afina
- llm-agents
- jailbreak-defense
- risk-assessment
Investigador de Machine Learning
Construir baterías de evaluación reproducibles para LLMs es ejercicio directo del rol de ML Researcher en seguridad y alineamiento.
Este proyecto afina
- experimental-design
- red-teaming
- ai-governance