Evaluación adversarial de un agente con herramientas peligrosas
Visión general
De qué trata este proyecto.
Construye 200 ataques de jailbreak a un agente de IA, ejecuta un red-team y clasifica 15 vulnerabilidades. Obtén tu certificado verificable.
El escenario
La scale-up (110 personas) tiene un comité de seguridad que bloquea releases sin red-team; la métrica clave del comité es no permitir vulnerabilidades de severidad alta en producción.
El Briefing
Lo que harás y lo que demostrarás.
Construir una suite de red-teaming automatizada y manual sobre un agente con herramientas peligrosas y entregar un informe de severidad con mitigaciones.
Earning criteria — what you'll demonstrate
- Diseñar ataques sistemáticos contra agentes con tool use
- Distinguir vulnerabilidades severidad alta vs. severidad baja con criterios claros
- Combinar evaluación automática y manual de forma complementaria
- Comunicar riesgos a un comité de seguridad con lenguaje accionable
Encaje académico
Dónde encaja esto en tus estudios.
Afina las mismas habilidades que tu titulación espera de ti.
AI Agents and LLM-Based Agents
Master · Ai Systems
Strong alignment
This challenge maps to AI Agents and LLM-Based Agents at the Master level. It sharpens the same practical skills your coursework expects — but in a real industry context with actual constraints and deliverables.
Habilidades
Habilidades que demostrarás.
Cada una aparece en tu credencial verificada.
- Red Teaming
Apply red teaming to solve real industry problems and demonstrate production-level capability.
- Prompt Injection
Apply prompt injection to solve real industry problems and demonstrate production-level capability.
- Agent Safety
Apply agent safety to solve real industry problems and demonstrate production-level capability.
- Adversarial Evaluation
Apply adversarial evaluation to solve real industry problems and demonstrate production-level capability.
- Python
Write clean, efficient Python for data processing, automation, and backend services.
- Llm Agents
Apply llm agents to solve real industry problems and demonstrate production-level capability.
Carreras
Roles para los que esto te prepara.
Títulos reales. Puentes de habilidades reales. Elige el que más se acerque a tu trayectoria.
Investigador en Seguridad de IA
Red-teaming sistemático con clasificación de severidad y mitigaciones es el oficio nuclear de quien ejerce de AI Safety Researcher en producto.
Este proyecto afina
- red-teaming
- agent-safety
- adversarial-evaluation
AI Engineer
Cualquier AI Engineer que despliegue agentes con herramientas peligrosas necesita haber pasado por este ejercicio antes de release.
Este proyecto afina
- llm-agents
- agent-safety
- python
Prompt Engineer
Diseñar prompts agresores y mitigaciones a nivel sistema es trabajo Prompt Engineer aplicado a seguridad.
Este proyecto afina
- prompt-injection
- adversarial-evaluation
- llm-agents