Red team e detector de alucinação em assistente de segurança na mineração
Visão geral
Sobre o que é este desafio
Neste desafio, você cria 80 testes adversarial e um detector de alucinação para um assistente de mineração. Recebe um certificado verificável.
O Brief
O que você vai fazer e o que vai demonstrar.
O assistente de IA responde perguntas de segurança com aparência de autoridade mesmo quando inventa números ou procedimentos, e a empresa não tem como medir com que frequência isso acontece nem como barrar essas respostas antes de liberá-lo em campo.
Earning criteria — what you'll demonstrate
- Projetar uma campanha adversarial sistemática em vez de testes improvisados, cobrindo categorias de ataque com cobertura declarada
- Implementar e medir um método de detecção de resposta não sustentada, reconhecendo os limites do próprio detector
- Analisar a ética de implantar sistemas de linguagem em contextos onde o erro causa dano físico, incluindo a questão de quem responde pelo dano
- Definir um critério de liberação verificável, ligando evidência técnica a uma decisão de governança
- Comunicar risco técnico para uma audiência de segurança do trabalho que não programa
Adequação ao Programa
Onde isso se encaixa no seu programa.
Aperfeiçoa as mesmas habilidades que seu curso espera que você demonstre.
Conteúdo alinhado em breve.
Habilidades
Habilidades que você vai demonstrar.
Cada um aparece no seu certificado verificado.
Carreiras
Cargos para os quais este desafio te prepara.
Títulos reais. Pontes reais de habilidades. Escolha o mais próximo da sua trajetória.
Trilhas de carreira que este desafio desenvolve
Funções canônicasEngenheiro de IA
Quem constrói produtos com modelos de linguagem precisa saber testá-los adversarialmente e barrar saídas não sustentadas antes do usuário. O desafio entrega prática direta em construir suíte de testes, detector de alucinação e critério de liberação em código versionado.
Este desafio aprimora
- red-team-operations-for-foundation-models
- hallucination-detection
- adversarial-concepts
Engenheiro de Segurança
A campanha adversarial é uma investigação de segurança aplicada a um sistema de linguagem: mapear superfície de ataque, priorizar por gravidade e facilidade de exploração, e recomendar controles. Essa é a rotina do papel, transposta para um alvo novo.
Este desafio aprimora
- adversarial-concepts
- red-team-operations-for-foundation-models
- ai-governance-frameworks
Líder de Conformidade em IA
A decisão de liberar ou não um sistema com base em evidência quantificada é o momento mais difícil dessa função. Aqui a pessoa define o critério de aprovação, o documenta e o defende diante de uma área que responde por vidas.
Este desafio aprimora
- ai-governance-frameworks
- ai-ethics
- hallucination-detection
Só mais uma coisa