Skip to contentSkip to content
Certificados verificados. On-chain. Para sempre.Saiba mais
Ewance
Entrar
Cover image for Red team e detector de alucinação em assistente de segurança na mineração
Research

Red team e detector de alucinação em assistente de segurança na mineração

FreeVerified credential4 semanasExpert

Visão geral

Sobre o que é este desafio

Neste desafio, você cria 80 testes adversarial e um detector de alucinação para um assistente de mineração. Recebe um certificado verificável.

CredentialBlockchain-anchored
ShareableLinkedIn-ready
LanguageEnglish
PaceSelf-paced

O Brief

O que você vai fazer e o que vai demonstrar.

O assistente de IA responde perguntas de segurança com aparência de autoridade mesmo quando inventa números ou procedimentos, e a empresa não tem como medir com que frequência isso acontece nem como barrar essas respostas antes de liberá-lo em campo.

Earning criteria — what you'll demonstrate

  • Projetar uma campanha adversarial sistemática em vez de testes improvisados, cobrindo categorias de ataque com cobertura declarada
  • Implementar e medir um método de detecção de resposta não sustentada, reconhecendo os limites do próprio detector
  • Analisar a ética de implantar sistemas de linguagem em contextos onde o erro causa dano físico, incluindo a questão de quem responde pelo dano
  • Definir um critério de liberação verificável, ligando evidência técnica a uma decisão de governança
  • Comunicar risco técnico para uma audiência de segurança do trabalho que não programa

Adequação ao Programa

Onde isso se encaixa no seu programa.

Aperfeiçoa as mesmas habilidades que seu curso espera que você demonstre.

Conteúdo alinhado em breve.

Carreiras

Cargos para os quais este desafio te prepara.

Títulos reais. Pontes reais de habilidades. Escolha o mais próximo da sua trajetória.

Trilhas de carreira que este desafio desenvolve

Funções canônicas

Engenheiro de IA

Quem constrói produtos com modelos de linguagem precisa saber testá-los adversarialmente e barrar saídas não sustentadas antes do usuário. O desafio entrega prática direta em construir suíte de testes, detector de alucinação e critério de liberação em código versionado.

Este desafio aprimora

  • red-team-operations-for-foundation-models
  • hallucination-detection
  • adversarial-concepts

Engenheiro de Segurança

A campanha adversarial é uma investigação de segurança aplicada a um sistema de linguagem: mapear superfície de ataque, priorizar por gravidade e facilidade de exploração, e recomendar controles. Essa é a rotina do papel, transposta para um alvo novo.

Este desafio aprimora

  • adversarial-concepts
  • red-team-operations-for-foundation-models
  • ai-governance-frameworks

Líder de Conformidade em IA

A decisão de liberar ou não um sistema com base em evidência quantificada é o momento mais difícil dessa função. Aqui a pessoa define o critério de aprovação, o documenta e o defende diante de uma área que responde por vidas.

Este desafio aprimora

  • ai-governance-frameworks
  • ai-ethics
  • hallucination-detection

Só mais uma coisa

Você pode colocar um certificado no seu currículo até sexta-feira.