Projeto de supervisão escalável para sistema de moderação de conteúdo com IA Constitucional
Visão geral
Sobre o que é este desafio
Analise falhas de moderação, reprojete princípios e implemente um evaluation harness para uma plataforma edtech. Ganhe um certificado verificável.
O Brief
O que você vai fazer e o que vai demonstrar.
Como reprojetar os princípios constitucionais e a arquitetura de supervisão para eliminar o viés contra variantes linguísticas regionais, manter a qualidade da moderação e escalar para o volume crescente de postagens?
Earning criteria — what you'll demonstrate
- Projetar e avaliar princípios de IA Constitucional (Constitutional AI) que sejam robustos a variação linguística e cultural
- Implementar um sistema de supervisão escalável (scalable oversight) que combine revisão humana estratificada com avaliação automática
- Construir um evaluation harness que meça equidade de desempenho de IA entre grupos linguísticos distintos
- Analisar trade-offs entre cobertura de moderação, latência de decisão e custo de revisão humana em escala
- Aplicar técnicas de capability evaluation (avaliação de capacidades) para medir se o sistema reprojetado resiste a adversarial inputs
Adequação ao Programa
Onde isso se encaixa no seu programa.
Aperfeiçoa as mesmas habilidades que seu curso espera que você demonstre.
Conteúdo alinhado em breve.
Habilidades
Habilidades que você vai demonstrar.
Cada um aparece no seu certificado verificado.
Carreiras
Cargos para os quais este desafio te prepara.
Títulos reais. Pontes reais de habilidades. Escolha o mais próximo da sua trajetória.
Pesquisador(a) de Segurança em IA
O projeto de princípios constitucionais e testes adversariais desenvolve competências de pesquisa em segurança de IA, onde avaliar e fortalecer mecanismos de alinhamento contra falhas sistemáticas é a atividade central.
Este desafio aprimora
- adversarial-concepts
- agent-evaluation
- ai-bias-awareness
AI-Compliance-Lead
A proposta de governança contínua e a análise de equidade regional preparam para liderar programas de conformidade que garantam que sistemas de IA cumpram requisitos de não discriminação e transparência.
Este desafio aprimora
- ai-governance-frameworks
- ai-bias-awareness
- ai-augmented-decision-making
Cientista de IA Aplicada
A implementação do evaluation harness e a otimização da arquitetura de supervisão desenvolvem habilidades práticas de construir e avaliar sistemas de IA em produção com restrições reais de escala e custo.
Este desafio aprimora
- agent-evaluation
- ai-augmented-decision-making
- adversarial-concepts
Pesquisador de Segurança em IA
A reformulação de mecanismos de alinhamento (princípios constitucionais) e a construção de protocolos de teste adversarial são competências diretamente aplicáveis à pesquisa em segurança e robustez de modelos de linguagem.
Este desafio aprimora
- adversarial-concepts
- ai-governance-frameworks
- agent-evaluation
Só mais uma coisa