Audit d'alignement par préférences d'un assistant export multilingue
Aperçu
En quoi consiste ce défi.
Analysez un dossier d'incident pour diagnostiquer les dérives d'un assistant export multilingue et obtenez un certificat vérifiable.
Le brief
Ce que vous ferez, et ce que vous démontrerez.
L'équipe doit déterminer la cause principale des dérives de ton et de précision observées après le DPO, et recommander s'il faut ré-annoter les préférences, ajuster les paramètres d'entraînement, ou suspendre l'extension à d'autres marchés.
Earning criteria — what you'll demonstrate
- Diagnostiquer les causes d'une dérive de comportement après un alignement par préférences (DPO)
- Évaluer la qualité et les biais d'un jeu de données de paires de préférences
- Distinguer sur-optimisation d'alignement et oubli catastrophique à partir de résultats d'évaluation
- Concevoir une gouvernance de collecte de préférences adaptée à une petite organisation
Adéquation au programme
Où cela s'inscrit dans votre cursus.
Renforce les mêmes compétences que celles attendues par votre diplôme.
Cursus associés bientôt disponibles.
Compétences
Les compétences que vous démontrerez.
Chacune apparaît sur votre certificat vérifié.
Débouchés
Les métiers auxquels ce défi vous prépare.
De vrais intitulés. De vraies passerelles de compétences. Choisissez celui qui se rapproche le plus de votre trajectoire.
Les parcours de carrière que ce défi construit
Métiers de référenceAI Safety Researcher
Distinguer sur-optimisation d'alignement et oubli catastrophique à partir de preuves empiriques est un exercice central du travail d'un AI Safety Researcher étudiant les effets secondaires des méthodes d'alignement.
Ce défi renforce
- preference-optimization-dpo
- rlhf-fundamentals
- analytical-reasoning
Responsible AI Policy Consultant
La construction d'un plan de gouvernance de collecte de préférences prépare directement au conseil en politiques d'intelligence artificielle responsable pour des organisations sans expertise IA interne.
Ce défi renforce
- ai-governance-frameworks
- ai-bias-awareness
- dataset-curation-for-adaptation
AI-Compliance-Lead
L'audit d'un incident d'alignement de modèle et la formalisation de garde-fous reproduisent le travail quotidien d'un responsable conformité IA face à des dérives de production.
Ce défi renforce
- ai-governance-frameworks
- rlhf-fundamentals
- ai-bias-awareness