Audit d'alignement par préférences d'un assistant export multilingue
Aperçu
En quoi consiste ce défi.
Analysez un dossier d'incident pour diagnostiquer les dérives d'un assistant export multilingue et obtenez un certificat vérifiable.
Le scénario
Rapport d'incident interne « Assistant Export Multilingue — Revue Post-Pilote », couvrant huit semaines de déploiement limité au marché japonais et compilant les retours de la représentante commerciale locale et les journaux de conversation.
Le brief
Ce que vous ferez, et ce que vous démontrerez.
L'équipe doit déterminer la cause principale des dérives de ton et de précision observées après le DPO, et recommander s'il faut ré-annoter les préférences, ajuster les paramètres d'entraînement, ou suspendre l'extension à d'autres marchés.
Earning criteria — what you'll demonstrate
- Diagnostiquer les causes d'une dérive de comportement après un alignement par préférences (DPO)
- Évaluer la qualité et les biais d'un jeu de données de paires de préférences
- Distinguer sur-optimisation d'alignement et oubli catastrophique à partir de résultats d'évaluation
- Concevoir une gouvernance de collecte de préférences adaptée à une petite organisation
Adéquation au programme
Où cela s'inscrit dans votre cursus.
Renforce les mêmes compétences que celles attendues par votre diplôme.
Cursus associés bientôt disponibles.
Compétences
Les compétences que vous démontrerez.
Chacune apparaît sur votre certificat vérifié.
- Preference Optimization Dpo
Apply preference optimization dpo to solve real industry problems and demonstrate production-level capability.
- Rlhf Fundamentals
Apply rlhf fundamentals to solve real industry problems and demonstrate production-level capability.
- Ai Bias Awareness
Apply ai bias awareness to solve real industry problems and demonstrate production-level capability.
- Dataset Curation For Adaptation
Apply dataset curation for adaptation to solve real industry problems and demonstrate production-level capability.
- Ai Governance Frameworks
Apply ai governance frameworks to solve real industry problems and demonstrate production-level capability.
- Analytical Reasoning
Apply analytical reasoning to solve real industry problems and demonstrate production-level capability.
Débouchés
Les métiers auxquels ce défi vous prépare.
De vrais intitulés. De vraies passerelles de compétences. Choisissez celui qui se rapproche le plus de votre trajectoire.
Les parcours de carrière que ce défi construit
Métiers de référenceAI Safety Researcher
Distinguer sur-optimisation d'alignement et oubli catastrophique à partir de preuves empiriques est un exercice central du travail d'un AI Safety Researcher étudiant les effets secondaires des méthodes d'alignement.
Ce défi renforce
- preference-optimization-dpo
- rlhf-fundamentals
- analytical-reasoning
Responsible AI Policy Consultant
La construction d'un plan de gouvernance de collecte de préférences prépare directement au conseil en politiques d'intelligence artificielle responsable pour des organisations sans expertise IA interne.
Ce défi renforce
- ai-governance-frameworks
- ai-bias-awareness
- dataset-curation-for-adaptation
AI-Compliance-Lead
L'audit d'un incident d'alignement de modèle et la formalisation de garde-fous reproduisent le travail quotidien d'un responsable conformité IA face à des dérives de production.
Ce défi renforce
- ai-governance-frameworks
- rlhf-fundamentals
- ai-bias-awareness