Instruction-Tuning-Dataset fuer Domaenen-Spezialisierung im Pharma-Bereich
Übersicht
Worum es bei diesem Projekt geht.
Erstelle ein Pharma-Dataset, annotiere 500 Beispiele und trainiere mit LoRA. Bewerte das Modell und erhalte ein verifizierbares Zertifikat.
Das Szenario
Generische LLMs scheitern an pharmazeutischer Fachterminologie und Sicherheits-Constraints; gleichzeitig kann ein zu aggressives Finetuning die Verweigerungs-Disziplin auswaschen ('alignment tax'). Eine ehrliche Trade-off-Berichterstattung ist die Voraussetzung fuer den naechsten Budget-Antrag der Pharma-IT.
Das Briefing
Was Du tust und was Du zeigst.
Designe und pilotiere ein Instruction-Tuning-Dataset fuer pharma-chemische Aufgaben und bewerte den Trade-off zwischen Domaenen-Gewinn und Sicherheits-Erosion.
Earning criteria — what you'll demonstrate
- Dataset-Design als zentrale Variable in Instruction-Tuning verstehen
- Annotations-Guidelines so verfassen, dass Inter-Annotator-Agreement hoch bleibt
- Domaenen-Gewinn und Sicherheits-Erosion getrennt messen
- Alignment-Tax als ehrlich kommunizierbares Konzept etablieren
Studienpassung
Wo dies in Dein Studium passt.
Schärft dieselben Fähigkeiten, die Dein Studium von Dir erwartet.
Studienzuordnung folgt in Kürze.
Fähigkeiten
Fähigkeiten, die Du unter Beweis stellst.
Jede taucht auf Deinem verifizierten Zertifikat auf.
- Instruction Tuning
Apply instruction tuning to solve real industry problems and demonstrate production-level capability.
- Supervised Finetuning
Apply supervised finetuning to solve real industry problems and demonstrate production-level capability.
- Dataset Design
Apply dataset design to solve real industry problems and demonstrate production-level capability.
- Lora
Apply lora to solve real industry problems and demonstrate production-level capability.
- Alignment Evaluation
Apply alignment evaluation to solve real industry problems and demonstrate production-level capability.
- Domain Specialization
Apply domain specialization to solve real industry problems and demonstrate production-level capability.
Karrieren
Berufe, auf die dies Dich vorbereitet.
Echte Berufsbezeichnungen. Echte Skill-Brücken. Wähle die, die Deinem Werdegang am nächsten kommt.
ML Researcher
Instruction-Tuning-Dataset-Design mit ehrlicher Alignment-Tax-Bewertung ist Kerngebiet von ML Researchers in domaenenspezifischen Foundation-Modell-Teams.
Dieses Projekt schärft
- instruction-tuning
- dataset-design
- domain-specialization
AI Safety Researcher
Alignment-Tax messbar zu machen ist eine seltene und gefragte Faehigkeit fuer AI Safety Researchers in Industrie und Foundation-Laboren.
Dieses Projekt schärft
- alignment-evaluation
- supervised-finetuning
- instruction-tuning
Applied AI Scientist
Domaenen-Spezialisierung mit Sicherheits-Disziplin auszuliefern und der IT-Leitung verstaendlich zu argumentieren ist die Tag-eins-Arbeit eines Applied AI Scientists in regulierten Branchen.
Dieses Projekt schärft
- lora
- domain-specialization
- alignment-evaluation
Noch eine Sache