KI & Daten
NLP Industrieprojekte
NLP-Challenges versetzen dich mitten in die Arbeit, Maschinen das Lesen und Verstehen von Sprache beizubringen. Du entwickelst Fähigkeiten in den Grundlagen von Natural Language Processing (NLP), Text-Tokenisierung und Word Embeddings sowie in Aufgaben wie Named Entity Recognition (NER) und Sequence Labeling mit NLTK.
Von dort meisterst du die kniffligeren Themen — Encoder-Fine-Tuning (BERT-Familie) mit Hugging Face Transformers, Custom Tokenization, Relation Extraction, Information Retrieval und Mehrsprachiges NLP — und baust Wissensrepräsentation auf, wie es echte NLP-Teams tun. Jede gelöste Challenge bringt dir einen verifizierten Nachweis für Recruiter.
- CodeMittelstufeNeu
Multimodale Produkt-Beschreibungs-Pipeline für einen Marktplatz
Du bekommst 5.000 Beispiel-Produkte mit Bild, strukturierten Attributen (Material, Maße, Farben) und vom Redaktions-Team verfassten Referenz-Beschreibungen. Setze eine Pipeline …
- Multimodal Generation
- Vision Language Models
- LLM Evaluation
Generative AI - CodeMittelstufeNeu
Empfehlungssystem für ein Berliner Musik-Streaming-Startup
Du erhältst einen anonymisierten Listen-Datensatz von rund 600.000 Nutzer:innen und 90.000 Tracks (rund 35 Millionen Listen-Events der letzten 12 Wochen). Implementiere (1) eine…
- Recommender Systems
- Collaborative Filtering
- Embeddings
Social Network Analysis and Web Science - CodeMittelstufeNeu
Description-Logic-Reasoner für Produktkonfigurations-Regeln
Du bekommst die heutige Excel-Konfigurations-Tabelle, 12 typische Kundenkonfigurations-Anfragen und die formalisierten Regeln aus zwei Workshops mit den Vertriebs-Ingenieurinnen…
- Description Logic
- Owl
- Knowledge Representation
Fuzzy Logic, Knowledge Representation, and Symbolic Reasoning - ResearchSeniorNeu
Sentiment-Shift-Erkennung in der Solar-Industrie-Debatte
Erstelle ein prototypisches Frühwarnsystem für Sentiment-Shift-Erkennung in der deutschsprachigen Solar-Industrie-Debatte. Sammle über einen definierten Zeitraum von mindestens …
- Social Media Data
- Natural Language Processing
- Time Series Analysis
Social Media and Web Analytics Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodeMittelstufeNeu
Information-Retrieval-Index für ein Versicherungs-Wissensportal
Du erhältst den Dokumenten-Korpus (anonymisiert, juristische Texte) und ein Test-Set mit 250 Suchanfragen plus erwarteten Treffern. Baue eine Pipeline: (1) Dokument-Preprocessin…
- Information Retrieval
- Bm25
- Embeddings
Data Mining and Information Retrieval - ResearchMittelstufeNeu
Niedrigressourcen-MT fuer Schweizerdeutsch in einer Bundesverwaltung
Du erhaeltst rund 12 000 parallele Saetze (Schweizerdeutsch → Standarddeutsch) plus rund 100 000 einsprachige Saetze in Schweizerdeutsch. Implementiere Backtranslation: trainier…
- Neural Machine Translation
- Data Augmentation
- Low Resource Mt
Machine Translation - CodeMittelstufeNeu
Semantische Suche für ein Kölner Rechtsverlags-Portal aufbauen
Sie erhalten 50.000 anonymisierte Urteile und ein Test-Set von 80 Anwältinnen-Suchanfragen mit redaktionell gelabelten relevanten Dokumenten (Recall@10 als Hauptmetrik). Bauen S…
- Distributional Semantics
- Embeddings
- Information Retrieval
Computational Semantics - AnalysisEinsteigerNeu
Maschinelle Übersetzung post-edit-Bewertung für ein Schweizer Lokalisierungs-Team
Du erhältst 4.000 Quelltexte (Software-Strings + technische Doku) mit Übersetzungs-Goldstandard und Post-Editing-Logs (Zeit, Edits, Edit-Typ). Implementiere ein Framework mit (1…
- Machine Translation
- Evaluation
- Comet
Linguistic Engineering and Language Technologies - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- ResearchEinsteigerNeu
Word-Embedding-Vergleich für Stuttgarter Automotive-NLP-Team
Sie erhalten 280.000 deutsche Werkstatt-Reports. Trainieren Sie zwei Embedding-Varianten von Grund auf auf der Domäne: (1) Word2Vec mit Skip-Gram, (2) FastText (handhabt OOV-Wör…
- Word Embeddings
- Word2vec
- Fasttext
Neural Networks for NLP - CodeEinsteigerNeu
Semantische Vertragssuche für eine Legal-Tech-Kanzlei aufbauen
Du erhältst 5.000 anonymisierte deutsche Vertragsklauseln (Mustertexte) plus 20 gelabelte Suchanfragen mit jeweils 5-10 erwarteten Treffern. Wende zwei Embedding-Modelle an (ein…
- Vector Search
- Embeddings
- Semantic Search
Vector Databases and Embeddings - CodeMittelstufeNeu
QLoRA auf Consumer-Hardware für ein juristisches Modell
Du bekommst 3.500 anonymisierte Schriftsätze (rund 20 MB Text), die Kanzlei-Style-Guide und Zugriff auf eine RTX-4090. Setze QLoRA mit bitsandbytes auf, trainiere zwei Varianten…
- Qlora
- Lora
- Supervised Fine Tuning
Fine-Tuning Large Language Models - CodeEinsteigerNeu
Hybride Suche für ein LegalTech-Such-Startup aufbauen
Du erhältst einen Korpus von 25.000 deutschsprachigen Rechtsdokumenten (anonymisiert, frei verfügbar aus offenen Bundesquellen) sowie 200 Anfragen mit Goldstandard-Treffern (dre…
- Information Retrieval
- Bm25
- Dense Retrieval
Information Retrieval and Search Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- ResearchSeniorNeu
Catastrophic-Forgetting-Studie nach Domain-Fine-Tuning
Du bekommst Zugriff auf das fine-getunte Modell und das Basismodell, eine Auswahl Standard-Benchmarks (MMLU-Subset, HumanEval-Lite, GSM8K-Stichprobe) und 8.000 generische Traini…
- Catastrophic Forgetting
- Continual Learning
- LLM Evaluation
Fine-Tuning Large Language Models - CodeMittelstufeNeu
Neuronale MT-Domaenenadaption fuer einen Maschinenbau-Dokumentationsanbieter
Du erhaeltst rund 200 000 parallele Saetze Deutsch-Englisch aus Wartungsanleitungen und Bedienhandbuechern eines Maschinenbau-Korpus. Wahle ein vortrainiertes Modell (z. B. Hels…
- Neural Machine Translation
- Domain Adaptation
- Fine Tuning
Machine Translation - CodeEinsteigerNeu
NLP-Klassifikator für Support-Tickets eines Berliner Insurtechs
Sie erhalten 60.000 anonymisierte deutschsprachige Support-Tickets mit bestehender Kategorienlabel. Trainieren Sie einen Klassifikator auf Basis eines vortrainierten deutschspra…
- NLP
- Transformer Fine Tuning
- Text Classification
Applied Machine Learning - CodeMittelstufeNeu
Fine-Tuning eines Sprachmodells für regulatorische Dokumente in der Pharma-Branche
Euer Team erhält einen anonymisierten Korpus von 8.000 regulatorischen Dokumenten mit bestehenden Kategorien aus dem Dokumentenmanagementsystem. Eure Aufgabe ist es, ein vortrai…
- Natural Language Processing
- Large Language Models
- Fine Tuning
Text Analytics and Natural Language Processing - CodeMittelstufeNeu
Diffusion-Modell für Modefotografie eines DTC-Labels
Du bekommst 200 Studio-Aufnahmen einer Sommer-Kollektion, den Stil-Guide des Labels und Zugriff auf eine gemietete A100-GPU. Trainiere zwei Varianten (Dreambooth full + LoRA), g…
- Diffusion Models
- Stable Diffusion
- Lora
Generative AI - ResearchMittelstufeNeu
Web-Science-Studie zur Themen-Polarisierung in DACH-Online-Foren
Du erhältst Zugriff auf ein deutschsprachiges Web-Forum-Archiv (öffentlich, anonymisiert; rund 1,2 Millionen Posts über 24 Monate). Wähle drei kontroverse Themen (z. B. Energiew…
- NLP
- Stance Detection
- Computational Social Science
Social Network Analysis and Web Science - CodeMittelstufeNeu
Structured Prediction für die Layoutextraktion in einem Düsseldorfer LegalTech
Du erhältst 4.000 annotierte deutsche Vertrags-PDFs mit pro Token gelabelten Klauselgrenzen, Sektionsgrenzen und Klauseltypen (15 Klassen). Trainiere zwei Modelle: (a) BERT-Base…
- Structured Prediction
- Conditional Random Fields
- Named Entity Recognition
Advanced Machine Learning - CodeSeniorNeu
Lexikalische Beschraenkungen fuer einen Pharma-Beipackzettel-Uebersetzer
Du erhaeltst rund 5 000 Beipackzettel-Saetze mit annotierten Pharma-Termini plus ein Glossar von rund 800 vorgeschriebenen Term-Uebersetzungen. Implementiere constrained beam se…
- Constrained Decoding
- Neural Machine Translation
- Domain Adaptation
Machine Translation - CodeEinsteigerNeu
Lexikalische Ressource für eine Tiroler Tourismus-Plattform
Du erhältst 30.000 Beschreibungstexte (DE/EN/IT-Mix) und drei bestehende inkonsistente Glossare. Baue eine Pipeline mit (1) automatischer Term-Extraktion aus den Beschreibungen …
- Lexical Resources
- Skos
- Term Extraction
Linguistic Engineering and Language Technologies - AnalysisMittelstufeNeu
Strategische Kommunikationsanalyse für ein B2B-Fintech in Berlin
Du erhältst einen vollständigen Korpus der öffentlichen Texte des Startups aus drei Jahren (Website-Texte, Blogartikel, Pressemitteilungen, Vertriebs-PDFs, LinkedIn-Posts). Nutz…
- Natural Language Processing
- Corpus Analysis
- Strategic Positioning
Text Analytics and Natural Language Processing - CodeEinsteigerNeu
Wikidata-basiertes Skills-Mapping für eine Hamburger HR-Plattform
Du erhältst 8.000 freie Skill-Strings aus der bisherigen Datenbank plus eine kuratierte Liste mit 200 Goldstandard-QIDs. Implementiere eine Pipeline mit (1) Vorverarbeitung (Nor…
- Entity Linking
- Wikidata
- Sparql
Knowledge Graphs and Semantic Web - CodeEinsteigerNeu
Brand-Monitoring-Dashboard für eine Düsseldorfer FMCG-Marke
Du erhältst einen Beispiel-Korpus von rund 25.000 deutschsprachigen Social-Posts aus einer akademischen Datenquelle (Reddit + öffentliche Foren, anonymisierte Autor:innen). Baue…
- NLP
- Sentiment Analysis
- Topic Modeling
Social Network Analysis and Web Science
So funktioniert's
Vom Briefing zum Zertifikat – in sechs Schritten.
Schritt 01
Durchsuche Challenges passend zu Deinem Studium.
Schritt 02
Wähle das Projekt, das zu Deinen Zielen passt.
Schritt 03
Arbeite es mit Hilfe des AI Copiloten durch.
Schritt 04
Reiche es zur strukturierten Bewertung ein.
Schritt 05
Erhalte ein verifiziertes Zertifikat.
Schritt 06
Füge es Deinem LinkedIn-Profil mit einem Klick hinzu.
Verwandte Kompetenzfelder
Alle Kompetenzen durchsuchenBranchenteams hinter einem Jahrzehnt praxisorientierter Briefings
Aus diesem Pool einstellen?
Sponsere eine Challenge und lerne Kandidaten durch ihre tatsächliche Arbeit kennen.
Industrieteams können Briefings rund um die Fähigkeiten gestalten, die sie suchen, und Studierende anhand von bewertungsmatrix-gestützten Ergebnissen beurteilen – nicht anhand von Lebensläufen.



















































































