Data Science
Data Scientist
Irgendwo zwischen Forscher und Softwareentwickler sitzt der Data Scientist – die Person, die Fragen beantwortet, von denen ein Unternehmen gar nicht wusste, wie man sie stellen sollte. Die Arbeit vereint Statistik, Programmierung und eine hartnäckige Weigerung, einfache Erklärungen zu akzeptieren.
In einer Woche entwirfst du vielleicht ein Experiment, um zu messen, ob eine neue Funktion tatsächlich zu mehr Nutzung führt, in der nächsten baust du ein Prognosemodell, das den Einstellungsplan für das nächste Jahr bestimmt. Studierende, die sowohl Matheunterricht als auch das Schreiben von Aufsätzen mochten, haben hier oft Erfolg.
Werkzeuge wie Python und PyMC werden zu täglichen Begleitern, aber die tiefere Fähigkeit ist es, die richtige Frage zu stellen. Exzellenz zeigt sich in einer Empfehlung, die sechs Monate später noch Bestand hat, weil die zugrundeliegende kausale Argumentation solide war.
Problem framing + experimental design + defending methodology to non-technical audiences are exactly the parts of the role AI augments but doesn't replace.
US$134,855 Mediangehalt in United States¹
Empfohlene Industrieprojekte
· Nur Fortgeschritten Zurücksetzen- AnalysisMittelstufeNeu
Customer-Lifetime-Value-Modell für einen Energieversorger
Du erhältst anonymisierte Vertragsdaten (5 Jahre, 1,4 Mio. Kund:innen), monatliche Abrechnungen und Akquisitions-Kanal-Information. Implementiere zwei Ansätze: (1) Probabilistis…
- Clv Modeling
- Probabilistic Models
- Xgboost
Data Mining and Information Retrieval - AnalysisMittelstufeNeu
MCMC vs. Variational Inference fuer Versicherungs-Schadenmodell
Du erhaeltst 5 Jahre anonymisierter Hausrat-Schadendaten (rund 280.000 Vertraege, rund 22.000 Schadenfaelle) plus die bestehende Modellspezifikation: hierarchisches Tweedie-GLM …
- Mcmc
- Variational Inference
- Hierarchical Models
Probabilistic Machine Learning - AnalysisMittelstufeNeu
Frequent-Pattern-Mining auf Clickstream-Daten eines AdTech-Anbieters
Du erhältst Bid-Logs (anonymisiert, ohne PII — personenbezogene Daten) als Parquet-Dateien (rund 600 GB) und einen Conversion-Join-Datensatz. Definiere Items sinnvoll (Domain-Ha…
- Frequent Pattern Mining
- Fp Growth
- Pyspark
Data Mining and Information Retrieval - ResearchMittelstufeNeu
Knowledge-Graph-Embeddings für Produktempfehlungen
Du bekommst Interaktions-Daten von 80.000 Lernenden mit 6.000 Kursen plus eine Themen-Taxonomie (1.200 Themen) und die Empfehlungs-Ergebnisse der heutigen Kollaborativen Filteru…
- Knowledge Graphs
- Graph Embeddings
- Transe
Fachübergreifend Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodeMittelstufeNeu
Optimierung der Ladeinfrastruktur-Flotte für ein E-Logistik-Startup
Sie agieren als Data Science Consultant und entwickeln ein präskriptives Optimierungsmodell für die Ladeplanung und Flotteneinsatzsteuerung. Ihr Auftrag umfasst: (1) Analyse his…
- Optimization
- Simulation
- Predictive Analytics
Business Analytics - CodeMittelstufeNeu
Anomalie-Erkennung in Sensor-Daten einer süddeutschen Windparks
Du erhältst 18 Monate 10-minütiger SCADA-Daten von 80 Turbinen (Vibration, Drehzahl, Drehmoment, Außen-Temperatur, Leistung) und ein Wartungs-Log mit 35 bestätigten Schadens-Ere…
- Time Series
- Anomaly Detection
- Signal Decomposition
Time Series Analysis and Forecasting - CodeMittelstufeNeu
GNN-basierte Betrugserkennung für ein Zahlungs-Netzwerk
Du bekommst zwei Wochen anonymisierter Transaktionen als gerichteter bipartiter Graph (rund 280k Nutzer-Knoten, 12k Händler-Knoten, 1,2 Mio. Kanten) plus Betrugs-Labels. Impleme…
- Graph Neural Networks
- Graphsage
- Pytorch Geometric
Machine Learning on Graphs - ResearchMittelstufeNeu
Topic-Modeling für österreichisches Sozialwissenschafts-Lab
Sie erhalten den Korpus mit Zeitstempeln und Forum-Quellen (anonymisiert). Implementieren Sie drei Ansätze: (1) klassisches LDA mit gensim, (2) BERTopic mit deutschen Sentence-E…
- Topic Modeling
- Bertopic
- Lda
Fachübergreifend - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- CodeMittelstufeNeu
Fine-Tuning eines Sprachmodells für regulatorische Dokumente in der Pharma-Branche
Euer Team erhält einen anonymisierten Korpus von 8.000 regulatorischen Dokumenten mit bestehenden Kategorien aus dem Dokumentenmanagementsystem. Eure Aufgabe ist es, ein vortrai…
- Natural Language Processing
- Large Language Models
- Fine Tuning
Text Analytics and Natural Language Processing - CodeMittelstufeNeu
Forecast-Capstone für Frankfurter Energiehändler
Sie erhalten drei Jahre historischer Stundenpreise, Wind- und Solar-Einspeise-Forecasts, Last-Forecasts und Gas-Spotpreise (alles öffentlich zugängliche Daten). Bauen Sie drei M…
- Time Series Forecasting
- Feature Engineering
- Lightgbm
AI/ML Practicum and Hands-on Lab - AnalysisMittelstufeNeu
Link-Analyse für Lieferketten-Risiken in einem Lebensmittelkonzern
Du erhältst einen anonymisierten Lieferanten-Datensatz (Tier-1 und Tier-2-Beziehungen, Warenkategorien, Länder, Volumen) sowie ein historisches Disruption-Set (12 dokumentierte …
- Link Analysis
- Graph Analytics
- Networkx
Data Mining and Knowledge Discovery - AnalysisMittelstufeNeu
Off-Policy-Evaluation fuer Recommender-Wechsel bei Stuttgarter Streamingdienst
Du erhaeltst 4 Wochen anonymisierter Empfehlungs-Logs der alten Policy (Aktion = empfohlener Track, Reward = abgespielt > 30 Sekunden, plus die loggende Policy-Wahrscheinlichkei…
- Off Policy Evaluation
- Importance Sampling
- Doubly Robust
Reinforcement Learning Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- CodeMittelstufeNeu
Change-Point-Detektion in Transaktions-Daten einer Frankfurter Bank
Du erhältst einen anonymisierten Datensatz von rund 12.000 Geschäfts-Kund:innen mit 24 Monaten täglicher Transaktions-Aggregat-Statistik (Anzahl, Volumen, Durchschnitt, Standard…
- Time Series
- Change Point Detection
- Anomaly Detection
Time Series Analysis and Forecasting - ResearchMittelstufeNeu
Modellselektion fuer einen Photovoltaik-Anlagenbauer
Du erhaeltst 18 Monate halbstuendliche Daten von rund 120 Anlagen: meteorologische Vorhersage, historische Ertraege, Anlagenkonfiguration, Saison. Implementiere die drei Kandida…
- Model Selection
- Cross Validation
- Regression
Machine Learning - AnalysisMittelstufeNeu
Anti-Fraud-Graph-Analyse für einen österreichischen Telekommunikations-Anbieter
Du erhältst einen anonymisierten 14-Tage-Datensatz von rund 80 Millionen Call Detail Records (CDR — Anrufdetail-Datensätze) mit pseudonymisierten Nummern, Zeitstempeln, Anrufdau…
- Network Analysis
- Graph Algorithms
- Anomaly Detection
Social Network Analysis and Web Science - CodeMittelstufeNeu
Day-Ahead-Lastprognose für einen Hamburger Stromversorger
Du erhältst 3 Jahre stündlicher Last-Daten (rund 26.000 Stunden) für eine Bilanzgruppe sowie historische Wetter-Daten (Temperatur, Bewölkung, Windgeschwindigkeit) aus drei Wette…
- Time Series
- Forecasting
- Sarima
Time Series Analysis and Forecasting - CodeMittelstufeNeu
Prognosemodell für Maschinenstillstände im Spritzguss
Du trittst als Data Scientist (datenwissenschaftliche:r Experte:in) in einem 3er-Team auf und entwickelst innerhalb von 3 Wochen ein prädiktives Wartungsmodell. Du erhältst eine…
- Machine Learning
- Data Preprocessing
- Time Series Analysis
Data Science for Business - CodeMittelstufeNeu
VAE-basierte Anomalie-Erkennung für Banküberweisungen
Du bekommst 1,2 Mio. anonymisierte legitime Transaktionen, 4.000 als auffällig markierte Transaktionen und das heutige Regel-Set. Trainiere ein VAE auf den legitimen Daten, nutz…
- Vae
- Generative Models
- Anomaly Detection
Generative AI - CodeMittelstufeNeu
Bayesianische Logistische Regression für medizinische Risiko-Scores
Du erhältst einen anonymisierten Datensatz von rund 18.000 stationären Aufnahmen mit 35 Features (Vitalwerte, Anamnese-Indikatoren, Labor-Ergebnisse) und einem 30-Tage-Wiederauf…
- Bayesian Statistics
- Logistic Regression
- Uncertainty Quantification
Statistical Machine Learning - CodeMittelstufeNeu
MapReduce-Pipeline für Fahrzeug-Fehlerdiagnose in der Serienproduktion
Implementiere eine MapReduce-Pipeline (z. B. mit Apache Hadoop oder einem simulierten Framework), die die 30 Millionen Datensätze auf kritische Fehlermuster prüft. Definiere min…
- Mapreduce
- Distributed Computing
- Big Data Processing
Big Data and Cloud Technologies - AnalysisMittelstufeNeu
Werbeerfolgsanalyse und Budgetoptimierung für einen Automobilzulieferer in Stuttgart
Sie agieren als Marketing Data Scientist und führen eine umfassende Werbeerfolgsanalyse für den beschriebenen Automobilzulieferer durch. Bereinigen und strukturieren Sie die vor…
- Marketing Attribution
- Budget Optimization
- Data Visualization
Marketing Communication and Advertising - CodeMittelstufeNeu
Bayessche Nachfrageprognose für einen schweizer FMCG-Hersteller
Du erhältst drei Jahre wöchentlicher Verkaufsdaten für 120 Stock-Keeping-Units (SKUs — Lagerhaltungseinheiten) über 8 Vertriebsregionen plus eine Tabelle der historischen Promot…
- Bayesian Inference
- Probabilistic Modeling
- Time Series
Advanced Machine Learning - AnalysisMittelstufeNeu
Dimensionsreduktion fuer Spektroskopie-Qualitaetskontrolle
Du erhaeltst rund 80 000 Linsen mit je einem 2 000-dimensionalen Spektrum plus optionale Schadenslabels (nur fuer rund 5 000 Linsen). Vergleiche drei Dimensionsreduktions-Verfah…
- Dimensionality Reduction
- Anomaly Detection
- Unsupervised Learning
Machine Learning - CodeMittelstufeNeu
Bedarfs-Prognose für die Lager-Logistik eines Wiener FMCG-Distributors
Du erhältst 3 Jahre Wochen-Verkaufs-Daten für rund 1.200 SKUs in 4 Lagern (rund 250.000 SKU-Lager-Wochen-Kombinationen) plus eine Promotion-Liste pro SKU und Woche. Implementier…
- Time Series
- Hierarchical Forecasting
- Demand Forecasting
Time Series Analysis and Forecasting - CodeMittelstufeNeu
Bayessches Netz fuer Pharmakovigilanz-Signale modellieren
Du erhaeltst rund 18.000 anonymisierte Spontanmeldungen im standardisierten ICH-E2B-Format (internationaler Datenstandard fuer Nebenwirkungsmeldungen). Definiere zunaechst per D…
- Bayesian Networks
- Structure Learning
- Probabilistic Inference
Probabilistic Graphical Models - CodeMittelstufeNeu
Lieferzeit-Prognose für einen Hamburger Logistikdienstleister verbessern
Sie erhalten eine Parquet-Datei mit etwa 800.000 Sendungen (Abholzeit, Übergabezeit, Empfänger-PLZ, Gewicht, Sendungsart, Wetterdaten aus DWD). Reinigen Sie Ausreißer und Geschä…
- Feature Engineering
- Regression Modeling
- Data Wrangling
Applied Data Analysis and Practical Data Science - ResearchMittelstufeNeu
Bandit-Optimierung für Onboarding-Personalisierung bei einem Wiener EdTech
Du erhältst einen historischen Datensatz von 80.000 Onboarding-Sitzungen mit 5 Kontext-Features pro Nutzer (Sprachniveau, Plattform, Tageszeit, Quelle, Altersgruppe) und der his…
- Multi Armed Bandits
- Reinforcement Learning
- Experiment Design
Advanced Machine Learning - CodeMittelstufeNeu
Recommendation-System für einen DACH-E-Commerce-Marktplatz
Du erhältst anonymisierte Session-Daten (rund 18 Mio. Sessions, 6 Mio. unique User), Produktmetadaten und 90 Tage Conversion-Daten. Implementiere drei Modelle: (1) Item-kNN als …
- Recommendation Systems
- Collaborative Filtering
- Matrix Factorization
Data Mining and Information Retrieval - CodeMittelstufeNeu
SHAP-Erklärungen für ein Kredit-Scoring-Modell unter EU-AI-Act
Du erhältst ein vorhandenes XGBoost-Modell, einen anonymisierten Datensatz von 12.000 abgeschlossenen Anträgen plus die Kundenkommunikations-Richtlinie der Bank. Berechne SHAP-W…
- Shap
- Model Interpretability
- Explainable Ai
Explainable and Interpretable AI - CodeMittelstufeNeu
Gaussian Process fuer Solarprognose im Schwarzwald kalibrieren
Du erhaeltst 2 Jahre stuendlicher Erzeugungsdaten je Anlage plus DWD-Wettervorhersage-Features (Globalstrahlung, Temperatur, Bewoelkung, Stunde, Wochentag). Definiere fuer jede …
- Gaussian Processes
- Bayesian Inference
- Uncertainty Quantification
Probabilistic Machine Learning - AnalysisMittelstufeNeu
Datengetriebene Kampagnenoptimierung für ein B2B-Fintech-Startup
Analysiere die vorhandenen Kampagnendaten, identifiziere die erfolgreichsten Kanäle und Touchpoints entlang der Customer Journey (Kundenreise), und entwickle ein datengestütztes…
- Marketing Analytics
- Customer Journey Mapping
- Conversion Rate Optimization
Marketing Management - AnalysisMittelstufeNeu
Ensemble-Vergleich für die Churn-Prognose bei einem Telco
Du erhältst einen anonymisierten Vertrags-Datensatz von rund 480.000 Privatkund:innen mit 65 Features (Vertragsdaten, Verbrauchsverhalten, Service-Tickets) und einem 90-Tage-Chu…
- Ensemble Methods
- Gradient Boosting
- Statistical Learning
Statistical Machine Learning - AnalysisMittelstufeNeu
Patient:innen-Reise-Visualisierung für ein Klinikverbund-Analyse-Team
Du erhältst einen administrativen Datensatz (rund 180.000 Aufenthalte, anonymisiert, keine klinischen Inhalte — nur Aufnahme-Diagnose-Codes, Stationen, Liegezeiten). Modelliere …
- Sankey Diagrams
- Process Mining
- Interactive Visualization
Data Visualization
So funktioniert's
Vom Briefing zum Zertifikat – in sechs Schritten.
Schritt 01
Durchsuche Challenges passend zu Deinem Studium.
Schritt 02
Wähle das Projekt, das zu Deinen Zielen passt.
Schritt 03
Arbeite es mit Hilfe des AI Copiloten durch.
Schritt 04
Reiche es zur strukturierten Bewertung ein.
Schritt 05
Erhalte ein verifiziertes Zertifikat.
Schritt 06
Füge es Deinem LinkedIn-Profil mit einem Klick hinzu.
Verwandte Rollen, die Dich interessieren könnten
Alle Rollen ansehen →Branchenteams hinter einem Jahrzehnt praxisorientierter Briefings
Aus diesem Pool einstellen?
Sponsere eine Challenge und lerne Kandidaten durch ihre tatsächliche Arbeit kennen.
Industrieteams können Briefings rund um die Fähigkeiten gestalten, die sie suchen, und Studierende anhand von bewertungsmatrix-gestützten Ergebnissen beurteilen – nicht anhand von Lebensläufen.
¹ Mediangehalt berechnet aus der Gehaltsverteilung von 50 aktuellen Adzuna-Stellenanzeigen für „Data Scientist" in United States, abgerufen am Mai 2026. Die Fähigkeiten stammen aus den Disziplinen, die auf aktiven Ewance-Challenges für diese Rolle getaggt sind.
Porträt: Foto von Jake Nackos auf Unsplash.



















































































