Data Science
Data Engineer
Jedes clevere Dashboard, jedes Machine-Learning-Modell, jeder Executive Report ruht auf einer Infrastruktur, die jemand gebaut hat und wartet. Data Engineers bauen diese Infrastruktur. Sie entwerfen die Pipelines, die Informationen aus Produktionssystemen in Data Warehouses transportieren, wo Analysten und Data Scientists sie nutzen können, und sie halten diese Pipelines zuverlässig, während die Datenmengen wachsen.
Die Rolle passt zu Studierenden, die systemisches Denken mögen und sich dafür interessieren, wie Dinge unter Last tatsächlich funktionieren. Der Arbeitsalltag umfasst das Schreiben von Transformationen in dbt, das Planen von Jobs in Airflow und das leise Abfangen fehlerhafter Daten, bevor sie eine Entscheidungsträgerin oder einen Entscheidungsträger erreichen. Exzellenz zeigt sich in Pipelines, die niemand bemerkt, weil sie nie ausfallen.
Du wächst in diese Rolle hinein, indem du viel SQL schreibst, Python lernst und eine Cloud-Plattform gründlich beherrschst.
US$119,658 Mediangehalt in United States¹
- CodeEinsteigerNeu
dbt-Modelle für eine E-Commerce-Kennzahlenschicht standardisieren
Du erhältst einen Snapshot eines BigQuery-Datasets (Shopify-Export + ERP-Bestellungen + Marketing-Cost) sowie eine Liste der 12 wichtigsten Kennzahlen mit den jeweils 2-3 widers…
- Dbt
- SQL
- Data Modeling
Data Engineering and Big Data Systems - CodeEinsteigerNeu
Linked-Open-Data-Veröffentlichung für ein bayerisches Stadtarchiv
Du erhältst 2.500 Datensätze (Personen, Bauwerke, Ereignisse) als CSV plus eine Auswahl an Bilddateien. Modelliere mit FOAF, Dublin Core, schema.org und CIDOC-CRM (etabliertes M…
- Linked Open Data
- Rdf
- Sparql
Fachübergreifend - CodeEinsteigerNeu
Wikidata-basiertes Skills-Mapping für eine Hamburger HR-Plattform
Du erhältst 8.000 freie Skill-Strings aus der bisherigen Datenbank plus eine kuratierte Liste mit 200 Goldstandard-QIDs. Implementiere eine Pipeline mit (1) Vorverarbeitung (Nor…
- Entity Linking
- Wikidata
- Sparql
Knowledge Graphs and Semantic Web - AnalysisEinsteigerNeu
Daten-Kostenoptimierung für eine AdTech-Plattform durchführen
Du erhältst 6 Monate Snowflake-Query-History (anonymisiert), S3-Kosten pro Bucket sowie Airflow-Lauftabellen. Identifiziere die 10 teuersten Workloads, klassifiziere sie nach He…
- Cost Optimization
- SQL
- Snowflake
Data Engineering and Big Data Systems Practice your coursework on real scenarios.
Every challenge is shaped from real-world context — not generic exercises. The work mirrors what your degree prepares you for.
Why Ewance
- CodeMittelstufeNeu
Arzneimittel-Wissensgraph für ein Leverkusener Pharma-Unternehmen
Du erhältst 14 anonymisierte Excel-Tabellen (Wirkstoffe, Indikationen, Studien, Marktzulassungen) sowie drei bestehende Glossare. Modelliere die Domäne in OWL, nutze wo möglich …
- Ontology Modeling
- Rdf
- Owl
Fachübergreifend - AnalysisEinsteigerNeu
Datenlager-Konzeption für einen Mittelständler im Maschinenbau
Du erhältst ein anonymisiertes Datenmodell der drei Quellsysteme sowie eine Liste von 12 typischen Geschäftsfragen des Unternehmens (zum Beispiel: 'Welche Kundensegmente generie…
- Data Modeling
- Etl Design
- SQL
Business Intelligence - CodeEinsteigerNeu
Datenpipeline-Migration auf BigQuery für einen Wiener E-Commerce
Sie erhalten die Schemata der drei Tabellen (orders, products, customers), die aktuellen ETL-Skripte und die Standardberichte des Reporting-Teams. Modellieren Sie die Tabellen f…
- Data Modeling
- Bigquery
- Etl
Cloud Computing for Data and ML - CodeMittelstufeNeu
Daten-Pipeline für Streaming-Features bei einem Wiener Online-Händler
Du erhältst eine Beispiel-Topologie (Browse-, Cart-, Order-Events als Kafka-Topics mit jeweils rund 8.000 Events/s in Spitzen), das aktuelle Batch-Feature-Schema (12 Aggregat-Fe…
- Streaming
- Apache Kafka
- Apache Spark
Machine Learning at Scale - Browse challenges
Explore role
Product Manager
Ship product that solves real user problems. Combine user research, prototyping, and stakeholder alignment to turn ambiguous briefs into measurable wins — the role at the centre of modern software teams.
- AnalysisMittelstufeNeu
Sparse-Linear-Solver-Vergleich für Geowissenschaftliches Institut
Erhalten Sie 4 reale anonymisierte Steifigkeitsmatrizen (1, 3, 8, 12 Mio. Unbekannte) plus rechte Seiten. Implementieren Sie CG mit Jacobi-Preconditioner, CG mit Incomplete-Chol…
- Sparse Linear Algebra
- Iterative Solvers
- Preconditioning
Scientific Computing and Numerical Methods - AnalysisEinsteigerNeu
Kostenoptimierung einer Datenplattform für ein Frankfurter Fintech
Sie erhalten anonymisierte AWS Cost Explorer Exports der letzten sechs Monate, Schema- und Statistikinformationen aus Redshift, sowie die Glue-Job-Definitionen. Identifizieren S…
- Cloud Cost Optimization
- AWS
- Data Architecture
Cloud Computing for Data and ML - DesignMittelstufeNeu
Ontologie für die Produktklassifikation eines technischen Großhändlers
Du bekommst den heutigen Excel-Baum, 5.000 ausgewählte Produkt-Datensätze und Interviews-Notizen aus drei Kategorie-Manager-Gesprächen. Modelliere eine OWL-Ontologie mit Klassen…
- Ontologies
- Owl
- Knowledge Representation
Fuzzy Logic, Knowledge Representation, and Symbolic Reasoning - CodeMittelstufeNeu
Dataset-Kuratierung und Eval-Harness für ein medizinisches Fachmodell
Du bekommst 12.000 anonymisierte Radiologie-Berichte (rohe Exports), Klinik-Style-Guide und eine Liste typischer Failure-Modes (Halluzinationen, falsche Befund-Vereinfachungen).…
- Dataset Curation
- Data Pipelines
- LLM Evaluation
Fine-Tuning Large Language Models Build a verifiable portfolio.
Submissions become evidence. Reviewers with shipping experience score against a rubric; the result becomes a credential anyone can verify.
Why Ewance
- CodeGrundlagenNeu
Auswertungs-Skript fuer Genfer Forschungs-Umfrage in einem Higher-Order-Style
Bereinige den CSV-Export (fehlende Werte, Code-Listen) mit einer Funktion clean(). Implementiere fuenf Aggregations-Operationen (durchschnittliche Antwort pro Frage, Verteilung …
- Programming Abstractions
- Higher Order Functions
- Functional Programming
Programming Abstractions - CodeMittelstufeNeu
Datenintegration und Prozessautomatisierung für Fintech-Startup in Berlin
Du erhältst Zugriff auf drei anonymisierte Datensätze (CRM-JSON, Transaktions-SQLite, Rechnungs-CSV) mit jeweils 10.000 Datensätzen. Entwickle in Python eine modulare Datenpipel…
- Python
- Data Manipulation
- Etl Pipeline Design
Programming for Business Applications - CodeEinsteigerNeu
OLAP-Analyse für einen pharmazeutischen Mittelständler
Ihr erhaltet einen anonymisierten Auszug aus dem Data Warehouse mit fünf Jahren Verkaufsdaten (ca. 500.000 Datensätze) sowie ein Dokument mit zehn wiederkehrenden Analyseanforde…
- Olap Design
- SQL
- Data Visualization
Business Intelligence - CodeMittelstufeNeu
Wissensgraph als Backbone für eine Finanz-Compliance-Plattform
Du erhältst Ausschnitte aus drei öffentlichen Quellen (Handelsregister-Auszug, OpenCorporates-Export, OFAC-Sanktionsliste) sowie eine Liste von 12 typischen Compliance-Fragen. M…
- Ontology Modeling
- Graph Databases
- Neo4j
Fachübergreifend - CodeEinsteigerNeu
NoSQL-Schema-Design für Echtzeit-Logistik in einem Seehafen
Entwerft ein dokumentenorientiertes oder spaltenbasiertes Datenmodell für die Echtzeit-Verarbeitung von Positions- und Statusdaten. Vergleicht mindestens zwei NoSQL-Ansätze (z. …
- Nosql Design
- Distributed Systems
- Data Modeling
Big Data and Cloud Technologies - CodeMittelstufeNeu
Spark-Pipeline für Risiko-Scoring bei einem Frankfurter B2B-Fintech
Du erhältst die bestehende pandas-Pipeline (Feature-Aggregation über 30/90/180-Tage-Fenster pro Geschäftskund:in plus ein bereits trainiertes XGBoost-Modell als PMML-Export), ei…
- Apache Spark
- Distributed Computing
- Feature Engineering
Machine Learning at Scale - CodeMittelstufeNeu
Description-Logic-Reasoner für Produktkonfigurations-Regeln
Du bekommst die heutige Excel-Konfigurations-Tabelle, 12 typische Kundenkonfigurations-Anfragen und die formalisierten Regeln aus zwei Workshops mit den Vertriebs-Ingenieurinnen…
- Description Logic
- Owl
- Knowledge Representation
Fuzzy Logic, Knowledge Representation, and Symbolic Reasoning - CodeMittelstufeNeu
Streaming-Pipeline für Echtzeit-Zahlungsbetrugssignale aufbauen
Du erhältst einen anonymisierten Snapshot von 10 Millionen Transaktionen (CSV + Avro-Schema) sowie eine Kafka-Sandbox mit Replay-Funktion. Baue eine Streaming-Pipeline (Kafka al…
- Stream Processing
- Kafka
- Apache Flink
Data Engineering and Big Data Systems - CodeEinsteigerNeu
Daten-Lineage und -Katalog für ein Versicherungs-Datenteam aufbauen
Du erhältst ein Inventar der 1.200 Tabellen (CSV), produktive Airflow-DAGs als Python-Code sowie Stichproben-Reports. Wähle die Top-100-Tabellen nach Geschäftskritikalität (Solv…
- Data Catalog
- Data Lineage
- Data Governance
Data Engineering and Big Data Systems - CodeMittelstufeNeu
Numerische ODE-Integration für Münchner Pharma-Pharmakokinetik
Erhalten Sie das pharmakokinetische Modell (8 Kompartimente, 12 ODEs) und 6 klinische Probanden-Datensätze (anonymisiert). Implementieren Sie Integrationen mit drei Verfahren: e…
- Numerical Odes
- Stiff Systems
- Scipy
Scientific Computing and Numerical Methods - AnalysisEinsteigerNeu
Datenbankmigration für einen Mittelständler im Maschinenbau
Du arbeitest als Datenbankberater:in (Database Consultant) und analysierst die bestehende Datenbankstruktur, identifizierst Normalisierungsdefizite und entwickelst ein Migration…
- SQL
- Database Design
- Data Modeling
Database Systems - StrategyMittelstufeNeu
Reporting-Strategie für ein Logistik-Start-up im Hafenumfeld
Du erhältst Zugang zu anonymisierten Datenauszügen aus vier Systemen (Frachtbuchungsplattform, Finanzsoftware, Kunden-CRM und Personalsystem) sowie ein Protokoll der letzten Inv…
- Reporting Strategy
- Data Integration
- KPI Design
Business Intelligence - CodeEinsteigerNeu
Datenpipeline für Wiener Kulturbetrieb-Analytics aufsetzen
Sie erhalten Beispielexporte aus drei Ticketsystemen (CSV, JSON, eine PostgreSQL-Tabelle), ein Logo-Style-Guide und die Liste der gewünschten ersten Reports (Besucher pro Haus p…
- Data Wrangling
- Data Modeling
- SQL
Applied Data Analysis and Practical Data Science - CodeMittelstufeNeu
Numerische Optimierung für Penzberger Bioprozess-Forschung
Erhalten Sie 14 historische Fermenter-Datensätze (jeweils rund 1.200 Zeitpunkte) plus ein bestehendes Surrogat-Modell (Gauss-Prozess, scikit-learn). Implementieren Sie drei Opti…
- Numerical Optimization
- Scipy
- Bayesian Optimization
Scientific Computing and Numerical Methods
So funktioniert's
Vom Briefing zum Zertifikat – in sechs Schritten.
Schritt 01
Durchsuche Challenges passend zu Deinem Studium.
Schritt 02
Wähle das Projekt, das zu Deinen Zielen passt.
Schritt 03
Arbeite es mit Hilfe des AI Copiloten durch.
Schritt 04
Reiche es zur strukturierten Bewertung ein.
Schritt 05
Erhalte ein verifiziertes Zertifikat.
Schritt 06
Füge es Deinem LinkedIn-Profil mit einem Klick hinzu.
Verwandte Rollen, die Dich interessieren könnten
Alle Rollen ansehen →Branchenteams hinter einem Jahrzehnt praxisorientierter Briefings
Aus diesem Pool einstellen?
Sponsere eine Challenge und lerne Kandidaten durch ihre tatsächliche Arbeit kennen.
Industrieteams können Briefings rund um die Fähigkeiten gestalten, die sie suchen, und Studierende anhand von bewertungsmatrix-gestützten Ergebnissen beurteilen – nicht anhand von Lebensläufen.
¹ Mediangehalt berechnet aus der Gehaltsverteilung von 50 aktuellen Adzuna-Stellenanzeigen für „Data Engineer" in United States, abgerufen am Mai 2026. Die Fähigkeiten stammen aus den Disziplinen, die auf aktiven Ewance-Challenges für diese Rolle getaggt sind.
Porträt: Foto von Kuanish Reymbaev auf Unsplash.



















































































