Kies uw taal
Data Engineer Cursus
Meer dan 2 miljoen studenten wereldwijd

Data Engineer Cursus

4,6

Beheers de volledige data-engineeringstack — van SQL en Python tot Kafka, Spark en dbt. Deze cursus leidt je door elke laag van de moderne datainfrastructuur en geeft je de praktische vaardigheden waar werkgevers actief naar op zoek zijn. Bouw echte pipelines, werk met industriestandaard tools en ben klaar om vanaf dag één te leveren.

Dedika voor bedrijven

Wat je gaat leren:

Je leert hoe je end-to-end datapipelines ontwerpt en implementeert die data op schaal verplaatsen, transformeren en serveren. De cursus behandelt relationeel modelleren, geavanceerde SQL, Python-scripting en cloud datawarehouse-engineering. Je werkt met tools zoals Apache Airflow, dbt, Apache Kafka en Apache Spark. Onderwerpen omvatten data-ingestiepatronen, streamingarchitecturen, DataOps-praktijken en datagovernance-frameworks. Aan het einde heb je de technische diepgang en praktische ervaring om te functioneren als een professionele data-engineer in elke moderne datagedreven organisatie.

Hoe je praktisch studeert Data Engineer Cursus

Hoe je oefent Data Engineer Cursus

Voor bedrijven die hun team willen trainen

Bij Dedika voor bedrijven bevat de cursus oefeningen en voorbeelden die zijn afgestemd op jouw organisatie en precies zoals jouw bedrijf het nodig heeft.

Klik hier

Cursusinhoud

8 Hoofdstukken • 37 LessenDuur tussen 4 en 360 uren (jij beslist)

Hoofdstuk 1Bekijk details

Grondslagen van data-engineering

  • Les 1 • Inleiding tot datarchitectuurpatronen

    Onderzoekt fundamentele architectuurstijlen, waaronder datawarehouses, datalakes en lakehouses. Verbindt architectuurkeuzes met bedrijfsvereisten en schaalbaarheidsdoelen.

  • Les 2 • Kerndataconcepten en -terminologie

    Introduceert gestructureerde, semi-gestructureerde en ongestructureerde datatypen en belangrijke opslagabstracties. Zorgt voor een gedeelde woordenschat voordat we in de architectuur en tools duiken.

  • Les 3 • Overzicht van de levenscyclus van data-engineering

    Brengt de end-to-end reis van data van bron tot consumptie in kaart. Biedt een mentaal model dat elk later in de cursus behandeld technisch onderwerp kadert.

  • Les 4 • De rol van de data-engineer

    Definieert de verantwoordelijkheden van de data-engineer binnen datateams en bedrijfscontexten. Legt de professionele basis die nodig is voor alle volgende technische hoofdstukken.

Hoofdstuk 2Bekijk details

SQL en relationele datamodellering

  • Les 1 • Geavanceerde SQL voor data-engineering

    Introduceert vensterfuncties, CTE's en setbewerkingen voor complexe analytische transformaties. Bereidt studenten voor om productieklare SQL te schrijven die wordt gebruikt in pipelines en rapportagelagen.

  • Les 2 • Dimensionale modellering voor analyses

    Past ster- en sneeuwvlakschemapatronen toe om analyseklare datamodellen te ontwerpen. Maakt direct het datawarehouse- en transformatiewerk mogelijk dat in latere hoofdstukken wordt behandeld.

  • Les 3 • Kern SQL-querytechnieken

    Leert SELECT, filteren, aggregatie en joins tussen meerdere tabellen voor data ophalen. Deze vaardigheden liggen ten grondslag aan elke transformatie en elke analytische workload in de cursus.

  • Les 4 • Basisprincipes van relationele databases

    Behandelt tabellen, sleutels, constraints en relaties als de bouwstenen van relationele systemen. Geeft studenten de theoretische basis die nodig is voor effectief schemaontwerp.

Hoofdstuk 3Bekijk details

Python voor data-engineering

  • Les 1 • Python-essenties voor datawerk

    Bespreekt Python-syntax, datastructuren en control flow die relevant zijn voor datamanipulatietaken. Legt de programmeerbasis voor het scripten van pipelines gedurende de hele cursus.

  • Les 2 • Bestands- en dataformaatverwerking

    Leert het lezen en schrijven van CSV-, JSON-, Parquet- en Avro-bestanden met Python-bibliotheken. Ondersteunt direct inname- en serialisatietaken in de hoofdstukken over pipeline-ontwikkeling.

  • Les 3 • Beste praktijken voor automatisering en scripten

    Introduceert logging, configuratiebeheer en verpakken voor productierijpe Python-scripts. Bereidt studenten voor om onderhoudbare code te schrijven die integreert in georkestreerde pipelines.

  • Les 4 • Datamanipulatie met Pandas

    Behandelt DataFrame-bewerkingen, samenvoegen, hervormen en opschonen met de Pandas-bibliotheek. Biedt de transformatietoolkit die wordt gebruikt in batchverwerking en verkennend datawerk.

  • Les 5 • Python verbinden met databases en API's

    Demonstreert databaseconnectiviteit via SQL-stuurprogramma's en REST API-consumptie met Python. Overbrugt scriptvaardigheden naar realistische databronintegratie die in de innamehoofdstukken wordt behandeld.

Hoofdstuk 4Bekijk details

Data-inname en pipeline-ontwerp

  • Les 1 • Data extraheren uit relationele bronnen

    Behandelt CDC, op tijdstempel gebaseerde extractie en op query's gebaseerde pulls uit relationele databases. Bouwt voort op SQL-vaardigheden om betrouwbare extractiestrategieën met weinig impact te implementeren.

  • Les 2 • Ontwerpprincipes voor pipelines

    Introduceert modulariteit, idempotentie, foutafhandeling en observeerbaarheid als pijlers van pipeline-ontwerp. Legt technische standaarden vast die in alle volgende pipepinehoofdstukken worden toegepast.

  • Les 3 • Innamepatronen en brontypen

    Onderzoekt veelvoorkomende databronnen, waaronder databases, API's, bestanden en event streams. Kadert de innameontwerpbeslissingen die de architectuurkeuzes van de pipeline sturen.

  • Les 4 • Inname uit API's en bestandsbronnen

    Leert gestructureerde benaderingen voor het consumeren van REST API's, FTP-bronnen en cloudopslagbestanden. Breidt Python API-vaardigheden uit naar productie-innamepipelinepatronen.

  • Les 5 • Datavalidatie en kwaliteitscontroles

    Implementeert schemavalidatie, nulcontroles en statistische profilering binnen innamelijnen. Zorgt dat datakwaliteit wordt afgedwongen bij het binnenkomen van de data, voordat verdere verwerking plaatsvindt.

Hoofdstuk 5Bekijk details

Dataopslag en warehouse-engineering

  • Les 1 • Tabelformaten en open opslagstandaarden

    Introduceert open tabelformaten die ACID-transacties en schema-evolutie op objectopslag mogelijk maken. Bereidt studenten voor op lakehouse-implementaties die in geavanceerde hoofdstukken worden behandeld.

  • Les 2 • Cloud datawarehouse-architectuur

    Onderzoekt kolomopslag, MPP-query-engines en scheiding van rekenkracht en opslag. Verbindt interne warehouse-mechanismen met queryprestaties en kostenoptimalisatiebeslissingen.

  • Les 3 • Datamodellering in het warehouse

    Past dimensionale en vault-modelleringstechnieken toe in cloud-warehouse-omgevingen. Bouwt voort op relationele modellering vaardigheden om analyseklare warehouse-lagen te produceren.

  • Les 4 • Basisprincipes van cloudobjectopslag

    Legt objectopslagconcepten uit, bucket-organisatie, partitionering en toegangscontrole. Biedt de opslagbasis die ten grondslag ligt aan datalakes en lakehouse-architecturen.

  • Les 5 • Warehouse-prestaties en kostenoptimalisatie

    Behandelt queryprofilering, gematerialiseerde weergaven, caching en warehouse-schaalstrategieën. Rust studenten uit om prestaties en kosten in productie-warehouse-omgevingen in balans te brengen.

Hoofdstuk 6Bekijk details

Datatransformatie en dbt

  • Les 1 • Geavanceerde dbt-patronen

    Behandelt macro's, Jinja-templating, packages en incrementele strategieën voor complexe use cases. Breidt kern-dbt-vaardigheden uit om grootschalige en dynamische transformatievereisten aan te kunnen.

  • Les 2 • Testen en documentatie in dbt

    Implementeert schematests, aangepaste tests en automatisch gegenereerde documentatie binnen dbt-projecten. Dwingt datakwaliteit en onderhoudbaarheidsstandaarden af in transformatiepipelines.

  • Les 3 • Architectuur van de transformatielaag

    Definieert de transformatielagen staging, intermediate en mart en hun verantwoordelijkheden. Legt het gelaagde ontwerppatroon vast dat al het dbt-projectwerk in dit hoofdstuk structureert.

  • Les 4 • dbt-modellen bouwen

    Leert het schrijven van SQL-modellen, het configureren van materialisaties en het beheren van modelafhankelijkheden in dbt. Zet SQL-vaardigheden om in een versiebeheerde, modulaire transformatieworkflow.

Hoofdstuk 7Bekijk details

Pipeline-orchestratie en workflowmanagement

  • Les 1 • Pipeline-monitoring en observeerbaarheid

    Legt logging, metrieken en lijnage-trackingpraktijken vast voor zichtbaarheid van georkestreerde pipelines. Verbindt observeerbaarheidstools met de datakwaliteit- en governancethema's van de cursus.

  • Les 2 • Moderne orchestratiealternatieven

    Onderzoekt Prefect, Dagster en event-gestuurde orchestratie als alternatieven voor Airflow. Rust studenten uit om orchestratietools te evalueren tegen projectvereisten en teambeperkingen.

  • Les 3 • Foutafhandeling en strategieën voor opnieuw proberen

    Implementeert pogingen tot herstel, SLA's, waarschuwingen en fout-callbacks binnen georkestreerde workflows. Zorgt dat pipelines voldoen aan de betrouwbaarheidsnormen die vereist zijn in productiedata-omgevingen.

  • Les 4 • Orchestratieconcepten en -patronen

    Introduceert DAG-gebaseerde planning, afhankelijkheidsresolutie en scheiding van orchestratie versus uitvoering. Kadert de orchestratielaag die inname, opslag en transformatie samenbindt.

  • Les 5 • Workflows bouwen met Apache Airflow

    Behandelt Airflow-architectuur, operators, hooks en DAG-authoring in Python. Biedt praktijkervaring met het industrie-standaard orchestratietool voor datapipelines.

Hoofdstuk 8Bekijk details

Streaming data-engineering

  • Les 1 • Streaming data-opslag en -serveren

    Behandelt het schrijven van streaminguitvoer naar datalakes, warehouses en real-time serving-stores. Verbindt streamingpipelines met de opslag- en consumptielagen die in eerdere hoofdstukken zijn gebouwd.

  • Les 2 • Betrouwbaarheid en schaling van streamingpipelines

    Behandelt backpressure, schema registry, dead-letter-topics en horizontale schaling voor streamingsystemen. Zorgt dat studenten streamingpipelines betrouwbaar kunnen bedienen op productieschaal.

  • Les 3 • Streamverwerking met Apache Flink

    Leert stateful streamverwerking, windowing en event-time-afhandeling met Apache Flink. Bouwt voort op Kafka-kennis om real-time transformatie- en aggregatielogica te implementeren.

  • Les 4 • Streaming-basisprincipes en use cases

    Contrasteert streaming met batchverwerking en identificeert use cases waar real-time data vereist is. Legt de conceptuele basis voor alle streamingarchitectuur- en toolingbeslissingen.

  • Les 5 • Apache Kafka-architectuur en -beheer

    Behandelt Kafka-brokers, topics, partities, consumentengroepen en producer/consumer-API's. Biedt de kennis van het messaging-backbone die nodig is voor alle streamingpipeline-implementaties.

Certificering

Jouw geldig certificaat van voltooiing

Deze cursus is voor jou:

  • Businessanalist: klaar om van data consumeren naar data-engineeren te gaan.

  • BI-ontwikkelaar: wil de pipelinelaag achter de dashboards beheren.

  • Softwareontwikkelaar: zoekt specialisatie in datainfrastructuur en -tooling.

  • Pas afgestudeerde: betreedt de arbeidsmarkt met focus op datarollen.

  • Data-analist: wil doorgroeien naar een engineeringpositie met meer impact.

  • Carrièreswitcher: komt uit IT of operations en stapt over naar data-engineering.

Wat onze studenten zeggen

Jullie lessen zijn perfect. Ik heb het jaarpakket aangeschaft en heb eindelijk de mogelijkheid om verschillende onderwerpen die mij interesseren te volgen zonder van platform te hoeven wisselen... bedankt voor alles wat jullie doen, ik heb jullie al aan anderen aanbevolen...
Giulio Carlo
Giulio CarloStudent Digitale Marketing
Ik vind het fijn hoe de lessen direct ter zake zijn en hoe ik tussen hoofdstukken kan wisselen en content kan overslaan die ik niet nodig heb.
Mariana Ferres
Mariana FerresStudent Fotografie
Ik vind de content en de manier van presenteren en transcriptie van video's geweldig, wat het proces versnelt!
Luciana Alvarenga
Luciana AlvarengaStudent Nageldesign
Het platform is snel en eenvoudig te gebruiken. De diversiteit aan content en de aanvullende video's helpen enorm bij het leren.
André Felipe
André FelipeStudent Prompt Engineering

Belangrijkste opleidingen

FAQ

Wie is Dedika?

Is het certificaat geldig in Nederland?

Zijn de cursussen gratis?

Wat is de studielast van de cursus?

Hoe zien de cursussen eruit?

Hoe werken de cursussen?

Wat is de duur van de cursussen?

Wat zijn de kosten of prijzen van de cursussen?

Wat is een EAD- of online cursus en hoe werkt het?

PDF-cursus