Vyberte svůj jazyk
Kurz implementace Apache HBase pro Big Data
Více než 2 miliony studentů po celém světě

Kurz implementace Apache HBase pro Big Data

Ovládněte Apache HBase od základů architektury až po nasazení, ladění a replikaci na produkční úrovni. Toto školení vybaví datové inženýry a architekty praktickými dovednostmi pro navrhování škálovatelných NoSQL úložných řešení pro skutečné big data pracovní zátěže. Překročte teorii a vybudujte si odborné znalosti, na které spoléhají podnikové týmy.

Dedika pro firmy

Co se naučíte:

  • Konfigurujte samostatné, pseudodistribuované a plně distribuované clustery HBase od začátku.

  • Navrhujte klíče řádků a schémata, která zabraňují hotspottingu a podporují efektivní rozsahové skenování.

  • Implementujte operace CRUD, dávkové a skenovací operace pomocí klientského API HBase pro Javu.

  • Dolaďte správu paměti s automatickým uvolňováním JVM, BlockCache a zásady kompaktace, abyste dosáhli cílové latence.

  • Nastavte replikaci mezi clustery na bázi WAL a vysokodostupnostní převzetí služeb HMaster.

  • Integrujte HBase s Apache Spark, Hive, Kafka a Apache Phoenix pro komplexní datové pipeline.

Jak studujete v praxi Kurz implementace Apache HBase pro Big Data

Jak procvičujete Kurz implementace Apache HBase pro Big Data

Pro vás, kteří jste firma a chcete školit svůj tým

V Dedika pro firmy je kurz doplněn o cvičení a příklady přímo z vašeho podnikání a přizpůsoben tak, jak vaše firma potřebuje.

Klikněte zde

Obsah kurzu

8 Kapitoly • 39 LekceDélka mezi 4 a 360 hodinami (rozhodujete vy)

Kapitola 1Zobrazit detaily

HBase – základy a kontext velkých dat

  • Lekce 1 • HBase ve srovnání s jinými NoSQL úložišti

    Porovnává HBase s dokumentovými, klíč-hodnota a širokosloupcovými úložišti z hlediska konzistence, latence a propustnosti. Navádí studenty při výběru HBase pro vhodné pracovní zátěže.

  • Lekce 2 • Přehled architektury HBase

    Představuje model HBase master-region server a jeho vztah k HDFS. Poskytuje strukturální mentální model potřebný pro všechny následující kapitoly.

  • Lekce 3 • Výzvy úložiště velkých dat

    Zkoumá problémy objemu, rychlosti a rozmanitosti, které relační databáze nedokážou zvládnout. Stanovuje motivaci pro sloupcová NoSQL řešení, jako je HBase.

  • Lekce 4 • Koncepty datového modelu HBase

    Definuje tabulky, řádky, rodiny sloupců, kvalifikátory a časová razítka. Studenti si tyto koncepty propojí s reálnými případy použití, aby si vybudovali intuici před praktickou prací.

Kapitola 2Zobrazit detaily

Instalace a konfigurace HBase

  • Lekce 1 • Nastavení pseudo-distribuovaného režimu

    Konfiguruje HBase pro použití HDFS na jednom počítači, čímž simuluje cluster. Představuje parametry souboru hbase-site.xml, které řídí distribuované chování.

  • Lekce 2 • Instalace v samostatném režimu

    Provede nastavením HBase na jednom uzlu pro vývoj a testování. Před přechodem k distribuovaným režimům ověří instalaci pomocí základních příkazů shellu.

  • Lekce 3 • Předpoklady prostředí a plánování

    Pokrývá požadavky na Javu, Hadoop a OS před jakýmkoli instalačním krokem. Předchází běžným selháním nastavení tím, že předem řeší konflikty závislostí.

  • Lekce 4 • Základní konfigurační parametry

    Ladí hbase-site.xml, hbase-env.sh a nastavení haldy JVM pro stabilitu. Propojuje volby konfigurace s výsledky výkonu a spolehlivosti.

  • Lekce 5 • Nasazení plně distribuovaného clusteru

    Nasazuje HBase na více uzlů s kvorem ZooKeeper a replikací HDFS. Studenti nakonfigurují soubor regionservers a otestují připravenost na převzetí služeb při selhání.

Kapitola 3Zobrazit detaily

Shell HBase a základní datové operace

  • Lekce 1 • Aktualizace a mazání dat

    Vysvětluje model zápisu HBase pouze s přidáváním a způsob, jakým mazání používá značky náhrobků (tombstone). Studenti si procvičí bezpečné vzory mazání, aby se vyhnuli nechtěné ztrátě dat.

  • Lekce 2 • Navigace v shellu HBase

    Představuje příkazy shellu, systém nápovědy a možnosti skriptování. Před prováděním datových operací zavádí efektivní návyky používání shellu.

  • Lekce 3 • Správa tabulek a schémat

    Pokrývá příkazy create, alter, disable, enable a drop pro tabulky. Učí návrhová rozhodnutí schématu, která ovlivňují efektivitu úložiště a výkon dotazů.

  • Lekce 4 • Hromadné načítání dat

    Používá nástroje ImportTsv a completebulkload k efektivnímu načítání velkých datových sad. Vyhýbá se úzkým místům cesty zápisu přímým generováním HFiles.

  • Lekce 5 • Zápis a čtení dat

    Demonstruje příkazy put, get a scan s filtry a správou verzí. Propojuje vzory čtení/zápisu se základním modelem úložiště LSM-strom.

Kapitola 4Zobrazit detaily

Návrh klíče řádku a modelování schématu

  • Lekce 1 • Techniky solení a hashování

    Aplikuje solené prefixy a klíče založené na hashi k distribuci zápisů napříč regiony. Studenti měří zlepšení distribuce pomocí metrik zatížení region serveru.

  • Lekce 2 • Strategie návrhu rodin sloupců

    Navádí rozhodnutí o počtu rodin sloupců, velikosti bloku a kompresi. Propojuje nastavení na úrovni rodiny s chováním MemStore a HFile.

  • Lekce 3 • Vzory schémat pro běžné případy použití

    Aplikuje vzory časových řad, entita-atribut-hodnota a invertovaný index na reálné scénáře. Studenti vyhodnocují náklady na skenování a úložiště každého vzoru.

  • Lekce 4 • Principy návrhu klíče řádku

    Vysvětluje, jak struktura klíče řádku určuje distribuci dat a efektivitu skenování. Před představením specifických návrhových vzorů stanovuje základní pravidla.

  • Lekce 5 • Předrozdělení regionů při vytváření tabulky

    Demonstruje manuální a algoritmické předrozdělování regionů, aby se předešlo počátečním hotspotům. Ověřuje hranice rozdělení vůči očekávané distribuci klíčů.

Kapitola 5Zobrazit detaily

Vnitřní mechanismy HBase a úložný engine

  • Lekce 1 • Typy kompakce a politiky

    Rozlišuje menší a hlavní kompakce a jejich dopad na zesílení čtení a úložiště. Studenti konfigurují politiky kompakce tak, aby vyvážily náklady na zápis a čtení.

  • Lekce 2 • Rozdělování a slučování regionů

    Vysvětluje automatické a manuální spouštěče rozdělení regionů a postup rozdělení. Pokrývá slučování regionů pro konsolidaci malých regionů a snížení režie.

  • Lekce 3 • Konfigurace WAL a trvanlivosti

    Konfiguruje režimy synchronizace WAL, replikační faktor a kompresi WAL pro vyvážení trvanlivosti a výkonu. Vysvětluje obnovu dat z WAL po havárii.

  • Lekce 4 • Cesta zápisu a MemStore

    Sleduje zápis klienta přes WAL, MemStore a případné vyprázdnění do HFile. Vysvětluje záruky trvanlivosti a podmínky spouštění vyprázdnění.

  • Lekce 5 • Formát HFile a bloková cache

    Zkoumá strukturu HFile v2 včetně datových bloků, Bloomových filtrů a indexových bloků. Propojuje konfiguraci blokové cache se snížením latence čtení.

Kapitola 6Zobrazit detaily

Java API HBase a klientské programování

  • Lekce 1 • Filtry a pokročilé dotazy

    Implementuje filtry na straně serveru pro snížení síťového přenosu a zpracování na straně klienta. Pokrývá konstrukci řádkových, sloupcových, hodnotových a složených filtrů.

  • Lekce 2 • Scan API a iterace výsledků

    Používá třídu Scan s počátečními/koncovými řádky, filtry a pokyny pro ukládání do mezipaměti pro efektivní čtení rozsahů. Učí životní cyklus ResultScanner a čištění zdrojů.

  • Lekce 3 • Nastavení Java klienta

    Konfiguruje závislosti Maven nebo Gradle a vytváří objekt Connection. Pokrývá načítání konfigurace a správu životního cyklu připojení.

  • Lekce 4 • Dávkové a mutační operace

    Provádí hromadné vkládání a mazání pomocí Table.batch a BufferedMutator pro optimalizaci propustnosti. Zpracovává částečná selhání v polích výsledků dávek.

  • Lekce 5 • Operace Put a Get v Javě

    Implementuje zápisy a čtení jednoho řádku s explicitním cílením na rodinu sloupců a kvalifikátor. Představuje vzory parsování výsledků a bezpečnosti vůči null.

Kapitola 7Zobrazit detaily

Ladění výkonu HBase a monitorování

  • Lekce 1 • Správa paměti s automatickým uvolňováním (Garbage Collection)

    Konfiguruje nastavení G1GC a CMS pro snížení dopadu pauz GC na latenci RegionServeru. Propojuje dimenzování haldy s alokací MemStore a BlockCache.

  • Lekce 2 • Optimalizace cesty čtení a zápisu

    Ladí parametry ukládání scanu do mezipaměti, velikosti dávek a vyrovnávací paměti pro zápis pro maximalizaci propustnosti. Aplikuje nastavení na straně klienta a serveru v kombinaci.

  • Lekce 3 • Metriky HBase a monitorování JMX

    Shromažďuje metriky HBase prostřednictvím JMX, Hadoop metrics2 a REST koncových bodů. Identifikuje klíčové indikátory pro latenci čtení, frontu kompakce a vyvážení regionů.

  • Lekce 4 • Optimalizace OS a sítě

    Ladí parametry linuxového jádra, plánovače I/O disku a síťové vyrovnávací paměti pro pracovní zátěže HBase. Zabraňuje úzkým místům na úrovni OS, která by maskovala přínosy ladění HBase.

  • Lekce 5 • Integrace s monitorovacími sestavami

    Připojuje metriky HBase k dashboardům Grafana prostřednictvím exportérů Prometheus nebo Ganglia. Vytváří pravidla upozornění pro kritické prahy, jako jsou pauzy GC a počet souborů úložiště.

Kapitola 8Zobrazit detaily

Vysoká dostupnost a replikace HBase

  • Lekce 1 • Odolnost RegionServeru proti chybám

    Vysvětluje opětovné přiřazení regionů po selhání RegionServeru a obnovu založenou na WAL. Ladí parametry rychlosti obnovy, aby se minimalizovala okna nedostupnosti.

  • Lekce 2 • Architektura replikace HBase

    Konfiguruje asynchronní replikaci založenou na WAL mezi zdrojovým a cílovým clusterem. Vysvětluje rozsah replikace, správu partnerů a monitorování zpoždění replikace.

  • Lekce 3 • Vysoká dostupnost HMaster

    Nasazuje záložní instance HMaster a konfiguruje volbu vůdce založenou na ZooKeeper. Testuje automatické převzetí služeb při selhání simulací selhání aktivního masteru.

  • Lekce 4 • Správa kvora ZooKeeper

    Dimenzuje a konfiguruje soubor ZooKeeper pro spolehlivost koordinace HBase. Pokrývá ladění časového limitu relace a správu datového adresáře ZooKeeper.

  • Lekce 5 • Zálohování, snapshot a obnovení

    Používá nástroje HBase snapshot a ExportSnapshot pro bodové zálohy v čase bez výpadku. Procvičuje postupy úplného a přírůstkového obnovení pro ověření obnovy.

Certifikace

Váš platný certifikát o dokončení

Tento kurz je pro vás:

  • Datoví inženýři připravení posunout se od relačních databází do oblasti NoSQL.

  • Backendoví vývojáři vytvářející systémy, které musí zvládat masivní propustnost zápisu.

  • Správci Hadoopu, kteří si chtějí rozšířit své dovednosti o znalost HBase.

  • Architekti řešení hodnotící sloupcové databáze pro podnikové datové platformy.

  • Softwaroví inženýři přecházející do rolí velkých dat ve společnostech náročných na data.

  • DevOps odborníci pověření nasazováním a údržbou distribuovaných úložných clusterů.

Co říkají naši studenti

Vaše lekce jsou perfektní. Koupil jsem si roční balíček a konečně mám možnost sledovat různá témata, která mě zajímají, aniž bych musel měnit platformu... děkuji za vše, co děláte, už jsem vás doporučil dalším lidem...
Giulio Carlo
Giulio CarloStudent digitálního marketingu
Líbí se mi, jak jsou lekce přímočaré a jak mohu přepínat mezi kapitolami a přeskakovat obsah, který nepotřebuji.
Mariana Ferres
Mariana FerresStudentka fotografie
Líbí se mi obsah a způsob prezentace a přepisu videí, což celý proces zrychluje!
Luciana Alvarenga
Luciana AlvarengaStudentka nail designu
Platforma je rychlá a jednoduchá na používání. Rozmanitost obsahu a doplňková videa velmi pomáhají při učení.
André Felipe
André FelipeStudent prompt engineeringu

Hlavní školení

Často kladené otázky

Kdo je Dedika?

Je certifikát platný v Česko?

Jsou kurzy zdarma?

Jaká je pracovní zátěž kurzu?

Jak kurzy vypadají?

Jak kurzy fungují?

Jaká je délka kurzů?

Jaká je cena nebo poplatek za kurzy?

Co je EAD nebo online kurz a jak funguje?

PDF kurz