Vyberte svůj jazyk
Kurz Apache Solr
Více než 2 miliony studentů po celém světě

Kurz Apache Solr

Ovládněte Apache Solr od instalace až po distribuované vyhledávání na produkční úrovni. Toto školení pokrývá návrh schématu, ladění relevance, architekturu SolrCloud, zabezpečení a optimalizaci výkonu – vše, co potřebujete k sebevědomému budování a provozu podnikových vyhledávacích systémů.

Dedika pro firmy

Co se naučíte:

Získáte praktické odborné znalosti napříč celým stackem Solr, počínaje základními vyhledávacími koncepty a pokračuje konfigurací schématu, indexováním dokumentů a pokročilým parsováním dotazů. Naučíte se ladit relevanci pomocí BM25, funkčních dotazů a modelů strojového učení pro řazení. Kurz pokrývá nasazení SolrCloud se ZooKeeperem, kolekce s více shardy a strategie replik pro vysokou dostupnost. Zavedete také autentizaci, šifrování TLS, monitorovací dashboardy a postupy zálohování pro produkční prostředí. Další moduly se zabývají integrací s Kafkou, vektorovým vyhledáváním, nasazením na Kubernetes a systematickým řešením incidentů z praxe.

Jak studujete v praxi Kurz Apache Solr

Jak procvičujete Kurz Apache Solr

Pro vás, kteří jste firma a chcete školit svůj tým

V Dedika pro firmy je kurz doplněn o cvičení a příklady přímo z vašeho podnikání a přizpůsoben tak, jak vaše firma potřebuje.

Klikněte zde

Obsah kurzu

8 Kapitoly • 39 LekceDélka mezi 4 a 360 hodinami (rozhodujete vy)

Kapitola 1Zobrazit detaily

Úvod do Solr a konceptů vyhledávání

  • Lekce 1 • Instalace a spuštění Solr

    Provede studenty lokální instalací, spuštěním a základním ověřením. Praktické nastavení zajistí funkční prostředí pro všechna následující cvičení.

  • Lekce 2 • Co je Apache Solr

    Pokrývá původ Solr, jeho účel a pozici v oblasti vyhledávání. Stanovuje kontext pro všechna následující technická témata v kapitole.

  • Lekce 3 • Přehled architektury Solr

    Vysvětluje hlavní komponenty Solr: jádra, handlery a pipeline požadavků. Studenti získají mentální model toho, jak dotaz prochází systémem.

  • Lekce 4 • Klíčové koncepty vyhledávání

    Představuje invertované indexy, scoring relevance a základy fulltextového vyhledávání. Poskytuje konceptuální slovník potřebný pro celý kurz.

Kapitola 2Zobrazit detaily

Návrh schématu a konfigurace polí

  • Lekce 1 • Porozumění schématu Solr

    Vysvětluje managed schema vs. klasický schema.xml a jejich kompromisy. Pokládá základy pro všechny definice polí a typů v této kapitole.

  • Lekce 2 • Řetězce analýzy a zpracování textu

    Učí, jak tokenizéry, filtry a analyzéry transformují text při indexování a dotazování. Správný návrh řetězce přímo ovlivňuje kvalitu vyhledávání.

  • Lekce 3 • Dynamická pole a kopírovací pole

    Představuje vzory dynamických polí a direktivy kopírovacích polí pro flexibilní návrh schématu. Studenti snižují režii údržby schématu a zároveň podporují různé potřeby dotazování.

  • Lekce 4 • Typy polí a datové modelování

    Pokrývá primitivní a komplexní typy polí, včetně textových, číselných, datových a geo. Studenti mapují doménová data na vhodné typy polí Solr.

  • Lekce 5 • Validace a vývoj schématu

    Řeší bezpečné přidávání, úpravy a odstraňování polí v produkčních schématech. Studenti aplikují strategie, které zabraňují ztrátě dat a přerušení reindexace.

Kapitola 3Zobrazit detaily

Indexování dokumentů a příjem dat

  • Lekce 1 • Použití SolrJ pro Java klienty

    Představuje klientskou knihovnu SolrJ pro programatické indexování a dotazování z Javy. Studenti sestaví jednoduchou indexační aplikaci pomocí SolrJ.

  • Lekce 2 • Atomické aktualizace a optimistická souběžnost

    Pokrývá částečné aktualizace dokumentů a detekci konfliktů na základě verzí. Studenti aplikují atomické aktualizace, aby se vyhnuli úplným přepisům dokumentů ve scénářích s vysokou propustností.

  • Lekce 3 • Data Import Handler a konektory

    Učí Data Import Handler (DIH) pro získávání dat z databází a souborů. Studenti nakonfigurují úlohu DIH a naplánují inkrementální importy.

  • Lekce 4 • Indexování pomocí Update API

    Pokrývá odesílání dokumentů ve formátech JSON, XML a CSV prostřednictvím Update Request Handleru. Studenti naindexují vzorové dokumenty a ihned ověří výsledky.

  • Lekce 5 • Základy indexování

    Vysvětluje model dokumentů Solr, unikátní klíče a sémantiku commitů. Vytváří správné mentální modely předtím, než studenti napíší jakýkoli indexovací kód.

Kapitola 4Zobrazit detaily

Dotazování v Solr: Syntaxe a parametry

  • Lekce 1 • Facetování a agregace

    Představuje field facety, range facety, pivot facety a agregace JSON Facet API. Studenti vytvářejí navigační a analytické funkce nad výsledky vyhledávání.

  • Lekce 2 • Filtrování, řazení a stránkování

    Učí filtrovací dotazy (fq), parametry řazení a kurzorové stránkování pro velké sady výsledků. Studenti optimalizují dotazy oddělením ukládání filtrů do mezipaměti od scoringu.

  • Lekce 3 • Parsery dotazů DisMax a eDisMax

    Pokrývá parsery DisMax a Extended DisMax určené pro uživatelská vyhledávací pole. Studenti konfigurují parametry qf, pf, mm a boost pro ladění relevance.

  • Lekce 4 • Zvýrazňování a formátování výsledků

    Pokrývá zvýrazňování úryvků, response writery a transformátory polí pro prezentaci výsledků. Studenti konfigurují výstupní formáty vhodné pro různé klientské aplikace.

  • Lekce 5 • Základy standardního dotazovacího parseru

    Představuje syntaxi parseru dotazů Lucene pro vyhledávání v polích, booleovské operátory a zástupné znaky. Studenti píší a testují dotazy na indexovaných vzorových datech.

Kapitola 5Zobrazit detaily

Ladění relevance a ranking

  • Lekce 1 • Strategie boostování

    Pokrývá boosty v čase indexování, v čase dotazu a boosty pomocí funkčních dotazů pro kontrolu relevance. Studenti aplikují více boostovacích strategií a měří jejich kombinovaný účinek.

  • Lekce 2 • Porozumění scoringu v Solr

    Vysvětluje výchozí model podobnosti BM25 a jak boosty na úrovni polí ovlivňují skóre. Studenti používají parametr debug=query ke kontrole vysvětlení skóre.

  • Lekce 3 • Funkční dotazy a vzorce pro ranking

    Učí syntaxi funkčních dotazů Solr pro rankingové signály založené na matematice. Studenti vytvářejí vlastní rankingové vzorce kombinující textové skóre s číselnými obchodními signály.

  • Lekce 4 • Learning to Rank se Solr LTR

    Představuje plugin Learning to Rank (LTR) pro rankingové modely strojově učené. Studenti nahrají úložiště příznaků, natrénují model a nasadí jej pro přeřazení výsledků.

  • Lekce 5 • Testování relevance a iterace

    Pokrývá offline vyhodnocování pomocí seznamů posudků a online přístupy A/B testování. Studenti si vytvoří opakovatelný pracovní postup pro zlepšování relevance.

Kapitola 6Zobrazit detaily

SolrCloud: Distribuované vyhledávání ve velkém měřítku

  • Lekce 1 • Distribuované indexování a dotazování

    Učí, jak jsou dokumenty směrovány do shardů a jak se slučují distribuované dotazy. Studenti konfigurují vlastní směrování a optimalizují výkon dotazů napříč shardy.

  • Lekce 2 • Architektura SolrCloud

    Vysvětluje sharding, replikaci a roli ZooKeeperu při koordinaci clusteru. Studenti mapují koncepty SolrCloud na své vlastní požadavky na škálování.

  • Lekce 3 • Operace ZooKeeper a správa konfigurace

    Pokrývá nahrávání konfiguračních sad, správu ZooKeeper znodů a rekonfiguraci clusteru. Studenti používají nástroj zkcli a Config API pro bezpečné změny konfigurace.

  • Lekce 4 • Typy replik a vysoká dostupnost

    Představuje typy replik NRT, TLOG a PULL a jejich kompromisy v dostupnosti. Studenti vybírají strategie replik, které vyvažují propustnost indexování s dostupností pro čtení.

  • Lekce 5 • Vytváření a správa kolekcí

    Pokrývá Collections API pro vytváření, úpravy a mazání kolekcí. Studenti provádějí běžné operace životního cyklu kolekcí pomocí API a Admin UI.

Kapitola 7Zobrazit detaily

Ladění výkonu a cachování

  • Lekce 1 • Ladění JVM a haldy

    Pokrývá dimenzování haldy JVM, výběr garbage collectoru a minimalizaci GC pauz. Studenti aplikují nastavení, která snižují stop-the-world pauzy během špičkového zatížení.

  • Lekce 2 • Architektura cachování Solr

    Vysvětluje filter cache, query result cache, document cache a field value cache. Studenti konfigurují velikosti cache a zásady odstraňování pro své pracovní zátěže.

  • Lekce 3 • Optimalizace indexu a správa segmentů

    Učí slučování segmentů Lucene, operace optimalizace a strategie zahřívání indexu. Studenti vyvažují režii slučování oproti výkonu dotazů pro svou velikost indexu.

  • Lekce 4 • Profilování výkonu dotazů

    Představuje parametr debug=timing, logování pomalých dotazů a Solr metrics API. Studenti identifikují náročné komponenty dotazů a aplikují cílené optimalizace.

  • Lekce 5 • Dimenzování hardwaru a nasazení

    Pokrývá aspekty diskových I/O, CPU, RAM a sítě pro nasazení Solr. Studenti vytvoří odhad dimenzování na základě velikosti indexu, frekvence dotazů a cílů SLA.

Kapitola 8Zobrazit detaily

Bezpečnost, monitorování a produkční operace

  • Lekce 1 • Monitorování pomocí metrik a logování

    Představuje Solr metrics API, integraci JMX a konfiguraci strukturovaného logování. Studenti vytvářejí dashboardy, které zobrazují latenci dotazů, chybovost a poměry zásahů cache.

  • Lekce 2 • Zálohování, obnova a plánování disaster recovery

    Pokrývá zálohování pomocí snapshotů, obnovu založenou na replikaci a plánování RTO/RPO. Studenti navrhnou plán zálohování a otestují postupy obnovy od začátku do konce.

  • Lekce 3 • Aktualizace a provozní runbooky

    Učí rolling upgrady, kontroly kompatibility a kroky validace po aktualizaci. Studenti vytvářejí runbooky pro rutinní operace a reakce na incidenty.

  • Lekce 4 • Autentizace a autorizace

    Pokrývá vestavěné autentizační pluginy Solr: Basic Auth, Kerberos a JWT. Studenti konfigurují řízení přístupu na základě rolí pro ochranu kolekcí a admin endpointů.

  • Lekce 5 • TLS šifrování a bezpečnost sítě

    Učí povolení TLS pro komunikaci klient-Solr a mezi uzly. Studenti generují certifikáty, konfigurují keystory a ověřují šifrovaná spojení.

Certifikace

Váš platný certifikát o dokončení

Tento kurz je pro vás:

  • Backendoví vývojáři: chtějí do svých aplikací přidat výkonné vyhledávání.

  • Datoví inženýři: vytvářejí pipeline, které potřebují rychlé a škálovatelné získávání textu.

  • DevOps inženýři: mají za úkol nasazovat a spravovat infrastrukturu pro vyhledávání.

  • Softwaroví architekti: hodnotí Solr pro rozsáhlé podnikové vyhledávací projekty.

  • Správci databází: rozšiřují své dovednosti do oblastí vyhledávacích technologií.

  • Techničtí produktoví manažeři: potřebují rozumět vyhledávacím systémům, na které dohlížejí.

Co říkají naši studenti

Vaše lekce jsou perfektní. Koupil jsem si roční balíček a konečně mám možnost sledovat různá témata, která mě zajímají, aniž bych musel měnit platformu... děkuji za vše, co děláte, už jsem vás doporučil dalším lidem...
Giulio Carlo
Giulio CarloStudent digitálního marketingu
Líbí se mi, jak jsou lekce přímočaré a jak mohu přepínat mezi kapitolami a přeskakovat obsah, který nepotřebuji.
Mariana Ferres
Mariana FerresStudentka fotografie
Líbí se mi obsah a způsob prezentace a přepisu videí, což celý proces zrychluje!
Luciana Alvarenga
Luciana AlvarengaStudentka nail designu
Platforma je rychlá a jednoduchá na používání. Rozmanitost obsahu a doplňková videa velmi pomáhají při učení.
André Felipe
André FelipeStudent prompt engineeringu

Hlavní školení

Často kladené otázky

Kdo je Dedika?

Je certifikát platný v Česko?

Jsou kurzy zdarma?

Jaká je pracovní zátěž kurzu?

Jak kurzy vypadají?

Jak kurzy fungují?

Jaká je délka kurzů?

Jaká je cena nebo poplatek za kurzy?

Co je EAD nebo online kurz a jak funguje?

PDF kurz