Elige tu idioma
Curso de Apache Solr
Más de 2 millones de estudiantes en todo el mundo

Curso de Apache Solr

Dominá Apache Solr, desde la instalación hasta la búsqueda distribuida de nivel producción. Esta capacitación cubre diseño de esquemas, ajuste de relevancia, arquitectura SolrCloud, seguridad y optimización de rendimiento: todo lo que necesitás para construir y operar sistemas de búsqueda enterprise con confianza.

Dedika para empresas

Lo que vas a aprender:

Vas a adquirir experiencia práctica en todo el stack de Solr, empezando por los conceptos centrales de búsqueda y avanzando por la configuración del esquema, la indexación de documentos y el parseo avanzado de consultas. Vas a aprender a ajustar la relevancia usando BM25, consultas de función y modelos de ranking por aprendizaje automático. El curso cubre el despliegue de SolrCloud con ZooKeeper, colecciones multi-shard y estrategias de réplicas de alta disponibilidad. También vas a implementar autenticación, cifrado TLS, paneles de monitoreo y procedimientos de backup para entornos de producción. Módulos adicionales abordan la integración con Kafka, búsqueda vectorial, despliegue en Kubernetes y la resolución sistemática de incidentes del mundo real.

Cómo estudias de forma práctica Curso de Apache Solr

Cómo practicas Curso de Apache Solr

Para ti que eres empresa y quieres capacitar a tu equipo

En Dedika para empresas, el curso incluye ejercicios y ejemplos adaptados a tu propio negocio y a las necesidades de tu empresa.

Haz clic aquí

Contenido del curso

8 Capítulos • 39 ClasesDuración entre 4 y 360 horas (tú decides)

Capítulo 1Ver detalles

Introducción a Solr y conceptos de búsqueda

  • Clase 1 • Instalando y ejecutando Solr

    Guía a los estudiantes a través de la instalación local, el inicio y la verificación básica. La configuración práctica asegura un entorno de trabajo para todos los ejercicios posteriores.

  • Clase 2 • Qué es Apache Solr

    Cubre el origen, propósito y posición de Solr en el panorama de búsqueda. Establece el contexto para todos los temas técnicos subsiguientes del capítulo.

  • Clase 3 • Descripción general de la arquitectura de Solr

    Explica los componentes principales de Solr: cores, handlers y el pipeline de solicitudes. Los estudiantes adquieren un modelo mental de cómo fluye una consulta a través del sistema.

  • Clase 4 • Conceptos básicos de búsqueda

    Introduce los índices invertidos, la puntuación de relevancia y los fundamentos de la búsqueda de texto completo. Proporciona el vocabulario conceptual necesario a lo largo del curso.

Capítulo 2Ver detalles

Diseño de esquemas y configuración de campos

  • Clase 1 • Entendiendo el esquema de Solr

    Explica el esquema administrado vs. el schema.xml clásico y sus ventajas y desventajas. Establece la base para todas las definiciones de campos y tipos en este capítulo.

  • Clase 2 • Cadenas de análisis y procesamiento de texto

    Enseña cómo los tokenizadores, filtros y analizadores transforman el texto en el momento de indexación y consulta. El diseño adecuado de la cadena afecta directamente la calidad de la búsqueda.

  • Clase 3 • Campos dinámicos y campos de copia

    Introduce patrones de campos dinámicos y directivas de campos de copia para un diseño de esquema flexible. Los estudiantes reducen el costo de mantenimiento del esquema mientras soportan diversas necesidades de consulta.

  • Clase 4 • Tipos de campo y modelado de datos

    Cubre tipos de campo primitivos y complejos, incluyendo texto, numérico, fecha y geo. Los estudiantes mapean datos del dominio a tipos de campo de Solr apropiados.

  • Clase 5 • Validación y evolución del esquema

    Aborda cómo agregar, modificar y eliminar campos de forma segura en esquemas de producción. Los estudiantes aplican estrategias que evitan la pérdida de datos y la interrupción por reindexación.

Capítulo 3Ver detalles

Indexando documentos e ingesta de datos

  • Clase 1 • Usando SolrJ para clientes Java

    Presenta la librería cliente SolrJ para indexación y consultas programáticas desde Java. Los estudiantes construyen una aplicación de indexación simple usando SolrJ.

  • Clase 2 • Actualizaciones atómicas y concurrencia optimista

    Cubre las actualizaciones parciales de documentos y la detección de conflictos basada en versiones. Los estudiantes aplican actualizaciones atómicas para evitar reescrituras completas de documentos en escenarios de alto rendimiento.

  • Clase 3 • Data Import Handler y conectores

    Enseña el Data Import Handler (DIH) para extraer datos de bases de datos y archivos. Los estudiantes configuran un trabajo DIH y programan importaciones incrementales.

  • Clase 4 • Indexando a través de la Update API

    Cubre el envío de documentos en formato JSON, XML y CSV a través del Update Request Handler. Los estudiantes indexan documentos de muestra y verifican los resultados de inmediato.

  • Clase 5 • Fundamentos de indexación

    Explica el modelo de documentos de Solr, las claves únicas y la semántica de commit. Establece modelos mentales correctos antes de que los estudiantes escriban cualquier código de indexación.

Capítulo 4Ver detalles

Consultando Solr: sintaxis y parámetros

  • Clase 1 • Faceting y agregaciones

    Introduce facetas de campo, de rango, pivot y agregaciones de la JSON Facet API. Los estudiantes construyen características de navegación y analíticas sobre los resultados de búsqueda.

  • Clase 2 • Filtrado, ordenamiento y paginación

    Enseña consultas de filtro (fq), parámetros de ordenamiento y paginación basada en cursor para conjuntos de resultados grandes. Los estudiantes optimizan consultas separando el caché de filtros de la puntuación.

  • Clase 3 • Query parsers DisMax y eDisMax

    Cubre los parsers DisMax y Extended DisMax diseñados para cajas de búsqueda orientadas al usuario. Los estudiantes configuran los parámetros qf, pf, mm y boost para el ajuste de relevancia.

  • Clase 4 • Highlighting y formateo de resultados

    Cubre el resaltado de fragmentos, los response writers y los transformadores de campo para la presentación de resultados. Los estudiantes configuran formatos de salida adecuados para diferentes aplicaciones cliente.

  • Clase 5 • Conceptos básicos del Standard Query Parser

    Introduce la sintaxis del parser de consultas de Lucene para búsquedas por campo, operadores booleanos y comodines. Los estudiantes escriben y prueban consultas contra datos de muestra indexados.

Capítulo 5Ver detalles

Ajuste de relevancia y ranking

  • Clase 1 • Estrategias de boosting

    Cubre los boosts en tiempo de indexación, en tiempo de consulta y los boosts de función de consulta para el control de relevancia. Los estudiantes aplican múltiples estrategias de boost y miden su efecto combinado.

  • Clase 2 • Entendiendo la puntuación de Solr

    Explica el modelo de similitud BM25 por defecto y cómo los boosts a nivel de campo afectan las puntuaciones. Los estudiantes usan el parámetro debug=query para inspeccionar las explicaciones de puntuación.

  • Clase 3 • Consultas de función y fórmulas de ranking

    Enseña la sintaxis de consultas de función de Solr para señales de ranking basadas en matemáticas. Los estudiantes construyen fórmulas de ranking personalizadas combinando la puntuación de texto con señales numéricas de negocio.

  • Clase 4 • Learning to Rank con Solr LTR

    Introduce el plugin de Learning to Rank (LTR) para modelos de ranking basados en aprendizaje automático. Los estudiantes cargan almacenes de características, entrenan un modelo y lo despliegan para reranking.

  • Clase 5 • Pruebas de relevancia e iteración

    Cubre la evaluación offline con listas de juicio y enfoques de prueba A/B online. Los estudiantes establecen un flujo de trabajo repetible de mejora de relevancia.

Capítulo 6Ver detalles

SolrCloud: búsqueda distribuida a escala

  • Clase 1 • Indexación y consultas distribuidas

    Enseña cómo los documentos se enrutan a los shards y cómo se fusionan las consultas distribuidas. Los estudiantes configuran enrutamiento personalizado y optimizan el rendimiento de consultas entre shards.

  • Clase 2 • Arquitectura de SolrCloud

    Explica el sharding, la replicación y el rol de ZooKeeper en la coordinación del clúster. Los estudiantes mapean los conceptos de SolrCloud a sus propios requisitos de escalado.

  • Clase 3 • Operaciones de ZooKeeper y gestión de configuración

    Cubre la carga de conjuntos de configuración, la gestión de znodes de ZooKeeper y la reconfiguración del clúster. Los estudiantes usan la herramienta zkcli y la Config API para cambios de configuración seguros.

  • Clase 4 • Tipos de réplica y alta disponibilidad

    Introduce los tipos de réplica NRT, TLOG y PULL y sus compensaciones de disponibilidad. Los estudiantes seleccionan estrategias de réplica que equilibran el rendimiento de indexación con la disponibilidad de lectura.

  • Clase 5 • Creando y gestionando colecciones

    Cubre la Collections API para crear, modificar y eliminar colecciones. Los estudiantes realizan operaciones comunes del ciclo de vida de una colección a través de la API y la UI de administración.

Capítulo 7Ver detalles

Ajuste de rendimiento y almacenamiento en caché

  • Clase 1 • Ajuste de JVM y heap

    Cubre el dimensionamiento del heap de JVM, la selección del recolector de basura y la minimización de pausas de GC. Los estudiantes aplican configuraciones que reducen las pausas stop-the-world durante la carga máxima.

  • Clase 2 • Arquitectura de caché de Solr

    Explica el caché de filtros, el caché de resultados de consulta, el caché de documentos y el caché de valores de campo. Los estudiantes configuran tamaños de caché y políticas de desalojo para sus cargas de trabajo.

  • Clase 3 • Optimización de índices y gestión de segmentos

    Enseña la fusión de segmentos de Lucene, operaciones de optimización y estrategias de calentamiento de índices. Los estudiantes equilibran el costo de fusión con el rendimiento de consultas para el tamaño de su índice.

  • Clase 4 • Perfilado de rendimiento de consultas

    Introduce el parámetro debug=timing, el registro de consultas lentas y la API de métricas de Solr. Los estudiantes identifican componentes de consulta costosos y aplican optimizaciones dirigidas.

  • Clase 5 • Dimensionamiento de hardware y despliegue

    Cubre las consideraciones de I/O de disco, CPU, RAM y red para despliegues de Solr. Los estudiantes producen una estimación de dimensionamiento basada en el tamaño del índice, la tasa de consultas y los objetivos de SLA.

Capítulo 8Ver detalles

Seguridad, monitoreo y operaciones de producción

  • Clase 1 • Monitoreo con métricas y registro

    Introduce la API de métricas de Solr, la integración con JMX y la configuración de registro estructurado. Los estudiantes construyen dashboards que muestran la latencia de consultas, las tasas de error y las relaciones de aciertos de caché.

  • Clase 2 • Backup, recuperación y planificación ante desastres

    Cubre los backups basados en snapshots, la recuperación basada en replicación y la planificación de RTO/RPO. Los estudiantes diseñan un cronograma de backup y prueban los procedimientos de restauración de punta a punta.

  • Clase 3 • Actualizaciones y runbooks operativos

    Enseña actualizaciones continuas, verificaciones de compatibilidad y pasos de validación post-actualización. Los estudiantes crean runbooks para operaciones de rutina y respuesta a incidentes.

  • Clase 4 • Autenticación y autorización

    Cubre los plugins de autenticación integrados de Solr: Basic Auth, Kerberos y JWT. Los estudiantes configuran control de acceso basado en roles para proteger colecciones y endpoints de administración.

  • Clase 5 • Encriptación TLS y seguridad de red

    Enseña a habilitar TLS para la comunicación cliente-Solr y entre nodos. Los estudiantes generan certificados, configuran keystores y verifican conexiones encriptadas.

Certificación

Tu certificado válido de finalización

Este curso es para ti:

  • Desarrolladores backend: que quieren agregar búsqueda potente a sus aplicaciones.

  • Ingenieros de datos: que construyen pipelines que necesitan recuperación de texto rápida y escalable.

  • Ingenieros DevOps: encargados de desplegar y mantener infraestructura de búsqueda.

  • Arquitectos de software: que evalúan Solr para proyectos de búsqueda empresarial a gran escala.

  • Administradores de bases de datos: que amplían sus habilidades hacia tecnologías de búsqueda.

  • Product managers técnicos: que necesitan entender los sistemas de búsqueda que supervisan.

Lo que dicen nuestros estudiantes

Sus clases son perfectas. Adquirí el paquete de un año y, finalmente, tengo la oportunidad de seguir diversos temas de mi interés sin necesidad de cambiar de plataforma... agradezco por todo lo que hacen, ya los he recomendado a otras personas...
Giulio Carlo
Giulio CarloEstudiante de Marketing Digital
Me gusta cómo las lecciones van directo al grano y cómo puedo cambiar capítulos y saltar contenidos que no necesito.
Mariana Ferres
Mariana FerresEstudiante de Fotografía
Me gusta el contenido y la forma de presentación y transcripción de videos, ¡lo que acelera el proceso!
Luciana Alvarenga
Luciana AlvarengaEstudiante de Diseño de Uñas
La plataforma es rápida, simple de usar. La diversidad de contenido y los videos complementarios ayudan mucho en el aprendizaje.
André Felipe
André FelipeEstudiante de Ingeniería de Prompt

Principales capacitaciones

Preguntas Frecuentes

¿Quién es Dedika?

¿El certificado es válido en Chile?

¿Los cursos son gratuitos?

¿Cuál es la carga horaria del curso?

¿Cómo son los cursos?

¿Cómo funcionan los cursos?

¿Cuál es la duración de los cursos?

¿Cuál es el costo o precio de los cursos?

¿Qué es un curso EAD u online y cómo funciona?

Curso en PDF