
Curso de Apache Solr
Domina Apache Solr desde la instalación hasta la búsqueda distribuida de grado producción. Esta capacitación cubre diseño de esquemas, ajuste de relevancia, arquitectura SolrCloud, seguridad y optimización de rendimiento — todo lo que necesitas para construir y operar sistemas de búsqueda empresarial con confianza.
Lo que vas a aprender:
Obtendrás experiencia práctica en todo el stack de Solr, comenzando con conceptos centrales de búsqueda y avanzando por la configuración del esquema, la indexación de documentos y el análisis avanzado de consultas. Aprenderás a ajustar la relevancia usando BM25, consultas de función y modelos de aprendizaje automático para ranking. El curso cubre el despliegue de SolrCloud con ZooKeeper, colecciones con múltiples fragmentos y estrategias de réplica de alta disponibilidad. También implementarás autenticación, cifrado TLS, paneles de monitoreo y procedimientos de respaldo para entornos de producción. Módulos adicionales abordan la integración con Kafka, búsqueda vectorial, despliegue en Kubernetes y la resolución sistemática de incidentes del mundo real.
Cómo estudias de forma práctica Curso de Apache Solr
Cómo practicas Curso de Apache Solr
Para ti que eres empresa y quieres capacitar a tu equipo
En Dedika para empresas, el curso incluye ejercicios y ejemplos adaptados a tu propio negocio y a las necesidades de tu empresa.
Contenido del curso
8 Capítulos • 39 LeccionesDuración entre 4 y 360 horas (tú decides)
Capítulo 1OcultarOcultar detallesVer detallesIntroducción a Solr y conceptos de búsqueda
Introducción a Solr y conceptos de búsqueda
Lección 1 • Instalando y ejecutando Solr
Guía a los estudiantes a través de la instalación local, inicio y verificación básica. La configuración práctica asegura un entorno funcional para todos los ejercicios posteriores.
Lección 2 • Qué es Apache Solr
Cubre el origen, propósito y posición de Solr en el panorama de búsqueda. Establece el contexto para todos los temas técnicos posteriores en el capítulo.
Lección 3 • Descripción general de la arquitectura de Solr
Explica los componentes principales de Solr: núcleos, manejadores y el pipeline de solicitudes. Los estudiantes obtienen un modelo mental de cómo fluye una consulta a través del sistema.
Lección 4 • Conceptos básicos de búsqueda
Introduce índices invertidos, puntuación de relevancia y fundamentos de búsqueda de texto completo. Proporciona el vocabulario conceptual necesario a lo largo del curso.
Capítulo 2OcultarOcultar detallesVer detallesDiseño de esquema y configuración de campos
Diseño de esquema y configuración de campos
Lección 1 • Entendiendo el esquema de Solr
Explica el esquema administrado vs. el schema.xml clásico y sus compensaciones. Sienta las bases para todas las definiciones de campos y tipos en este capítulo.
Lección 2 • Cadenas de análisis y procesamiento de texto
Enseña cómo los tokenizadores, filtros y analizadores transforman el texto en el momento de indexación y consulta. El diseño adecuado de la cadena afecta directamente la calidad de la búsqueda.
Lección 3 • Campos dinámicos y campos de copia
Introduce patrones de campos dinámicos y directivas de campos de copia para un diseño de esquema flexible. Los estudiantes reducen la sobrecarga de mantenimiento del esquema mientras soportan diversas necesidades de consulta.
Lección 4 • Tipos de campo y modelado de datos
Cubre tipos de campo primitivos y complejos, incluyendo texto, numérico, fecha y geo. Los estudiantes mapean datos del dominio a tipos de campo de Solr apropiados.
Lección 5 • Validación y evolución del esquema
Aborda agregar, modificar y eliminar campos de forma segura en esquemas de producción. Los estudiantes aplican estrategias que evitan la pérdida de datos y la interrupción de la reindexación.
Capítulo 3OcultarOcultar detallesVer detallesIndexando documentos e ingesta de datos
Indexando documentos e ingesta de datos
Lección 1 • Usando SolrJ para clientes Java
Introduce la librería cliente SolrJ para indexación y consultas programáticas desde Java. Los estudiantes construyen una aplicación de indexación simple usando SolrJ.
Lección 2 • Actualizaciones atómicas y concurrencia optimista
Cubre actualizaciones parciales de documentos y detección de conflictos basada en versión. Los estudiantes aplican actualizaciones atómicas para evitar reescrituras completas de documentos en escenarios de alto rendimiento.
Lección 3 • Manejador de importación de datos y conectores
Enseña el Data Import Handler (DIH) para extraer datos de bases de datos y archivos. Los estudiantes configuran un trabajo DIH y programan importaciones incrementales.
Lección 4 • Indexación mediante la API de actualización
Cubre el envío de documentos JSON, XML y CSV a través del Update Request Handler. Los estudiantes indexan documentos de muestra y verifican los resultados inmediatamente.
Lección 5 • Fundamentos de indexación
Explica el modelo de documento de Solr, claves únicas y semántica de commits. Establece modelos mentales correctos antes de que los estudiantes escriban cualquier código de indexación.
Capítulo 4OcultarOcultar detallesVer detallesConsultando Solr: Sintaxis y parámetros
Consultando Solr: Sintaxis y parámetros
Lección 1 • Faceteado y agregaciones
Introduce facetas de campo, facetas de rango, facetas pivote y agregaciones de la API de facetas JSON. Los estudiantes construyen funciones de navegación y analíticas sobre los resultados de búsqueda.
Lección 2 • Filtrado, ordenamiento y paginación
Enseña consultas de filtro (fq), parámetros de ordenamiento y paginación basada en cursor para grandes conjuntos de resultados. Los estudiantes optimizan consultas separando el caché de filtros de la puntuación.
Lección 3 • Analizadores de consultas DisMax y eDisMax
Cubre los analizadores DisMax y Extended DisMax diseñados para cuadros de búsqueda orientados al usuario. Los estudiantes configuran los parámetros qf, pf, mm y boost para el ajuste de relevancia.
Lección 4 • Resaltado y formato de resultados
Cubre resaltado de fragmentos, escritores de respuesta y transformadores de campo para la presentación de resultados. Los estudiantes configuran formatos de salida adecuados para diferentes aplicaciones cliente.
Lección 5 • Conceptos básicos del analizador de consultas estándar
Introduce la sintaxis del analizador de consultas de Lucene para búsquedas por campo, operadores booleanos y comodines. Los estudiantes escriben y prueban consultas contra datos de muestra indexados.
Capítulo 5OcultarOcultar detallesVer detallesAjuste de relevancia y ranking
Ajuste de relevancia y ranking
Lección 1 • Estrategias de impulso
Cubre impulsos en tiempo de indexación, impulsos en tiempo de consulta e impulsos de consulta de función para el control de relevancia. Los estudiantes aplican múltiples estrategias de impulso y miden su efecto combinado.
Lección 2 • Entendiendo la puntuación de Solr
Explica el modelo de similitud BM25 predeterminado y cómo los impulsos a nivel de campo afectan las puntuaciones. Los estudiantes usan el parámetro debug=query para inspeccionar las explicaciones de puntuación.
Lección 3 • Consultas de función y fórmulas de ranking
Enseña la sintaxis de consultas de función de Solr para señales de ranking basadas en matemáticas. Los estudiantes construyen fórmulas de ranking personalizadas que combinan la puntuación de texto con señales numéricas de negocio.
Lección 4 • Learning to Rank con Solr LTR
Introduce el plugin Learning to Rank (LTR) para modelos de ranking de aprendizaje automático. Los estudiantes cargan almacenes de características, entrenan un modelo y lo despliegan para reordenar.
Lección 5 • Pruebas de relevancia e iteración
Cubre evaluación offline con listas de juicio y enfoques de pruebas A/B en línea. Los estudiantes establecen un flujo de trabajo repetible de mejora de relevancia.
Capítulo 6OcultarOcultar detallesVer detallesSolrCloud: Búsqueda distribuida a escala
SolrCloud: Búsqueda distribuida a escala
Lección 1 • Indexación y consultas distribuidas
Enseña cómo los documentos se enrutan a los shards y cómo se fusionan las consultas distribuidas. Los estudiantes configuran enrutamiento personalizado y optimizan el rendimiento de consultas entre shards.
Lección 2 • Arquitectura de SolrCloud
Explica el sharding, la replicación y el rol de ZooKeeper en la coordinación del clúster. Los estudiantes mapean conceptos de SolrCloud a sus propios requisitos de escalamiento.
Lección 3 • Operaciones de ZooKeeper y gestión de configuración
Cubre la carga de conjuntos de configuración, la gestión de znodes de ZooKeeper y la reconfiguración del clúster. Los estudiantes usan la herramienta zkcli y la API de configuración para cambios de configuración seguros.
Lección 4 • Tipos de réplica y alta disponibilidad
Introduce los tipos de réplica NRT, TLOG y PULL y sus compensaciones de disponibilidad. Los estudiantes seleccionan estrategias de réplica que equilibran el rendimiento de indexación con la disponibilidad de lectura.
Lección 5 • Creando y administrando colecciones
Cubre la API de colecciones para crear, modificar y eliminar colecciones. Los estudiantes realizan operaciones comunes del ciclo de vida de la colección mediante la API y la UI de administración.
Capítulo 7OcultarOcultar detallesVer detallesAjuste de rendimiento y almacenamiento en caché
Ajuste de rendimiento y almacenamiento en caché
Lección 1 • Ajuste de JVM y heap
Cubre el dimensionamiento del heap de JVM, la selección del recolector de basura y la minimización de pausas de GC. Los estudiantes aplican configuraciones que reducen las pausas stop-the-world durante la carga máxima.
Lección 2 • Arquitectura de almacenamiento en caché de Solr
Explica la caché de filtros, caché de resultados de consulta, caché de documentos y caché de valores de campo. Los estudiantes configuran tamaños de caché y políticas de desalojo para sus cargas de trabajo.
Lección 3 • Optimización de índice y gestión de segmentos
Enseña la fusión de segmentos de Lucene, operaciones de optimización y estrategias de calentamiento de índice. Los estudiantes equilibran la sobrecarga de fusión con el rendimiento de consultas para el tamaño de su índice.
Lección 4 • Perfilado de rendimiento de consultas
Introduce el parámetro debug=timing, el registro de consultas lentas y la API de métricas de Solr. Los estudiantes identifican componentes de consulta costosos y aplican optimizaciones específicas.
Lección 5 • Dimensionamiento de hardware y despliegue
Cubre consideraciones de I/O de disco, CPU, RAM y red para despliegues de Solr. Los estudiantes producen una estimación de dimensionamiento basada en el tamaño del índice, la tasa de consultas y los objetivos de SLA.
Capítulo 8OcultarOcultar detallesVer detallesSeguridad, monitoreo y operaciones de producción
Seguridad, monitoreo y operaciones de producción
Lección 1 • Monitoreo con métricas y registros
Introduce la API de métricas de Solr, la integración JMX y la configuración de registro estructurado. Los estudiantes construyen dashboards que muestran la latencia de consultas, tasas de error y tasas de aciertos de caché.
Lección 2 • Respaldo, recuperación y planificación de desastres
Cubre respaldos basados en instantáneas, recuperación basada en replicación y planificación de RTO/RPO. Los estudiantes diseñan un programa de respaldo y prueban los procedimientos de restauración de principio a fin.
Lección 3 • Actualizaciones y runbooks operativos
Enseña actualizaciones continuas, verificaciones de compatibilidad y pasos de validación posteriores a la actualización. Los estudiantes crean runbooks para operaciones rutinarias y respuesta a incidentes.
Lección 4 • Autenticación y autorización
Cubre los plugins de autenticación integrados de Solr: Basic Auth, Kerberos y JWT. Los estudiantes configuran control de acceso basado en roles para proteger colecciones y endpoints de administración.
Lección 5 • Encriptación TLS y seguridad de red
Enseña a habilitar TLS para la comunicación cliente-Solr y entre nodos. Los estudiantes generan certificados, configuran almacenes de claves y verifican conexiones encriptadas.
Tu certificado válido de finalización
Este curso es para ti:
Desarrolladores backend: que desean agregar búsqueda potente a sus aplicaciones.
Ingenieros de datos: que construyen pipelines que necesitan recuperación de texto rápida y escalable.
Ingenieros DevOps: encargados de desplegar y mantener infraestructura de búsqueda.
Arquitectos de software: evaluando Solr para proyectos de búsqueda empresarial de gran escala.
Administradores de base de datos: expandiendo su conjunto de habilidades hacia tecnologías de búsqueda.
Gerentes técnicos de producto: que necesitan entender los sistemas de búsqueda que supervisan.
Lo que dicen nuestros alumnos
Sus clases son perfectas. Adquirí el paquete de un año y, finalmente, tengo la oportunidad de seguir diversos temas de mi interés sin necesidad de cambiar de plataforma... agradezco todo lo que hacen, ya los he recomendado a otras personas...

Me gusta cómo las lecciones van directo al grano y cómo puedo cambiar capítulos y saltar contenidos que no necesito.

Me gusta el contenido y la forma de presentación y transcripción de videos, ¡lo que acelera el proceso!

La plataforma es rápida, simple de usar. La diversidad de contenido y los videos complementarios ayudan mucho en el aprendizaje.

Principales capacitaciones
Preguntas frecuentes
¿Quién es Dedika?
¿El certificado es válido en México?
¿Los cursos son gratuitos?
¿Cuál es la carga horaria del curso?
¿Cómo son los cursos?
¿Cómo funcionan los cursos?
¿Cuál es la duración de los cursos?
¿Cuál es el costo o precio de los cursos?
¿Qué es un curso EAD u online y cómo funciona?
Curso en PDF




















