
Curso de Apache Solr
Domine Apache Solr desde la instalación hasta la búsqueda distribuida de nivel producción. Esta capacitación cubre el diseño de esquemas, el ajuste de relevancia, la arquitectura de SolrCloud, la seguridad y la optimización del rendimiento: todo lo que necesita para construir y operar sistemas de búsqueda empresarial con confianza.
Lo que vas a aprender:
Usted obtendrá experiencia práctica en toda la pila de Solr, comenzando con los conceptos básicos de búsqueda y avanzando por la configuración del esquema, la indexación de documentos y el análisis avanzado de consultas. Aprenderá a ajustar la relevancia usando BM25, consultas de función y modelos de aprendizaje automático para clasificación. El curso cubre el despliegue de SolrCloud con ZooKeeper, colecciones con múltiples fragmentos y estrategias de réplicas de alta disponibilidad. También implementará autenticación, cifrado TLS, paneles de monitoreo y procedimientos de backup para entornos de producción. Módulos adicionales abordan la integración con Kafka, búsqueda vectorial, despliegue en Kubernetes y la solución sistemática de problemas en incidentes reales.
Cómo estudias de forma práctica Curso de Apache Solr
Cómo practicas Curso de Apache Solr
Para ti que eres empresa y quieres capacitar a tu equipo
En Dedika para empresas, el curso incluye ejercicios y ejemplos adaptados a tu propio negocio y a las necesidades de tu empresa.
Contenido del curso
8 Capítulos • 39 LeccionesDuración entre 4 y 360 horas (tú decides)
Capítulo 1OcultarOcultar detallesVer detallesIntroducción a Solr y Conceptos de Búsqueda
Introducción a Solr y Conceptos de Búsqueda
Lección 1 • Instalación y Ejecución de Solr
Guía a los estudiantes a través de la instalación local, el inicio y la verificación básica. La configuración práctica garantiza un entorno de trabajo para todos los ejercicios posteriores.
Lección 2 • ¿Qué es Apache Solr?
Cubre el origen, propósito y posición de Solr en el panorama de búsqueda. Establece el contexto para todos los temas técnicos posteriores del capítulo.
Lección 3 • Descripción General de la Arquitectura de Solr
Explica los componentes principales de Solr: núcleos, manejadores y el pipeline de solicitudes. Los estudiantes adquieren un modelo mental de cómo fluye una consulta a través del sistema.
Lección 4 • Conceptos Básicos de Búsqueda
Presenta los índices invertidos, la puntuación de relevancia y los fundamentos de la búsqueda de texto completo. Proporciona el vocabulario conceptual necesario a lo largo del curso.
Capítulo 2OcultarOcultar detallesVer detallesDiseño de Esquema y Configuración de Campos
Diseño de Esquema y Configuración de Campos
Lección 1 • Comprendiendo el Esquema de Solr
Explica el esquema gestionado frente al schema.xml clásico y sus ventajas y desventajas. Establece la base para todas las definiciones de campos y tipos en este capítulo.
Lección 2 • Cadenas de Análisis y Procesamiento de Texto
Enseña cómo los tokenizadores, filtros y analizadores transforman el texto en el momento de indexación y consulta. El diseño adecuado de la cadena afecta directamente la calidad de la búsqueda.
Lección 3 • Campos Dinámicos y Campos de Copia
Presenta los patrones de campos dinámicos y las directivas de campos de copia para un diseño de esquema flexible. Los estudiantes reducen la sobrecarga de mantenimiento del esquema mientras satisfacen diversas necesidades de consulta.
Lección 4 • Tipos de Campo y Modelado de Datos
Cubre tipos de campo primitivos y complejos, incluyendo texto, numérico, fecha y geoespacial. Los estudiantes mapean datos de dominio a tipos de campo de Solr apropiados.
Lección 5 • Validación y Evolución del Esquema
Aborda la adición, modificación y eliminación segura de campos en esquemas de producción. Los estudiantes aplican estrategias que evitan la pérdida de datos y la interrupción de la reindexación.
Capítulo 3OcultarOcultar detallesVer detallesIndexación de Documentos e Ingesta de Datos
Indexación de Documentos e Ingesta de Datos
Lección 1 • Uso de SolrJ para Clientes Java
Presenta la biblioteca cliente SolrJ para indexación y consulta programática desde Java. Los estudiantes construyen una aplicación de indexación simple usando SolrJ.
Lección 2 • Actualizaciones Atómicas y Concurrencia Optimista
Cubre las actualizaciones parciales de documentos y la detección de conflictos basada en versiones. Los estudiantes aplican actualizaciones atómicas para evitar reescrituras completas de documentos en escenarios de alto rendimiento.
Lección 3 • Manejador de Importación de Datos y Conectores
Enseña el Manejador de Importación de Datos (DIH) para extraer datos de bases de datos y archivos. Los estudiantes configuran un trabajo DIH y programan importaciones incrementales.
Lección 4 • Indexación a través de la API de Actualización
Cubre el envío de documentos JSON, XML y CSV a través del Manejador de Solicitudes de Actualización. Los estudiantes indexan documentos de muestra y verifican los resultados de inmediato.
Lección 5 • Fundamentos de Indexación
Explica el modelo de documentos de Solr, las claves únicas y la semántica de confirmación. Establece modelos mentales correctos antes de que los estudiantes escriban cualquier código de indexación.
Capítulo 4OcultarOcultar detallesVer detallesConsultando Solr: Sintaxis y Parámetros
Consultando Solr: Sintaxis y Parámetros
Lección 1 • Facetado y Agregaciones
Presenta facetas de campo, facetas de rango, facetas pivote y agregaciones de la API de Facetas JSON. Los estudiantes construyen funciones de navegación y analítica sobre los resultados de búsqueda.
Lección 2 • Filtrado, Ordenamiento y Paginación
Enseña consultas de filtro (fq), parámetros de ordenamiento y paginación basada en cursor para conjuntos de resultados grandes. Los estudiantes optimizan consultas separando el almacenamiento en caché de filtros de la puntuación.
Lección 3 • Analizadores de Consulta DisMax y eDisMax
Cubre los analizadores DisMax y DisMax Extendido diseñados para cajas de búsqueda orientadas al usuario. Los estudiantes configuran los parámetros qf, pf, mm y boost para el ajuste de relevancia.
Lección 4 • Resaltado y Formateo de Resultados
Cubre el resaltado de fragmentos, los escritores de respuesta y los transformadores de campo para la presentación de resultados. Los estudiantes configuran formatos de salida adecuados para diferentes aplicaciones cliente.
Lección 5 • Fundamentos del Analizador de Consultas Estándar
Presenta la sintaxis del analizador de consultas de Lucene para búsquedas por campo, operadores booleanos y comodines. Los estudiantes escriben y prueban consultas contra datos de muestra indexados.
Capítulo 5OcultarOcultar detallesVer detallesAjuste de Relevancia y Clasificación
Ajuste de Relevancia y Clasificación
Lección 1 • Estrategias de Impulso
Cubre los impulsos en tiempo de indexación, en tiempo de consulta y los impulsos de consulta de función para el control de relevancia. Los estudiantes aplican múltiples estrategias de impulso y miden su efecto combinado.
Lección 2 • Comprendiendo la Puntuación de Solr
Explica el modelo de similitud BM25 predeterminado y cómo los impulsos a nivel de campo afectan las puntuaciones. Los estudiantes usan el parámetro debug=query para inspeccionar las explicaciones de puntuación.
Lección 3 • Consultas de Función y Fórmulas de Clasificación
Enseña la sintaxis de consultas de función de Solr para señales de clasificación basadas en matemáticas. Los estudiantes construyen fórmulas de clasificación personalizadas que combinan la puntuación de texto con señales de negocio numéricas.
Lección 4 • Aprendizaje para Clasificar con Solr LTR
Presenta el plugin de Aprendizaje para Clasificar (LTR) para modelos de clasificación de aprendizaje automático. Los estudiantes cargan almacenes de características, entrenan un modelo y lo despliegan para re-clasificar.
Lección 5 • Pruebas e Iteración de Relevancia
Cubre la evaluación offline con listas de juicio y enfoques de pruebas A/B online. Los estudiantes establecen un flujo de trabajo repetible para la mejora de la relevancia.
Capítulo 6OcultarOcultar detallesVer detallesSolrCloud: Búsqueda Distribuida a Escala
SolrCloud: Búsqueda Distribuida a Escala
Lección 1 • Indexación y Consulta Distribuida
Enseña cómo se enrutan los documentos a los fragmentos y cómo se fusionan las consultas distribuidas. Los estudiantes configuran enrutamiento personalizado y optimizan el rendimiento de consultas entre fragmentos.
Lección 2 • Arquitectura de SolrCloud
Explica el fragmentado, la replicación y el rol de ZooKeeper en la coordinación del clúster. Los estudiantes mapean los conceptos de SolrCloud a sus propios requisitos de escalamiento.
Lección 3 • Operaciones de ZooKeeper y Gestión de Configuración
Cubre la carga de conjuntos de configuración, la gestión de znodes de ZooKeeper y la reconfiguración del clúster. Los estudiantes usan la herramienta zkcli y la API de Configuración para cambios de configuración seguros.
Lección 4 • Tipos de Réplica y Alta Disponibilidad
Presenta los tipos de réplica NRT, TLOG y PULL y sus compensaciones de disponibilidad. Los estudiantes seleccionan estrategias de réplica que equilibran el rendimiento de indexación con la disponibilidad de lectura.
Lección 5 • Creación y Gestión de Colecciones
Cubre la API de Colecciones para crear, modificar y eliminar colecciones. Los estudiantes realizan operaciones comunes del ciclo de vida de la colección a través de la API y la UI de administración.
Capítulo 7OcultarOcultar detallesVer detallesAjuste de Rendimiento y Almacenamiento en Caché
Ajuste de Rendimiento y Almacenamiento en Caché
Lección 1 • Ajuste de la JVM y la Memoria Heap
Cubre el dimensionamiento de la memoria heap de la JVM, la selección del recolector de basura y la minimización de pausas de GC. Los estudiantes aplican configuraciones que reducen las pausas de detención total durante la carga máxima.
Lección 2 • Arquitectura de Almacenamiento en Caché de Solr
Explica la caché de filtros, la caché de resultados de consulta, la caché de documentos y la caché de valores de campo. Los estudiantes configuran tamaños de caché y políticas de desalojo para sus cargas de trabajo.
Lección 3 • Optimización de Índices y Gestión de Segmentos
Enseña la fusión de segmentos de Lucene, las operaciones de optimización y las estrategias de calentamiento de índices. Los estudiantes equilibran la sobrecarga de fusión con el rendimiento de consultas para el tamaño de su índice.
Lección 4 • Perfilado de Rendimiento de Consultas
Presenta el parámetro debug=timing, el registro de consultas lentas y la API de métricas de Solr. Los estudiantes identifican componentes de consulta costosos y aplican optimizaciones específicas.
Lección 5 • Dimensionamiento de Hardware y Despliegue
Cubre las consideraciones de E/S de disco, CPU, RAM y red para los despliegues de Solr. Los estudiantes producen una estimación de tamaño basada en el tamaño del índice, la tasa de consultas y los objetivos de SLA.
Capítulo 8OcultarOcultar detallesVer detallesSeguridad, Monitoreo y Operaciones de Producción
Seguridad, Monitoreo y Operaciones de Producción
Lección 1 • Monitoreo con Métricas y Registro
Presenta la API de métricas de Solr, la integración con JMX y la configuración de registro estructurado. Los estudiantes construyen dashboards que muestran la latencia de consultas, las tasas de error y las tasas de aciertos de caché.
Lección 2 • Backup, Recuperación y Planificación de Desastres
Cubre los backups basados en instantáneas, la recuperación basada en replicación y la planificación de RTO/RPO. Los estudiantes diseñan un cronograma de backup y prueban los procedimientos de restauración de principio a fin.
Lección 3 • Actualizaciones y Runbooks Operativos
Enseña actualizaciones continuas, verificaciones de compatibilidad y pasos de validación posteriores a la actualización. Los estudiantes crean runbooks para operaciones rutinarias y respuesta a incidentes.
Lección 4 • Autenticación y Autorización
Cubre los plugins de autenticación integrados de Solr: Autenticación Básica, Kerberos y JWT. Los estudiantes configuran control de acceso basado en roles para proteger colecciones y endpoints de administración.
Lección 5 • Cifrado TLS y Seguridad de Red
Enseña a habilitar TLS para la comunicación cliente-Solr e internodo. Los estudiantes generan certificados, configuran almacenes de claves y verifican las conexiones cifradas.
Tu certificado válido de finalización
Este curso es para ti:
Desarrolladores backend: que desean agregar búsqueda potente a sus aplicaciones.
Ingenieros de datos: que construyen pipelines que necesitan recuperación de texto rápida y escalable.
Ingenieros de DevOps: encargados de desplegar y mantener la infraestructura de búsqueda.
Arquitectos de software: que evalúan Solr para proyectos de búsqueda empresarial a gran escala.
Administradores de base de datos: que amplían sus habilidades hacia tecnologías de búsqueda.
Gerentes técnicos de producto: que necesitan comprender los sistemas de búsqueda que supervisan.
Lo que dicen nuestros estudiantes
Sus clases son perfectas. Adquirí el paquete de un año y, finalmente, tengo la oportunidad de seguir diversos temas de mi interés sin necesidad de cambiar de plataforma... les agradezco por todo lo que hacen, ya los he recomendado a otras personas...

Me gusta cómo las lecciones van directo al grano y cómo puedo cambiar capítulos y saltar contenidos que no necesito.

Me gusta el contenido y la forma de presentación y transcripción de videos, ¡lo que acelera el proceso!

La plataforma es rápida, fácil de usar. La diversidad de contenido y los videos complementarios ayudan mucho en el aprendizaje.

Principales capacitaciones
Preguntas frecuentes
¿Quién es Dedika?
¿El certificado es válido en Colombia?
¿Los cursos son gratuitos?
¿Cuál es la carga horaria del curso?
¿Cómo son los cursos?
¿Cómo funcionan los cursos?
¿Cuál es la duración de los cursos?
¿Cuál es el costo o precio de los cursos?
¿Qué es un curso EAD u online y cómo funciona?
Curso en PDF




















