
Curso de Apache Solr
Dominá Apache Solr, desde la instalación hasta la búsqueda distribuida de nivel producción. Esta capacitación cubre diseño de esquemas, ajuste de relevancia, arquitectura SolrCloud, seguridad y optimización de rendimiento: todo lo que necesitás para construir y operar sistemas de búsqueda enterprise con confianza.
Qué vas a aprender:
Vas a adquirir experiencia práctica en todo el stack de Solr, empezando por los conceptos centrales de búsqueda y avanzando por la configuración del esquema, la indexación de documentos y el parseo avanzado de consultas. Vas a aprender a ajustar la relevancia usando BM25, consultas de función y modelos de ranking por aprendizaje automático. El curso cubre el despliegue de SolrCloud con ZooKeeper, colecciones multi-shard y estrategias de réplicas de alta disponibilidad. También vas a implementar autenticación, cifrado TLS, paneles de monitoreo y procedimientos de backup para entornos de producción. Módulos adicionales abordan la integración con Kafka, búsqueda vectorial, despliegue en Kubernetes y la resolución sistemática de incidentes del mundo real.
Cómo estudiás de forma práctica Curso de Apache Solr
Cómo practicás Curso de Apache Solr
Para vos que sos empresa y querés capacitar a tu equipo
En Dedika para empresas, el curso incluye ejercicios y ejemplos adaptados a tu propio negocio y a las necesidades de tu empresa.
Contenido del curso
8 Capítulos • 39 LeccionesDuración entre 4 y 360 horas (tú decides)
Capítulo 1OcultarOcultar detallesVer detallesIntroducción a Solr y conceptos de búsqueda
Introducción a Solr y conceptos de búsqueda
Lección 1 • Instalando y ejecutando Solr
Guía a los estudiantes a través de la instalación local, el inicio y la verificación básica. La configuración práctica asegura un entorno de trabajo para todos los ejercicios posteriores.
Lección 2 • Qué es Apache Solr
Cubre el origen, propósito y posición de Solr en el panorama de búsqueda. Establece el contexto para todos los temas técnicos subsiguientes del capítulo.
Lección 3 • Descripción general de la arquitectura de Solr
Explica los componentes principales de Solr: cores, handlers y el pipeline de solicitudes. Los estudiantes adquieren un modelo mental de cómo fluye una consulta a través del sistema.
Lección 4 • Conceptos básicos de búsqueda
Introduce los índices invertidos, la puntuación de relevancia y los fundamentos de la búsqueda de texto completo. Proporciona el vocabulario conceptual necesario a lo largo del curso.
Capítulo 2OcultarOcultar detallesVer detallesDiseño de esquemas y configuración de campos
Diseño de esquemas y configuración de campos
Lección 1 • Entendiendo el esquema de Solr
Explica el esquema administrado vs. el schema.xml clásico y sus ventajas y desventajas. Establece la base para todas las definiciones de campos y tipos en este capítulo.
Lección 2 • Cadenas de análisis y procesamiento de texto
Enseña cómo los tokenizadores, filtros y analizadores transforman el texto en el momento de indexación y consulta. El diseño adecuado de la cadena afecta directamente la calidad de la búsqueda.
Lección 3 • Campos dinámicos y campos de copia
Introduce patrones de campos dinámicos y directivas de campos de copia para un diseño de esquema flexible. Los estudiantes reducen el costo de mantenimiento del esquema mientras soportan diversas necesidades de consulta.
Lección 4 • Tipos de campo y modelado de datos
Cubre tipos de campo primitivos y complejos, incluyendo texto, numérico, fecha y geo. Los estudiantes mapean datos del dominio a tipos de campo de Solr apropiados.
Lección 5 • Validación y evolución del esquema
Aborda cómo agregar, modificar y eliminar campos de forma segura en esquemas de producción. Los estudiantes aplican estrategias que evitan la pérdida de datos y la interrupción por reindexación.
Capítulo 3OcultarOcultar detallesVer detallesIndexando documentos e ingesta de datos
Indexando documentos e ingesta de datos
Lección 1 • Usando SolrJ para clientes Java
Presenta la librería cliente SolrJ para indexación y consultas programáticas desde Java. Los estudiantes construyen una aplicación de indexación simple usando SolrJ.
Lección 2 • Actualizaciones atómicas y concurrencia optimista
Cubre las actualizaciones parciales de documentos y la detección de conflictos basada en versiones. Los estudiantes aplican actualizaciones atómicas para evitar reescrituras completas de documentos en escenarios de alto rendimiento.
Lección 3 • Data Import Handler y conectores
Enseña el Data Import Handler (DIH) para extraer datos de bases de datos y archivos. Los estudiantes configuran un trabajo DIH y programan importaciones incrementales.
Lección 4 • Indexando a través de la Update API
Cubre el envío de documentos en formato JSON, XML y CSV a través del Update Request Handler. Los estudiantes indexan documentos de muestra y verifican los resultados de inmediato.
Lección 5 • Fundamentos de indexación
Explica el modelo de documentos de Solr, las claves únicas y la semántica de commit. Establece modelos mentales correctos antes de que los estudiantes escriban cualquier código de indexación.
Capítulo 4OcultarOcultar detallesVer detallesConsultando Solr: sintaxis y parámetros
Consultando Solr: sintaxis y parámetros
Lección 1 • Faceting y agregaciones
Introduce facetas de campo, de rango, pivot y agregaciones de la JSON Facet API. Los estudiantes construyen características de navegación y analíticas sobre los resultados de búsqueda.
Lección 2 • Filtrado, ordenamiento y paginación
Enseña consultas de filtro (fq), parámetros de ordenamiento y paginación basada en cursor para conjuntos de resultados grandes. Los estudiantes optimizan consultas separando el caché de filtros de la puntuación.
Lección 3 • Query parsers DisMax y eDisMax
Cubre los parsers DisMax y Extended DisMax diseñados para cajas de búsqueda orientadas al usuario. Los estudiantes configuran los parámetros qf, pf, mm y boost para el ajuste de relevancia.
Lección 4 • Highlighting y formateo de resultados
Cubre el resaltado de fragmentos, los response writers y los transformadores de campo para la presentación de resultados. Los estudiantes configuran formatos de salida adecuados para diferentes aplicaciones cliente.
Lección 5 • Conceptos básicos del Standard Query Parser
Introduce la sintaxis del parser de consultas de Lucene para búsquedas por campo, operadores booleanos y comodines. Los estudiantes escriben y prueban consultas contra datos de muestra indexados.
Capítulo 5OcultarOcultar detallesVer detallesAjuste de relevancia y ranking
Ajuste de relevancia y ranking
Lección 1 • Estrategias de boosting
Cubre los boosts en tiempo de indexación, en tiempo de consulta y los boosts de función de consulta para el control de relevancia. Los estudiantes aplican múltiples estrategias de boost y miden su efecto combinado.
Lección 2 • Entendiendo la puntuación de Solr
Explica el modelo de similitud BM25 por defecto y cómo los boosts a nivel de campo afectan las puntuaciones. Los estudiantes usan el parámetro debug=query para inspeccionar las explicaciones de puntuación.
Lección 3 • Consultas de función y fórmulas de ranking
Enseña la sintaxis de consultas de función de Solr para señales de ranking basadas en matemáticas. Los estudiantes construyen fórmulas de ranking personalizadas combinando la puntuación de texto con señales numéricas de negocio.
Lección 4 • Learning to Rank con Solr LTR
Introduce el plugin de Learning to Rank (LTR) para modelos de ranking basados en aprendizaje automático. Los estudiantes cargan almacenes de características, entrenan un modelo y lo despliegan para reranking.
Lección 5 • Pruebas de relevancia e iteración
Cubre la evaluación offline con listas de juicio y enfoques de prueba A/B online. Los estudiantes establecen un flujo de trabajo repetible de mejora de relevancia.
Capítulo 6OcultarOcultar detallesVer detallesSolrCloud: búsqueda distribuida a escala
SolrCloud: búsqueda distribuida a escala
Lección 1 • Indexación y consultas distribuidas
Enseña cómo los documentos se enrutan a los shards y cómo se fusionan las consultas distribuidas. Los estudiantes configuran enrutamiento personalizado y optimizan el rendimiento de consultas entre shards.
Lección 2 • Arquitectura de SolrCloud
Explica el sharding, la replicación y el rol de ZooKeeper en la coordinación del clúster. Los estudiantes mapean los conceptos de SolrCloud a sus propios requisitos de escalado.
Lección 3 • Operaciones de ZooKeeper y gestión de configuración
Cubre la carga de conjuntos de configuración, la gestión de znodes de ZooKeeper y la reconfiguración del clúster. Los estudiantes usan la herramienta zkcli y la Config API para cambios de configuración seguros.
Lección 4 • Tipos de réplica y alta disponibilidad
Introduce los tipos de réplica NRT, TLOG y PULL y sus compensaciones de disponibilidad. Los estudiantes seleccionan estrategias de réplica que equilibran el rendimiento de indexación con la disponibilidad de lectura.
Lección 5 • Creando y gestionando colecciones
Cubre la Collections API para crear, modificar y eliminar colecciones. Los estudiantes realizan operaciones comunes del ciclo de vida de una colección a través de la API y la UI de administración.
Capítulo 7OcultarOcultar detallesVer detallesAjuste de rendimiento y almacenamiento en caché
Ajuste de rendimiento y almacenamiento en caché
Lección 1 • Ajuste de JVM y heap
Cubre el dimensionamiento del heap de JVM, la selección del recolector de basura y la minimización de pausas de GC. Los estudiantes aplican configuraciones que reducen las pausas stop-the-world durante la carga máxima.
Lección 2 • Arquitectura de caché de Solr
Explica el caché de filtros, el caché de resultados de consulta, el caché de documentos y el caché de valores de campo. Los estudiantes configuran tamaños de caché y políticas de desalojo para sus cargas de trabajo.
Lección 3 • Optimización de índices y gestión de segmentos
Enseña la fusión de segmentos de Lucene, operaciones de optimización y estrategias de calentamiento de índices. Los estudiantes equilibran el costo de fusión con el rendimiento de consultas para el tamaño de su índice.
Lección 4 • Perfilado de rendimiento de consultas
Introduce el parámetro debug=timing, el registro de consultas lentas y la API de métricas de Solr. Los estudiantes identifican componentes de consulta costosos y aplican optimizaciones dirigidas.
Lección 5 • Dimensionamiento de hardware y despliegue
Cubre las consideraciones de I/O de disco, CPU, RAM y red para despliegues de Solr. Los estudiantes producen una estimación de dimensionamiento basada en el tamaño del índice, la tasa de consultas y los objetivos de SLA.
Capítulo 8OcultarOcultar detallesVer detallesSeguridad, monitoreo y operaciones de producción
Seguridad, monitoreo y operaciones de producción
Lección 1 • Monitoreo con métricas y registro
Introduce la API de métricas de Solr, la integración con JMX y la configuración de registro estructurado. Los estudiantes construyen dashboards que muestran la latencia de consultas, las tasas de error y las relaciones de aciertos de caché.
Lección 2 • Backup, recuperación y planificación ante desastres
Cubre los backups basados en snapshots, la recuperación basada en replicación y la planificación de RTO/RPO. Los estudiantes diseñan un cronograma de backup y prueban los procedimientos de restauración de punta a punta.
Lección 3 • Actualizaciones y runbooks operativos
Enseña actualizaciones continuas, verificaciones de compatibilidad y pasos de validación post-actualización. Los estudiantes crean runbooks para operaciones de rutina y respuesta a incidentes.
Lección 4 • Autenticación y autorización
Cubre los plugins de autenticación integrados de Solr: Basic Auth, Kerberos y JWT. Los estudiantes configuran control de acceso basado en roles para proteger colecciones y endpoints de administración.
Lección 5 • Encriptación TLS y seguridad de red
Enseña a habilitar TLS para la comunicación cliente-Solr y entre nodos. Los estudiantes generan certificados, configuran keystores y verifican conexiones encriptadas.
Tu certificado válido de finalización
Este curso es para vos:
Desarrolladores backend: que quieren agregar búsqueda potente a sus aplicaciones.
Ingenieros de datos: que construyen pipelines que necesitan recuperación de texto rápida y escalable.
Ingenieros DevOps: encargados de desplegar y mantener infraestructura de búsqueda.
Arquitectos de software: que evalúan Solr para proyectos de búsqueda empresarial a gran escala.
Administradores de bases de datos: que amplían sus habilidades hacia tecnologías de búsqueda.
Product managers técnicos: que necesitan entender los sistemas de búsqueda que supervisan.
Lo que dicen nuestros alumnos
Sus clases son perfectas. Adquirí el paquete de un año y, finalmente, tengo la oportunidad de seguir diversos temas de mi interés sin necesidad de cambiar de plataforma... les agradezco por todo lo que hacen, ya los recomendé a otras personas...

Me gusta cómo las lecciones van directo al grano y cómo puedo cambiar capítulos y saltear contenidos que no necesito.

Me gusta el contenido y la forma de presentación y transcripción de videos, ¡lo que acelera el proceso!

La plataforma es rápida, simple de usar. La diversidad de contenido y los videos complementarios ayudan mucho en el aprendizaje.

Principales capacitaciones
Preguntas frecuentes
¿Quién es Dedika?
¿El certificado es válido en Argentina?
¿Los cursos son gratuitos?
¿Cuál es la carga horaria del curso?
¿Cómo son los cursos?
¿Cómo funcionan los cursos?
¿Cuál es la duración de los cursos?
¿Cuál es el costo o precio de los cursos?
¿Qué es un curso EAD u online y cómo funciona?
Curso en PDF




















