Elige tu idioma
Curso de Apache Solr
Más de 2 millones de estudiantes en todo el mundo

Curso de Apache Solr

Domina Apache Solr desde la instalación hasta la búsqueda distribuida de grado producción. Esta capacitación cubre diseño de esquemas, ajuste de relevancia, arquitectura SolrCloud, seguridad y optimización de rendimiento — todo lo que necesitas para construir y operar sistemas de búsqueda empresarial con confianza.

Dedika para empresas

Lo que vas a aprender:

Obtendrás experiencia práctica en todo el stack de Solr, comenzando con conceptos centrales de búsqueda y avanzando por la configuración del esquema, la indexación de documentos y el análisis avanzado de consultas. Aprenderás a ajustar la relevancia usando BM25, consultas de función y modelos de aprendizaje automático para ranking. El curso cubre el despliegue de SolrCloud con ZooKeeper, colecciones con múltiples fragmentos y estrategias de réplica de alta disponibilidad. También implementarás autenticación, cifrado TLS, paneles de monitoreo y procedimientos de respaldo para entornos de producción. Módulos adicionales abordan la integración con Kafka, búsqueda vectorial, despliegue en Kubernetes y la resolución sistemática de incidentes del mundo real.

Cómo estudias de forma práctica Curso de Apache Solr

Cómo practicas Curso de Apache Solr

Para ti que tienes una empresa y quieres capacitar a tu equipo

En Dedika para empresas, el curso incluye ejercicios y ejemplos adaptados a tu propio negocio y a las necesidades de tu empresa.

Haz clic aquí

Contenido del curso

8 Capítulos • 39 LeccionesDuración entre 4 y 360 horas (tú decides)

Capítulo 1Ver detalles

Introducción a Solr y conceptos de búsqueda

  • Lección 1 • Instalando y ejecutando Solr

    Guía a los estudiantes a través de la instalación local, inicio y verificación básica. La configuración práctica asegura un entorno funcional para todos los ejercicios posteriores.

  • Lección 2 • Qué es Apache Solr

    Cubre el origen, propósito y posición de Solr en el panorama de búsqueda. Establece el contexto para todos los temas técnicos posteriores en el capítulo.

  • Lección 3 • Descripción general de la arquitectura de Solr

    Explica los componentes principales de Solr: núcleos, manejadores y el pipeline de solicitudes. Los estudiantes obtienen un modelo mental de cómo fluye una consulta a través del sistema.

  • Lección 4 • Conceptos básicos de búsqueda

    Introduce índices invertidos, puntuación de relevancia y fundamentos de búsqueda de texto completo. Proporciona el vocabulario conceptual necesario a lo largo del curso.

Capítulo 2Ver detalles

Diseño de esquema y configuración de campos

  • Lección 1 • Entendiendo el esquema de Solr

    Explica el esquema administrado vs. el schema.xml clásico y sus compensaciones. Sienta las bases para todas las definiciones de campos y tipos en este capítulo.

  • Lección 2 • Cadenas de análisis y procesamiento de texto

    Enseña cómo los tokenizadores, filtros y analizadores transforman el texto en el momento de indexación y consulta. El diseño adecuado de la cadena afecta directamente la calidad de la búsqueda.

  • Lección 3 • Campos dinámicos y campos de copia

    Introduce patrones de campos dinámicos y directivas de campos de copia para un diseño de esquema flexible. Los estudiantes reducen la sobrecarga de mantenimiento del esquema mientras soportan diversas necesidades de consulta.

  • Lección 4 • Tipos de campo y modelado de datos

    Cubre tipos de campo primitivos y complejos, incluyendo texto, numérico, fecha y geo. Los estudiantes mapean datos del dominio a tipos de campo de Solr apropiados.

  • Lección 5 • Validación y evolución del esquema

    Aborda agregar, modificar y eliminar campos de forma segura en esquemas de producción. Los estudiantes aplican estrategias que evitan la pérdida de datos y la interrupción de la reindexación.

Capítulo 3Ver detalles

Indexando documentos e ingesta de datos

  • Lección 1 • Usando SolrJ para clientes Java

    Introduce la librería cliente SolrJ para indexación y consultas programáticas desde Java. Los estudiantes construyen una aplicación de indexación simple usando SolrJ.

  • Lección 2 • Actualizaciones atómicas y concurrencia optimista

    Cubre actualizaciones parciales de documentos y detección de conflictos basada en versión. Los estudiantes aplican actualizaciones atómicas para evitar reescrituras completas de documentos en escenarios de alto rendimiento.

  • Lección 3 • Manejador de importación de datos y conectores

    Enseña el Data Import Handler (DIH) para extraer datos de bases de datos y archivos. Los estudiantes configuran un trabajo DIH y programan importaciones incrementales.

  • Lección 4 • Indexación mediante la API de actualización

    Cubre el envío de documentos JSON, XML y CSV a través del Update Request Handler. Los estudiantes indexan documentos de muestra y verifican los resultados inmediatamente.

  • Lección 5 • Fundamentos de indexación

    Explica el modelo de documento de Solr, claves únicas y semántica de commits. Establece modelos mentales correctos antes de que los estudiantes escriban cualquier código de indexación.

Capítulo 4Ver detalles

Consultando Solr: Sintaxis y parámetros

  • Lección 1 • Faceteado y agregaciones

    Introduce facetas de campo, facetas de rango, facetas pivote y agregaciones de la API de facetas JSON. Los estudiantes construyen funciones de navegación y analíticas sobre los resultados de búsqueda.

  • Lección 2 • Filtrado, ordenamiento y paginación

    Enseña consultas de filtro (fq), parámetros de ordenamiento y paginación basada en cursor para grandes conjuntos de resultados. Los estudiantes optimizan consultas separando el caché de filtros de la puntuación.

  • Lección 3 • Analizadores de consultas DisMax y eDisMax

    Cubre los analizadores DisMax y Extended DisMax diseñados para cuadros de búsqueda orientados al usuario. Los estudiantes configuran los parámetros qf, pf, mm y boost para el ajuste de relevancia.

  • Lección 4 • Resaltado y formato de resultados

    Cubre resaltado de fragmentos, escritores de respuesta y transformadores de campo para la presentación de resultados. Los estudiantes configuran formatos de salida adecuados para diferentes aplicaciones cliente.

  • Lección 5 • Conceptos básicos del analizador de consultas estándar

    Introduce la sintaxis del analizador de consultas de Lucene para búsquedas por campo, operadores booleanos y comodines. Los estudiantes escriben y prueban consultas contra datos de muestra indexados.

Capítulo 5Ver detalles

Ajuste de relevancia y ranking

  • Lección 1 • Estrategias de impulso

    Cubre impulsos en tiempo de indexación, impulsos en tiempo de consulta e impulsos de consulta de función para el control de relevancia. Los estudiantes aplican múltiples estrategias de impulso y miden su efecto combinado.

  • Lección 2 • Entendiendo la puntuación de Solr

    Explica el modelo de similitud BM25 predeterminado y cómo los impulsos a nivel de campo afectan las puntuaciones. Los estudiantes usan el parámetro debug=query para inspeccionar las explicaciones de puntuación.

  • Lección 3 • Consultas de función y fórmulas de ranking

    Enseña la sintaxis de consultas de función de Solr para señales de ranking basadas en matemáticas. Los estudiantes construyen fórmulas de ranking personalizadas que combinan la puntuación de texto con señales numéricas de negocio.

  • Lección 4 • Learning to Rank con Solr LTR

    Introduce el plugin Learning to Rank (LTR) para modelos de ranking de aprendizaje automático. Los estudiantes cargan almacenes de características, entrenan un modelo y lo despliegan para reordenar.

  • Lección 5 • Pruebas de relevancia e iteración

    Cubre evaluación offline con listas de juicio y enfoques de pruebas A/B en línea. Los estudiantes establecen un flujo de trabajo repetible de mejora de relevancia.

Capítulo 6Ver detalles

SolrCloud: Búsqueda distribuida a escala

  • Lección 1 • Indexación y consultas distribuidas

    Enseña cómo los documentos se enrutan a los shards y cómo se fusionan las consultas distribuidas. Los estudiantes configuran enrutamiento personalizado y optimizan el rendimiento de consultas entre shards.

  • Lección 2 • Arquitectura de SolrCloud

    Explica el sharding, la replicación y el rol de ZooKeeper en la coordinación del clúster. Los estudiantes mapean conceptos de SolrCloud a sus propios requisitos de escalamiento.

  • Lección 3 • Operaciones de ZooKeeper y gestión de configuración

    Cubre la carga de conjuntos de configuración, la gestión de znodes de ZooKeeper y la reconfiguración del clúster. Los estudiantes usan la herramienta zkcli y la API de configuración para cambios de configuración seguros.

  • Lección 4 • Tipos de réplica y alta disponibilidad

    Introduce los tipos de réplica NRT, TLOG y PULL y sus compensaciones de disponibilidad. Los estudiantes seleccionan estrategias de réplica que equilibran el rendimiento de indexación con la disponibilidad de lectura.

  • Lección 5 • Creando y administrando colecciones

    Cubre la API de colecciones para crear, modificar y eliminar colecciones. Los estudiantes realizan operaciones comunes del ciclo de vida de la colección mediante la API y la UI de administración.

Capítulo 7Ver detalles

Ajuste de rendimiento y almacenamiento en caché

  • Lección 1 • Ajuste de JVM y heap

    Cubre el dimensionamiento del heap de JVM, la selección del recolector de basura y la minimización de pausas de GC. Los estudiantes aplican configuraciones que reducen las pausas stop-the-world durante la carga máxima.

  • Lección 2 • Arquitectura de almacenamiento en caché de Solr

    Explica la caché de filtros, caché de resultados de consulta, caché de documentos y caché de valores de campo. Los estudiantes configuran tamaños de caché y políticas de desalojo para sus cargas de trabajo.

  • Lección 3 • Optimización de índice y gestión de segmentos

    Enseña la fusión de segmentos de Lucene, operaciones de optimización y estrategias de calentamiento de índice. Los estudiantes equilibran la sobrecarga de fusión con el rendimiento de consultas para el tamaño de su índice.

  • Lección 4 • Perfilado de rendimiento de consultas

    Introduce el parámetro debug=timing, el registro de consultas lentas y la API de métricas de Solr. Los estudiantes identifican componentes de consulta costosos y aplican optimizaciones específicas.

  • Lección 5 • Dimensionamiento de hardware y despliegue

    Cubre consideraciones de I/O de disco, CPU, RAM y red para despliegues de Solr. Los estudiantes producen una estimación de dimensionamiento basada en el tamaño del índice, la tasa de consultas y los objetivos de SLA.

Capítulo 8Ver detalles

Seguridad, monitoreo y operaciones de producción

  • Lección 1 • Monitoreo con métricas y registros

    Introduce la API de métricas de Solr, la integración JMX y la configuración de registro estructurado. Los estudiantes construyen dashboards que muestran la latencia de consultas, tasas de error y tasas de aciertos de caché.

  • Lección 2 • Respaldo, recuperación y planificación de desastres

    Cubre respaldos basados en instantáneas, recuperación basada en replicación y planificación de RTO/RPO. Los estudiantes diseñan un programa de respaldo y prueban los procedimientos de restauración de principio a fin.

  • Lección 3 • Actualizaciones y runbooks operativos

    Enseña actualizaciones continuas, verificaciones de compatibilidad y pasos de validación posteriores a la actualización. Los estudiantes crean runbooks para operaciones rutinarias y respuesta a incidentes.

  • Lección 4 • Autenticación y autorización

    Cubre los plugins de autenticación integrados de Solr: Basic Auth, Kerberos y JWT. Los estudiantes configuran control de acceso basado en roles para proteger colecciones y endpoints de administración.

  • Lección 5 • Encriptación TLS y seguridad de red

    Enseña a habilitar TLS para la comunicación cliente-Solr y entre nodos. Los estudiantes generan certificados, configuran almacenes de claves y verifican conexiones encriptadas.

Certificación

Tu certificado válido de finalización

Este curso es para ti:

  • Desarrolladores backend: que desean agregar búsqueda potente a sus aplicaciones.

  • Ingenieros de datos: que construyen pipelines que necesitan recuperación de texto rápida y escalable.

  • Ingenieros DevOps: encargados de desplegar y mantener infraestructura de búsqueda.

  • Arquitectos de software: evaluando Solr para proyectos de búsqueda empresarial de gran escala.

  • Administradores de base de datos: expandiendo su conjunto de habilidades hacia tecnologías de búsqueda.

  • Gerentes técnicos de producto: que necesitan entender los sistemas de búsqueda que supervisan.

Lo que dicen nuestros alumnos

Sus clases son perfectas. Adquirí el paquete de un año y, finalmente, tengo la oportunidad de seguir diversos temas de mi interés sin necesidad de cambiar de plataforma... les agradezco por todo lo que hacen, ya los he recomendado a otras personas...
Giulio Carlo
Giulio CarloEstudiante de Marketing Digital
Me gusta cómo las lecciones van directo al grano y cómo puedo cambiar capítulos y saltar contenidos que no necesito.
Mariana Ferres
Mariana FerresEstudiante de Fotografía
Me gusta el contenido y la forma de presentación y transcripción de videos, ¡lo que acelera el proceso!
Luciana Alvarenga
Luciana AlvarengaEstudiante de Diseño de Uñas
La plataforma es rápida, fácil de usar. La diversidad de contenido y los videos complementarios ayudan mucho en el aprendizaje.
André Felipe
André FelipeEstudiante de Ingeniería de Prompt

Principales capacitaciones

Preguntas frecuentes

¿Quién es Dedika?

¿El certificado es válido en México?

¿Los cursos son gratuitos?

¿Cuál es la carga horaria del curso?

¿Cómo son los cursos?

¿Cómo funcionan los cursos?

¿Cuál es la duración de los cursos?

¿Cuál es el costo o precio de los cursos?

¿Qué es un curso EAD u online y cómo funciona?

Curso en PDF