Contacta con nosotros

Temario del curso

Esenciales de la administración de Kafka

  • Dónde se encaja Kafka en una plataforma de datos moderna y las responsabilidades típicas de producción
  • Conceptos fundamentales para operadores: brokers, temas, particiones, desplazamientos (offsets), grupos de consumidores
  • Fundamentos de la replicación: líderes y seguidores, réplicas sincronizadas, compensaciones en la disponibilidad
  • Aspectos destacados operativos de Kafka y terminología común utilizada en los manuales de ejecución (runbooks)

Modo KRaft y diseño del clúster

  • Conceptos básicos de KRaft: controladores, quórum de metadatos, elecciones y por qué es importante operativamente
  • Planificación del despliegue: dimensionamiento para el throughput, particiones, retención y crecimiento
  • Roles y distribución de nodos: controladores combinados frente a dedicados, consideraciones sobre dominios de fallo
  • Taller: inspeccionar metadatos de KRaft, validar la salud del quórum e interpretar los registros del controlador

Instalación, configuración y operaciones diarias

  • Enfoques de instalación (paquetes, tarball, contenedores) y qué estandarizar en entornos empresariales
  • Configuración básica del broker que impacta la fiabilidad: listeners, replicación, directorios de registros, retención
  • Operaciones seguras del servicio: orden de inicio, apagado graceful y comprobaciones de validación
  • Taller: implementar un clúster multi-nodo, verificar el registro del broker y confirmar la producción y consumo iniciales

Gestión de temas, particiones y ubicación de datos

  • Ciclo de vida del tema usando la CLI de Kafka: crear, describir, actualizar configuraciones, eliminar
  • Selección de factores de partición y replicación para cargas de trabajo reales, incluyendo anti-patrones comunes
  • Reasignaciones y equilibrio: cuándo mover particiones y cómo verificar el progreso de forma segura
  • Taller: crear temas, disparar una reasignación de particiones, simular un fallo de broker y confirmar la recuperación

Aseguramiento de Kafka para producción

  • TLS para tráfico de clientes e inter-broker: certificados, cadenas de confianza y pasos de validación
  • Autenticación con SASL: selección de mecanismos comunes y evitar configuraciones erróneas
  • Autorización con ACLs: patrones de privilegio mínimo para administradores, productores y consumidores
  • Taller: habilitar TLS y SASL, validar la conectividad del cliente y aplicar ACLs para roles de aplicación

Observabilidad, fiabilidad y resolución de problemas

  • Aspectos esenciales de la monitorización: salud del controlador, particiones sub-replicadas, latencia de solicitudes, saturación de disco y red
  • Registros y métricas: lectura de registros del broker y exposición de métricas mediante JMX exporter a pilas de observabilidad comunes
  • Manuales operativos: reinicios progresivos, cambios seguros de configuración, manejo de problemas de disco lleno e ISR
  • Taller: construir un conjunto mínimo de alertas, diagnosticar un clúster degradado y restaurar la replicación saludable

Actualizaciones y preparación para recuperación ante desastres

  • Planificación de actualizaciones de Kafka: comprobaciones de compatibilidad, fases progresivas y enfoque de reversión
  • Expectativas de copias de seguridad y recuperación: qué se puede respaldar, qué no, y conceptos básicos de recuperación de configuración
  • Descripción general de la replicación entre clústeres y cuándo utilizar MirrorMaker 2 para DR y migraciones
  • Cierre: lista de verificación operativa, artefactos de traspaso y siguientes pasos para el despliegue en producción

Requerimientos

  • Comprensión básica de la administración de Linux (usuarios, servicios, archivos, permisos)
  • Experiencia con conceptos de red TCP/IP (DNS, puertos, firewalls, balanceadores de carga)
  • Experiencia básica en scripting (Bash, PowerShell o similar) para tareas operativas rutinarias

Público objetivo

  • Administradores de Kafka e ingenieros de plataforma responsables de operar clústeres de Kafka
  • Ingenieros de confiabilidad del sitio (SRE) e ingenieros de DevOps que apoyan plataformas de streaming
  • Equipos de infraestructura y operaciones que implementan nuevos clústeres de Kafka basados en KRaft o migran desde ZooKeeper
 21 Horas

Número de participantes


Precio por participante

Reseñas (5)

Próximos cursos

Categorías Relacionadas