Ponte en Contacto
 Duración 35 horas

Temario del curso

Introducción a Apache Spark

  • El papel de Spark en el procesamiento de big data
  • Arquitectura de Spark y sus componentes

Configuración de Apache Spark

  • Requisitos de hardware y software
  • Procedimientos de instalación para modos standalone y de clúster
  • Buenas prácticas de configuración para administradores de sistemas

Administración de clústeres de Spark

  • Herramientas y técnicas de gestión de clústeres
  • Monitoreo de aplicaciones de Spark y recursos del clúster
  • Configuraciones de seguridad y gestión de usuarios

Ajuste de rendimiento y optimización

  • Asignación de recursos y programación
  • Ajuste de Spark para un rendimiento óptimo
  • Identificación y resolución de cuellos de botella comunes

Resolución de problemas y diagnóstico

  • Desafíos comunes en la administración de Spark
  • Herramientas y técnicas de diagnóstico para la resolución de problemas
  • Enfoque paso a paso para resolver problemas comunes
  • Buenas prácticas para mantener un entorno de Spark saludable

Temas avanzados de administración

  • Integración con otras herramientas de big data
  • Garantía de alta disponibilidad y recuperación ante desastres
  • Actualización y escalado de clústeres de Spark

Requerimientos

  • Conocimiento básico de la configuración y gestión de redes
  • Conocimiento del sistema operativo Linux y la interfaz de línea de comandos
  • Interés en aprender sobre sistemas de computación distribuida y gestión de big data

Audiencia

  • Administradores de sistemas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas