Ponte en Contacto

Temario del curso

Introducción a Apache Spark

  • El papel de Spark en el procesamiento de datos masivos (big data)
  • Arquitectura de Spark y sus componentes

Configuración inicial de Apache Spark

  • Requisitos de hardware y software
  • Procedimientos de instalación para modos independientes y de clúster
  • Mejores prácticas de configuración para administradores de sistemas

Administración de clústeres de Spark

  • Herramientas y técnicas de gestión de clústeres
  • Monitoreo de aplicaciones de Spark y recursos del clúster
  • Configuraciones de seguridad y gestión de usuarios

Ajuste de rendimiento y optimización

  • Asignación y programación de recursos
  • Ajuste de Spark para un rendimiento óptimo
  • Identificación y resolución de cuellos de botella comunes

Diagnóstico y solución de problemas

  • Desafíos comunes en la administración de Spark
  • Herramientas y técnicas de diagnóstico para la solución de problemas
  • Enfoque paso a paso para resolver problemas comunes
  • Mejores prácticas para mantener un entorno de Spark saludable

Temas avanzados de administración

  • Integración con otras herramientas de datos masivos (big data)
  • Garantía de alta disponibilidad y recuperación ante desastres
  • Actualización y escalado de clústeres de Spark

Requerimientos

  • Conocimientos básicos de configuración y gestión de redes.
  • Familiaridad con el sistema operativo Linux y la interfaz de línea de comandos.
  • Interés en aprender sobre sistemas de computación distribuida y gestión de datos masivos (big data).

Audiencia

  • Administradores de sistemas.
 35 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas