Temario del curso
Introducción
- Apache Spark vs. Hadoop MapReduce
Visión general de las características y arquitectura de Apache Spark
Elegir un lenguaje de programación
Configuración de Apache Spark
Creación de una aplicación de muestra
Selección del conjunto de datos
Realización de análisis de datos sobre el conjunto seleccionado
Procesamiento de datos estructurados con Spark SQL
Procesamiento de datos en streaming con Spark Streaming
Integración de Apache Spark con herramientas de aprendizaje automático de terceros
Uso de Apache Spark para procesamiento de grafos
Optimización de Apache Spark
Solución de problemas
Resumen y conclusión
Requerimientos
- Experiencia con la línea de comandos de Linux
- Conocimiento general sobre procesamiento de datos
- Experiencia en programación con Java, Scala, Python o R
Público objetivo
- Desarrolladores
Reseñas (1)
Un viaje por el mundo de Spark: un curso muy intenso. DSL, Spark SQL, particionamiento versus agrupación para mí.
Georgiana Elisabeta
Curso - Apache Spark Fundamentals
Traducción Automática