Pipeline de datos con Pyspark

No hay miniatura disponible

Fecha

Autores

Heredia-Vizcaino, Diana

Título de la revista

ISSN de la revista

Título del volumen

Editor

Universidad Simón Bolívar
Facultad de Ingenierías

Resumen

Qué estructura tiene un pipeline para procesamiento de datos en Python, usando las funcionalidades de Apache Spark contenidas en la librería Pyspark.

Descripción

Contenido digital-video de 0.02:39

Palabras clave

Apache Spark, Pyspark, Canalización de datos, Data Pipeline

Citación

Enlace DOI