
Topic
framework de computación en clúster para análisis de datos de código abierto
Be the first in the room — members see you arrive.
Join the roomApache Spark es un motor de análisis unificado de código abierto para el procesamiento de datos a gran escala. Spark proporciona una interfaz para programar clústeres con paralelismo de datos implícito y tolerancia a fallos. Originalmente desarrollado en el AMPLab de la Universidad de California, Berkeley a partir de 2009, en 2013, el código base de Spark fue donado a la Apache Software Foundation, que lo ha mantenido desde entonces.