Qué es
Un cluster de cómputo agrupa varios servidores individuales (nodos) que se coordinan entre sí para funcionar como un único sistema más potente, repartiendo el procesamiento y el almacenamiento de datos entre todos ellos.
Cómo se organiza el trabajo
Generalmente, uno o más nodos actúan como coordinadores, repartiendo las tareas entre los demás nodos (trabajadores) y combinando los resultados parciales que estos van generando. Frameworks como Hadoop y Spark se encargan de automatizar buena parte de esa coordinación.
Por qué son la base del Big Data
Ningún servidor individual, sin importar qué tan potente sea, puede procesar en un tiempo razonable los volúmenes de datos que manejan hoy muchas organizaciones. Los clusters permiten repartir esa carga entre decenas, cientos o miles de máquinas trabajando en paralelo.
