ZooKeeper mantiene información de configuración compartida, coordina la elección de un nodo líder entre varios candidatos, y sincroniza el estado entre los distintos nodos de un sistema distribuido complejo, resolviendo un problema de coordinación que sería muy difícil y propenso a errores si cada sistema lo implementara por su cuenta desde cero.
Su rol histórico en el ecosistema Big Data
Fue durante mucho tiempo un componente de infraestructura subyacente prácticamente indispensable en clusters de Hadoop y Kafka, aunque versiones más recientes de algunas de estas herramientas fueron incorporando mecanismos de coordinación propios, reduciendo gradualmente esa dependencia externa.
