Presto (y su bifurcación posterior, Trino) permite ejecutar consultas SQL sobre datos almacenados en fuentes completamente distintas —un data lake, una base de datos relacional, un sistema NoSQL— combinándolos en una sola consulta, sin necesitar mover previamente todos esos datos a un único lugar centralizado.
Su ventaja frente a herramientas más antiguas como Hive
Está optimizado para consultas interactivas que devuelven resultados en segundos, en lugar de minutos u horas, siendo mucho más adecuado para el análisis exploratorio ad hoc que las herramientas de procesamiento por lotes más tradicionales del ecosistema Hadoop.
