Una TPU (Tensor Processing Unit) es un tipo de chip diseñado desde cero específicamente para las operaciones matemáticas que predominan en el entrenamiento e inferencia de redes neuronales, en lugar de ser un procesador de propósito general adaptado a esa tarea, como ocurre con las GPU.
Su ventaja frente a las GPU
Al estar diseñadas exclusivamente para cargas de trabajo de machine learning, las TPU pueden ofrecer una eficiencia energética y de rendimiento superior para ese uso específico, aunque son menos flexibles que las GPU para otro tipo de tareas de cómputo general.
