En lugar de mezclar y dividir aleatoriamente los datos entre entrenamiento y prueba, la validación temporal entrena el modelo con datos de un período anterior y lo evalúa exclusivamente con datos de un período posterior, respetando el orden cronológico real en que la información estaría disponible.
Por qué es indispensable en problemas con series de tiempo
Una división aleatoria en un problema temporal podría dejar datos del futuro mezclados en el conjunto de entrenamiento, generando una fuga de datos y una estimación de desempeño completamente irreal, ya que en producción el modelo nunca tendría acceso a información del futuro al momento de predecir.
