Naive Bayes calcula la probabilidad de que una observación pertenezca a cada categoría posible, combinando la probabilidad de cada una de sus características de forma independiente entre sí, aunque en la práctica esas características rara vez sean completamente independientes (de ahí lo de “ingenuo”).
Por qué funciona bien a pesar de esa simplificación
Sorprendentemente, sigue dando muy buenos resultados en muchos problemas reales, especialmente en clasificación de texto (como filtros de spam), donde es rápido de entrenar y de ejecutar, incluso con conjuntos de datos muy grandes y de alta dimensión.
