Un filtro de contenido analiza tanto las solicitudes que recibe un sistema de IA como las respuestas que genera, buscando identificar contenido que viole políticas de uso: discurso de odio, información peligrosa, contenido sexual inapropiado, entre otras categorías, para bloquearlo o modificarlo antes de que llegue al usuario final.
Su tensión constante
Un filtro demasiado estricto puede bloquear consultas legítimas (como una pregunta médica seria), mientras que uno demasiado permisivo puede dejar pasar contenido genuinamente dañino. Calibrar ese equilibrio de forma consistente en distintos idiomas y contextos culturales sigue siendo un desafío abierto para quienes desarrollan estos sistemas.
