Qué es
Un modelo de lenguaje grande (LLM, por sus siglas en inglés) es un sistema entrenado sobre enormes cantidades de texto para predecir la palabra o el fragmento más probable que sigue a una secuencia dada. A partir de esa capacidad de predicción, aprende gramática, hechos, estilos de escritura y relaciones entre conceptos.
Cómo se entrena
El entrenamiento suele darse en dos grandes etapas: un preentrenamiento masivo sobre texto general de internet y otras fuentes, seguido de un ajuste fino (fine-tuning) para orientar el modelo hacia tareas específicas o hacerlo más útil y seguro en una conversación.
Limitaciones a tener en cuenta
Un LLM no “sabe” hechos como una base de datos: genera texto estadísticamente probable, lo que puede llevar a alucinaciones (afirmaciones incorrectas dichas con total confianza). Por eso, para tareas que requieren precisión factual, suele combinarse con técnicas como RAG que le dan acceso a fuentes externas verificables.
