Datapedia
Inteligencia Artificial

Modelo de lenguaje (LLM)

Sistema de IA entrenado con grandes volúmenes de texto para predecir y generar lenguaje de forma coherente.

LLMNLPTransformer

Qué es

Un modelo de lenguaje grande (LLM, por sus siglas en inglés) es un sistema entrenado sobre enormes cantidades de texto para predecir la palabra o el fragmento más probable que sigue a una secuencia dada. A partir de esa capacidad de predicción, aprende gramática, hechos, estilos de escritura y relaciones entre conceptos.

Cómo se entrena

El entrenamiento suele darse en dos grandes etapas: un preentrenamiento masivo sobre texto general de internet y otras fuentes, seguido de un ajuste fino (fine-tuning) para orientar el modelo hacia tareas específicas o hacerlo más útil y seguro en una conversación.

Limitaciones a tener en cuenta

Un LLM no “sabe” hechos como una base de datos: genera texto estadísticamente probable, lo que puede llevar a alucinaciones (afirmaciones incorrectas dichas con total confianza). Por eso, para tareas que requieren precisión factual, suele combinarse con técnicas como RAG que le dan acceso a fuentes externas verificables.