LLM (modelo de lenguaje grande)

Tambien: Large Language Model, Modelo de lenguaje, LLM

En una frase

Un LLM (modelo de lenguaje grande) es un modelo de IA entrenado con enormes cantidades de texto para predecir y generar lenguaje. Es la tecnologia que hay detras de ChatGPT, Claude y Gemini.

Un LLM (large language model, o modelo de lenguaje grande) es un modelo entrenado con cantidades masivas de texto para aprender los patrones del lenguaje y, a partir de ellos, generar respuestas, resumir, traducir o clasificar. No consulta una base de datos ni razona como una persona: predice, palabra a palabra, la continuacion mas probable segun lo que aprendio. Entender esto explica tanto su potencia como sus limites (puede sonar seguro y equivocarse).

¿Como funciona un LLM por dentro?

Se basa en una arquitectura llamada transformer, que aprende que partes del texto son relevantes entre si. Durante el entrenamiento ajusta miles de millones de parametros para predecir texto; una vez entrenado, genera respuestas prediciendo el siguiente fragmento una y otra vez. Por eso responde con fluidez, pero tambien por eso puede inventar: optimiza por plausibilidad, no por verdad.

¿Que puede y que no puede hacer por si solo?

Puede redactar, resumir, clasificar, extraer datos de texto, responder en lenguaje natural y conversar. Lo que no puede en solitario: conocer datos privados o actuales de tu negocio (eso lo aporta el RAG) ni ejecutar acciones en tus sistemas (eso lo hace un agente). Un LLM suelto es solo la mitad de la solucion; el valor aparece al conectarlo a tus datos y a tus herramientas.

Datos