LLM (Large Language Model)
Un LLM (Large Language Model) es un modelo de inteligencia artificial entrenado con volúmenes masivos de texto para aprender las estructuras estadísticas del lenguaje humano. Funciona prediciendo la palabra siguiente más probable dentro de una secuencia. Los principales LLM del mercado son GPT-4o, Claude, Mistral y Llama.
Los Large Language Models (LLM) representan un avance fundamental en inteligencia artificial. Estos modelos se entrenan con miles de millones de documentos de texto (libros, artículos, páginas web) con el fin de adquirir una comprensión estadística profunda del lenguaje natural. A diferencia de una base de datos clásica, un LLM no almacena la información palabra por palabra: aprende patrones lingüísticos que le permiten generar texto coherente y contextualmente pertinente.
En el ámbito jurídico, los LLM ya alimentan numerosas herramientas: búsqueda jurisprudencial, redacción de actos, resumen de resoluciones, análisis de contratos. Los despachos de abogados que los adoptan constatan hasta un 50 % de ahorro de tiempo en las tareas repetitivas. Sin embargo, un LLM no es un jurista: genera texto estadísticamente probable, no necesariamente exacto desde el punto de vista jurídico.
El reto para los profesionales del derecho consiste en comprender las fortalezas y los límites de estos modelos. La combinación de un LLM con técnicas como el RAG (Retrieval Augmented Generation) y un prompt engineering riguroso permite obtener resultados fiables y verificables, anclados en fuentes jurídicas reales.
Términos relacionados
GPT (Generative Pre-trained Transformer) es una familia de modelos de IA desarrollados por OpenAI, basados en la arquitectura Tran…
Claude es un modelo de IA desarrollado por Anthropic, empresa fundada en 2021 por antiguos investigadores de OpenAI. Se distingue …
Un modelo fundacional es un gran modelo de IA entrenado sobre datos masivos sin etiquetar mediante aprendizaje autosupervisado, ad…
El RAG (Retrieval Augmented Generation) es una técnica que combina la búsqueda documental con un LLM. Antes de generar una respues…
La tokenización es el proceso de división de un texto en "tokens", las unidades básicas que procesa una IA. Un token puede ser una…