LLM (Large Language Model)
Un LLM (Large Language Model) est un modèle d'intelligence artificielle entraîné sur des volumes massifs de texte pour apprendre les structures statistiques du langage humain. Il fonctionne en prédisant le mot suivant le plus probable dans une séquence. Les principaux LLM du marché sont GPT-4o, Claude, Mistral et Llama.
Les Large Language Models (LLM) représentent une avancée majeure en intelligence artificielle. Ces modèles sont entraînés sur des milliards de documents textuels — livres, articles, pages web — afin d'acquérir une compréhension statistique profonde du langage naturel. Contrairement à une base de données classique, un LLM ne stocke pas l'information mot à mot : il apprend des patterns linguistiques qui lui permettent de générer du texte cohérent et contextuellement pertinent.
Dans le domaine juridique, les LLM alimentent déjà de nombreux outils : recherche jurisprudentielle, rédaction d'actes, synthèse de décisions, analyse de contrats. Les cabinets d'avocats qui les adoptent constatent jusqu'à 50 % de gain de temps sur les tâches répétitives. Cependant, un LLM n'est pas un juriste : il génère du texte statistiquement probable, pas nécessairement juridiquement exact.
L'enjeu pour les professionnels du droit est de comprendre les forces et limites de ces modèles. La combinaison d'un LLM avec des techniques comme le RAG (Retrieval Augmented Generation) et un prompt engineering rigoureux permet d'obtenir des résultats fiables et vérifiables, ancrés dans des sources juridiques réelles.
Termes liés
GPT (Generative Pre-trained Transformer) est une famille de modèles d'IA développés par OpenAI, basés sur l'architecture Transform…
Claude est un modèle d'IA développé par Anthropic, entreprise fondée en 2021 par d'anciens chercheurs d'OpenAI. Il se distingue pa…
Un modèle de fondation est un grand modèle d'IA entraîné sur des données massives non étiquetées par apprentissage auto-supervisé,…
Le RAG (Retrieval Augmented Generation) est une technique combinant la recherche documentaire avec un LLM. Avant de générer une ré…
La tokenisation est le processus de découpage d'un texte en "tokens", les unités de base traitées par une IA. Un token peut être u…