GPT (Generative Pre-trained Transformer)
GPT (Generative Pre-trained Transformer) est une famille de modèles d'IA développés par OpenAI, basés sur l'architecture Transformer inventée en 2017. Ces modèles génératifs sont pré-entraînés sur de vastes corpus textuels puis affinés pour des tâches spécifiques. La dernière version, GPT-4o, est multimodale et alimente notamment ChatGPT.
La famille GPT d'OpenAI a popularisé l'intelligence artificielle générative auprès du grand public. L'acronyme signifie Generative (génère du texte), Pre-trained (pré-entraîné sur un vaste corpus) et Transformer (architecture neuronale avec mécanismes d'attention). Depuis GPT-1 en 2018 jusqu'à GPT-4o en 2024, chaque génération a apporté des améliorations significatives en termes de cohérence, de raisonnement et de capacités multimodales.
Dans le secteur juridique, GPT alimente des solutions professionnelles comme Harvey AI, utilisé par le cabinet Allen & Overy. Ce type d'outil permet la recherche jurisprudentielle, la rédaction de notes et la synthèse de documents complexes. Cependant, utilisé seul via ChatGPT, GPT n'est pas connecté à des bases de données juridiques vérifiées et présente des risques d'hallucinations.
Pour les avocats et juristes, il est essentiel de distinguer l'usage grand public de ChatGPT et les solutions professionnelles intégrant GPT avec des garde-fous spécifiques au droit : RAG sur des bases certifiées, contrôle de la température, et vérification humaine systématique des productions.
Termes liés
Un LLM (Large Language Model) est un modèle d'intelligence artificielle entraîné sur des volumes massifs de texte pour apprendre l…
Claude est un modèle d'IA développé par Anthropic, entreprise fondée en 2021 par d'anciens chercheurs d'OpenAI. Il se distingue pa…
Un modèle de fondation est un grand modèle d'IA entraîné sur des données massives non étiquetées par apprentissage auto-supervisé,…
Les hallucinations de l'IA désignent la production d'informations fausses, inventées ou incohérentes présentées avec une apparente…
La température est un hyperparamètre qui contrôle le degré d'aléatoire dans les réponses d'un LLM. Une valeur basse (proche de 0) …