GLOSSAIRE IA · TECHNIQUE
GPT
Generative Pre-trained Transformer
GPT signifie Generative Pre-trained Transformer, soit transformeur génératif pré-entraîné. C'est le nom de la famille de modèles de langage développée par OpenAI, ceux qui font tourner ChatGPT. Chacun des trois mots décrit une propriété précise du modèle.
- Sigle
- Generative Pre-trained Transformer
- Traduction
- Transformeur génératif pré-entraîné
- Éditeur
- OpenAI
- Première version
- 2018
- Produit grand public
- ChatGPT
- Catégorie
- Famille de modèles de langage
Trois mots, trois propriétés
Le sigle n'est pas un nom commercial : il décrit exactement ce qu'est le modèle.
Generative, génératif : le modèle produit du contenu nouveau plutôt que de choisir parmi des réponses préexistantes. Il compose sa réponse token après token, chacun choisi en fonction de tout ce qui précède.
Pre-trained, pré-entraîné : l'essentiel de son apprentissage a eu lieu avant que vous ne l'utilisiez, sur un corpus immense de textes. Cette phase, très coûteuse, se fait une fois ; ensuite le modèle est ajusté puis mis à disposition.
Transformer, transformeur : c'est l'architecture technique employée, celle du transformeur avec son mécanisme d'attention. Elle est partagée par tous les grands modèles actuels, y compris ceux des concurrents d'OpenAI.
GPT n'est pas un synonyme d'IA
La confusion la plus répandue, et celle qui fausse le plus les discussions.
GPT désigne une famille de modèles précise, celle d'OpenAI. Claude est développé par Anthropic, Gemini par Google, Mistral par Mistral AI : ce sont des modèles de langage, mais ce ne sont pas des GPT.
La confusion vient du succès de ChatGPT, devenu le nom générique de la catégorie comme d'autres marques avant lui. Dire « je vais demander à GPT » pour parler d'un assistant quelconque est un raccourci d'usage, mais il induit en erreur dès qu'on compare des outils.
Autre distinction utile : GPT désigne le modèle, ChatGPT désigne le produit. Le modèle est le moteur ; le produit est l'interface, avec sa mémoire, ses fonctions, ses quotas et ses réglages. On peut utiliser un modèle GPT sans passer par ChatGPT, via l'interface de programmation.
Ce qui a changé au fil des générations
Une trajectoire en trois temps, du laboratoire au produit de masse.
-
Les premières versions, à partir de 2018
Des modèles de recherche qui démontrent qu'un simple entraînement à prédire le mot suivant, à grande échelle, produit des capacités inattendues.
-
Le changement d'échelle
L'augmentation massive du nombre de paramètres et du volume de données fait apparaître des aptitudes que personne n'avait explicitement programmées : traduire, résumer, coder.
-
L'alignement sur l'humain
Une phase d'ajustement à partir de retours humains transforme un modèle qui complète du texte en assistant qui répond à des consignes. C'est ce qui rend ChatGPT utilisable par le grand public en 2022.
-
La multimodalité et les outils
Les générations récentes traitent l'image et le son, appellent des outils externes, cherchent sur le web et exécutent du code. Le modèle cesse d'être un pur générateur de texte.
Ce qu'un modèle GPT ne fait pas
Les limites tiennent au principe même, pas à la version employée.
-
Il ne vérifie rien
Le modèle produit la suite la plus vraisemblable, pas la plus vraie. C'est l'origine des hallucinations, qui persistent quelle que soit la génération.
-
Sa connaissance a une date
Le pré-entraînement s'arrête à un moment donné. Sans recherche web, le modèle ignore tout ce qui s'est passé depuis, et l'ignore parfois sans le savoir.
-
Il n'apprend pas de vous
Vos conversations ne modifient pas le modèle. Les fonctions de mémoire des produits stockent des informations à côté et les réinjectent, ce qui n'est pas la même chose qu'un apprentissage.
-
Il ne raisonne pas comme un humain
Les modèles récents décomposent visiblement les problèmes, ce qui améliore beaucoup les résultats. Cela reste une production de texte guidée par des régularités, pas une déduction logique garantie.
EN CLAIR
Pour le dire simplement
GPT est à l'IA ce que Frigidaire est au réfrigérateur : une marque devenue nom commun. Employer le mot pour désigner n'importe quel assistant est courant et compréhensible, mais dès qu'on compare deux outils, il faut redonner à chacun son nom, parce que les différences entre familles de modèles sont réelles.
Ce qu'il faut arrêter de croire.
-
IDÉE REÇUE
GPT et intelligence artificielle, c'est pareil.
EN RÉALITÉ
GPT est une famille de modèles éditée par OpenAI. Claude, Gemini et Mistral sont des modèles de langage concurrents, qui ne sont pas des GPT. L'IA est le domaine, GPT en est un produit parmi d'autres.
-
IDÉE REÇUE
GPT et ChatGPT désignent la même chose.
EN RÉALITÉ
GPT est le modèle, ChatGPT est le produit construit autour. On peut utiliser un modèle GPT sans ChatGPT, par programmation, et ChatGPT ajoute au modèle une interface, une mémoire et des fonctions qui n'appartiennent pas au modèle lui-même.
-
IDÉE REÇUE
GPT apprend de mes conversations.
EN RÉALITÉ
Le modèle ne se modifie pas quand vous discutez avec lui. Certaines conversations peuvent servir à entraîner de futures versions si vous ne l'avez pas désactivé, mais cela n'a aucun effet immédiat sur vos réponses.
-
IDÉE REÇUE
Une nouvelle version corrige les erreurs de la précédente.
EN RÉALITÉ
Chaque génération réduit les erreurs sans les supprimer, parce que le mécanisme qui les produit est le même que celui qui produit les bonnes réponses. La vérification humaine reste nécessaire quelle que soit la version.
Questions fréquentes.
Que veut dire GPT ?
GPT signifie Generative Pre-trained Transformer, soit transformeur génératif pré-entraîné. Chaque terme décrit une propriété : le modèle produit du contenu nouveau, son apprentissage principal est antérieur à son usage, et il repose sur l'architecture transformeur.
Quelle différence entre GPT et ChatGPT ?
GPT est le modèle de langage, ChatGPT est le produit grand public construit autour : interface de conversation, mémoire, génération d'images, recherche web, quotas. Le modèle est le moteur, le produit est la voiture.
Claude est-il un GPT ?
Non. Claude est développé par Anthropic et repose sur ses propres modèles. Gemini est développé par Google, Mistral par Mistral AI. Tous sont des grands modèles de langage bâtis sur une architecture transformeur, mais GPT désigne spécifiquement la famille d'OpenAI.
Qui a créé GPT ?
OpenAI, entreprise américaine fondée en 2015. La première version date de 2018, et le passage au grand public s'est fait fin 2022 avec le lancement de ChatGPT, qui a rendu ces modèles accessibles sans compétence technique.
Les modèles GPT sont-ils gratuits ?
ChatGPT propose un accès gratuit avec des quotas et un accès restreint au modèle le plus performant. L'usage par programmation est facturé à la consommation, selon le volume de texte traité. Les modèles eux-mêmes ne sont pas ouverts, contrairement à certains concurrents.
Faut-il dire GPT pour parler de n'importe quelle IA ?
C'est un raccourci fréquent, comme dire Frigidaire pour un réfrigérateur. Il passe dans une conversation courante, mais devient gênant dès qu'on compare des outils, parce que les écarts entre familles de modèles sont réels, notamment sur la qualité rédactionnelle et la confidentialité.
Termes liés.
Révisé le 27 juillet 2026