Qu'est-ce qu'un LLM, expliqué simplement (sans les maths)
ChatGPT, Claude, Gemini reposent tous sur un LLM. Ce que ce mot veut dire, comment ça marche vraiment, et pourquoi ça explique leurs forces comme leurs limites.

LLM, pour « Large Language Model », modèle de langage à grande échelle. C’est le moteur derrière ChatGPT, Claude et Gemini. Le sigle revient partout, mais rarement expliqué. Voici l’essentiel, sans une seule équation.
L’idée en une phrase
Un LLM est un système entraîné à prédire le mot suivant dans un texte, avec une telle précision que la suite ressemble à une réponse réfléchie.
Ce n’est pas une base de données qui « cherche » une réponse quelque part. Il n’y a pas de fiche stockée qui dit « voici la capitale de la France ». Le modèle a vu, pendant son entraînement, des milliards de phrases où ce type d’information apparaît, et il a appris des régularités statistiques : après « la capitale de la France est », le mot « Paris » revient presque toujours. Il génère sa réponse mot après mot (plus précisément, « token » après token, un token étant un fragment de mot) en s’appuyant sur ces régularités.
Une analogie simple
Imaginez la fonction de correction automatique de votre téléphone, mais démesurément plus puissante et entraînée sur une fraction significative de tout ce qui a été écrit et numérisé. Votre clavier propose le mot suivant en fonction des trois derniers mots tapés. Un LLM fait la même chose, mais en tenant compte de tout un paragraphe, parfois de tout un document, et avec une compréhension bien plus fine du contexte, du sujet et du style attendu.
D’où viennent ses capacités
Trois ingrédients expliquent pourquoi ces modèles sont devenus si bons :
- La taille des données. Des volumes de texte considérables — livres, sites web, code, conversations — donnent au modèle une exposition à quasiment tous les sujets et tous les styles d’écriture.
- La taille du modèle. Plus un modèle a de paramètres (des réglages internes ajustés pendant l’entraînement), plus il capture de nuances. C’est ce qui distingue, en partie, un modèle « rapide » d’un modèle « avancé » chez un même éditeur.
- L’ajustement après entraînement. Un modèle brut prédit juste la suite d’un texte. Un travail supplémentaire — l’affiner sur des exemples de bonnes réponses, avec des retours humains — le transforme en assistant qui répond réellement à une question plutôt que de simplement continuer un texte au hasard.
Ce que ça explique, très concrètement
Comprendre ce mécanisme éclaire des comportements qui, sinon, semblent étranges.
Pourquoi il « invente » parfois avec assurance. Le modèle ne vérifie pas un fait dans une base : il produit la suite la plus plausible. Sur un sujet pointu ou peu documenté, plausible et vrai peuvent diverger — c’est ce qu’on appelle une hallucination. Nous détaillons ce mécanisme et comment s’en prémunir dans pourquoi l’IA « hallucine ».
Pourquoi le prompt compte autant. Puisque tout se joue sur le texte fourni en entrée, la qualité et la précision de votre consigne changent directement la qualité de ce qui suit. Un prompt vague donne une suite vague.
Pourquoi il « oublie » le début d’une longue conversation. Le modèle ne retient que ce qui tient dans sa fenêtre de contexte, l’espace de texte qu’il peut traiter en une fois. Au-delà, les premiers échanges sortent progressivement de son champ de vision.
Pourquoi ses connaissances ont une date de péremption. Un LLM ne sait, par défaut, que ce qui figurait dans ses données d’entraînement, arrêtées à une date donnée. Pour l’actualité récente, il a besoin d’un accès à une recherche web ou à un document que vous lui fournissez.
Ce qu’un LLM n’est pas
Ce n’est ni une intelligence consciente, ni un moteur de recherche, ni une calculatrice fiable par nature. C’est un système de génération de texte extraordinairement performant, dont la justesse dépend de ce qu’il a appris et de la manière dont on le sollicite. Pour un tour plus complet du vocabulaire associé, notre glossaire en 10 mots complète celui-ci.
À retenir
Un LLM prédit le mot suivant à partir de régularités apprises sur d’immenses volumes de texte — rien de plus mystique, mais rien de moins puissant. Cette mécanique simple explique à la fois ce qui rend ces outils si utiles au quotidien et pourquoi ils restent faillibles sur les faits précis. Savoir cela ne demande aucune compétence technique ; ça suffit pour s’en servir avec discernement.
