Aller au contenu
Fondamentaux

LLM (grand modèle de langage)

Un modèle d'IA entraîné sur d'immenses quantités de texte, capable de comprendre et de générer du langage.

6 min de lecture
  • #génération
  • #entraînement
  • #transformer

Un LLM (Large Language Model, « grand modèle de langage » en français) est un modèle d’intelligence artificielle entraîné sur d’immenses quantités de texte pour prédire la suite d’une phrase. C’est de cette prédiction, répétée des milliards de fois, que naissent toutes ses capacités.

Sur ton téléphone, l’autocomplétion te propose le mot suivant quand tu écris un message. Un LLM, c’est cette même idée, mais entraînée sur une bibliothèque de taille gigantesque : une bonne partie du web, des livres, du code… À force de deviner des milliards de fois « quel mot vient ensuite ? », il a capté la grammaire, des faits, des styles d’écriture, et même une forme de raisonnement.

Tout LLM repose sur une tâche d’entraînement très simple : on masque la suite d’un texte et le modèle doit la deviner. Quand il se trompe, ses réglages internes — ses poids, des milliards de nombres — sont légèrement ajustés pour faire mieux la prochaine fois. Répète cette opération sur des milliers de milliards de mots, et le modèle devient très fort pour produire du texte cohérent.

Une prédiction, c’est une liste de probabilités

Section intitulée « Une prédiction, c’est une liste de probabilités »

Le modèle ne sort jamais un mot unique. À chaque étape, il attribue une probabilité à toutes les suites possibles : après « le ciel est », il peut donner beaucoup de poids à « bleu », un peu moins à « couvert », presque rien à « tombé ». Un tirage pioche ensuite dans cette liste, le mot retenu est ajouté à la phrase, et on recommence.

Ce tirage explique deux choses que tu as sûrement remarquées. D’abord, poser deux fois la même question ne donne pas deux fois la même réponse mot pour mot. Ensuite, il existe un réglage, la température, qui décide à quel point on s’autorise à s’écarter du mot le plus probable : basse, les réponses sont prévisibles et un peu plates ; haute, elles sont plus variées et plus hasardeuses. Ce qu’on appelle la créativité d’un LLM n’est donc pas une intention, c’est un paramètre de tirage.

Trois choses sont grandes, et elles ne se confondent pas (chiffres constatés en 2026, ils vieillissent vite) :

  • Le nombre de paramètres, c’est-à-dire les poids. L’éventail est immense : Gemma 3 270M, publié par Google en août 2025, en compte 270 millions et tient sur un téléphone ; Kimi K2, publié un mois plus tôt par Moonshot AI, en annonce mille milliards. La plupart des modèles que tu croises se situent entre les deux, autour de quelques dizaines de milliards.
  • Le corpus d’entraînement. Meta indique avoir entraîné Llama 3 sur plus de 15 000 milliards de tokens — les fragments de texte que le modèle manipule, la fiche suivante y revient. Cela fait de l’ordre de dix mille milliards de mots, soit, à 80 000 mots par roman, l’équivalent de plus de cent millions de livres.
  • La facture. Epoch AI, qui suit ces dépenses, estime le calcul du seul entraînement final de GPT-4 à environ 40 millions de dollars, celui de Llama 3.1 405B à 50 millions et celui de Grok 4 à 500 millions. Selon la même source, ce montant double environ tous les huit mois pour les plus gros modèles.
  1. Le pré-entraînement : la phase géante où le modèle apprend la langue et le monde en prédisant la suite des textes. Le résultat est un « modèle de base », doué pour compléter mais pas très agréable en conversation.
  2. L’alignement : on le transforme en assistant, avec du fine-tuning sur des exemples de conversations, puis un ajustement selon les préférences humaines (le RLHF, apprentissage par renforcement à partir de retours humains). C’est ce qui fait passer d’un modèle qui « continue le texte » à un modèle qui « répond à tes questions ».

Un LLM ne stocke pas une base de données de faits : il encode des régularités statistiques dans ses poids. Deux conséquences directes. Sa connaissance s’arrête à la date de fin de son entraînement, et il peut formuler une réponse fausse avec un style parfaitement convaincant — c’est le phénomène d’hallucination. Il ne « sait » rien au sens humain, mais il est très bon pour manipuler le langage et les connaissances qu’il a absorbées.

GPT (OpenAI), Gemini (Google), Claude (Anthropic), Llama (Meta), Mistral (Mistral AI, français), Qwen (Alibaba)… La vraie ligne de partage n’est pas le pays, c’est l’accès aux poids. Les modèles de pointe d’OpenAI, de Google et d’Anthropic sont fermés : tu les utilises par une interface ou une API, jamais chez toi. D’autres sont à poids ouverts, le fichier se télécharge et tourne sur ta machine. Attention au vocabulaire : « poids ouverts » n’est pas « open source ». Mistral publie une partie de ses modèles sous licence Apache 2.0, une licence libre au sens strict, tandis que Llama est distribué sous une licence maison qui pose ses propres conditions d’usage.

  • Les assistants conversationnels grand public : ChatGPT, Claude, Gemini, ou Vibe chez Mistral — qui s’appelait Le Chat jusqu’à son changement de nom en 2026.
  • La rédaction, la traduction et la synthèse de documents longs.
  • La programmation : complétion et explication de code, avec GitHub Copilot ou Cursor.
  • L’éducation : Khan Academy a lancé en mars 2023 Khanmigo, un tuteur bâti sur GPT-4 et volontairement bridé pour ne pas donner la réponse, mais guider l’élève par questions. Bonne démonstration qu’un LLM se pilote autant par les consignes qu’on lui pose que par sa taille.
  • Partout où du texte entre ou sort d’une application : support client, recherche interne, modération.
  • « ChatGPT et LLM, c’est pareil. » Non : ChatGPT est un produit — une interface, une mémoire, des outils, des garde-fous — et le LLM est le modèle qui tourne dessous. L’éditeur peut changer le modèle sans changer le produit, et le même modèle peut servir dans dix applications différentes.
  • « Un LLM comprend comme un humain. » Il manipule le langage avec brio, mais sans expérience du monde ni conscience : le débat philosophique reste ouvert, mais ce n’est pas un humain dans une boîte.
  • « Plus c’est gros, mieux c’est. » Les petits modèles récents rivalisent avec les géants d’hier sur de nombreuses tâches, et coûtent bien moins cher à faire tourner.

Voir aussi