Comment GPT, Claude, Gemini fonctionnent
Un LLM (Large Language Model) est un modèle d'IA générative spécialisé dans le texte. Ex : GPT-4, Claude, Gemini, Llama.
Un LLM prédit le mot (token) suivant d'une phrase, à partir de tout ce qui précède.
Ex : entrée « Le chat dort sur le » → le modèle prédit « tapis », « canapé », « lit »… avec des probabilités.
En enchaînant ces prédictions, le modèle génère un texte cohérent.
Le texte est découpé en tokens : pas exactement des mots, plutôt des sous-mots. Ex : « Bonjour tout le monde » ≈ 5-6 tokens (selon le modèle).
1000 tokens ≈ 750 mots en anglais, un peu moins en français.
Les LLMs modernes utilisent l'architecture Transformer, basée sur le mécanisme d'attention : le modèle évalue quels mots de l'entrée sont importants pour prédire la suite.
Papier fondateur : Attention Is All You Need (Vaswani et al., 2017).
Forts pour : rédaction, résumé, traduction, brainstorming, code simple, explications.
Limites : maths complexes, faits récents, calculs précis, raisonnement multi-étapes long, vérification factuelle.
À chaque étape de génération, un LLM prédit la valeur la plus probable de quoi ?
Envie d'aller plus loin ? Découvrez nos formations certifiées Bac+2 à Bac+5 →