🧠 Brique 1

LLM — Large Language Model

Ce que tout le monde appelle "l'IA" ou "ChatGPT"

La métaphore
Imagine un expert ultra-cultivé — il a lu des milliards de pages d'internet, de livres, d'articles. Mais il est enfermé dans une pièce sans fenêtre, sans téléphone, sans accès à l'extérieur. Il peut répondre à toutes tes questions, mais il ne sait pas ce qui se passe aujourd'hui dans le monde, et il peut parfois inventer des réponses avec une confiance absolue.

C'est quoi exactement ?

Un LLM (Large Language Model) est un programme entraîné sur d'énormes quantités de texte. Son fonctionnement de base est presque magique dans sa simplicité : il prédit le mot suivant. Encore et encore. À une vitesse et une précision extraordinaires.

C'est ce moteur de prédiction qui est derrière ChatGPT, Gemini, Copilot, Claude… Ils utilisent tous un LLM différent, mais le principe est le même.

Comment ça "prédit" ?

Le LLM a vu tellement de texte qu'il sait ce qui vient naturellement après certains mots.

Le ciel est bleu →

Répète ça des millions de fois, avec des phrases bien plus complexes, et tu obtiens un modèle qui semble "comprendre" — même s'il ne fait que prédire statistiquement.

Les "tokens" — l'unité de base

Un LLM ne lit pas les mots comme toi. Il découpe le texte en tokens — des fragments qui correspondent approximativement à des syllabes ou des petits mots.

La phrase "Bonjour, comment vas-tu ?" découpée en tokens
Bon jour , comment vas - tu ?

Pourquoi c'est important ? Parce que les LLMs ont une limite de tokens qu'ils peuvent traiter en une fois — c'est ce qu'on appelle la fenêtre de contexte. Au-delà, ils "oublient" le début de la conversation.

Un échange concret

Voici ce qui se passe quand tu poses une question à ChatGPT :

Dialogue
Toi
Quelle est la capitale de la France ?
LLM
La capitale de la France est Paris.
Toi
Quelle est l'actualité d'aujourd'hui à Paris ?
LLM
⚠️ Attention : un LLM sans connexion internet ne connaît pas l'actualité d'aujourd'hui. Il peut inventer une réponse plausible mais fausse — c'est ce qu'on appelle une "hallucination".

L'hallucination — le point noir

Le LLM prédit le mot suivant. Parfois, la prédiction est fausse — mais il ne le sait pas. Il répond avec la même assurance, que ce soit vrai ou inventé.

⚠️ À retenir absolument
Un LLM peut citer une source qui n'existe pas, inventer un chiffre, ou affirmer un fait faux avec une confiance totale. Il ne ment pas : il prédit. C'est pour ça qu'on ne lui donne jamais une responsabilité critique sans vérification humaine.

C'est précisément pour pallier ce problème que les outils et le RAG (connexion à des documents réels) ont été inventés — voir brique 3.

Ce qu'un LLM seul ne peut pas faire

Réserver un billet de train à ta place
Chercher des informations sur internet en temps réel
Envoyer un email pour toi
Exécuter du code et voir le résultat
Se souvenir de votre conversation précédente (par défaut)

Pour tout ça, il faut lui greffer des outils et l'envelopper dans un agent — c'est ce qu'on voit dans les prochaines briques.

Pour aller plus loin

📖
Comment un LLM "sait" — et peut-on lui faire confiance ?
Entraînement, prédiction, fiabilité par type de sujet

Vidéos recommandées