Comprendre les LLM : architecture et fonctionnement

// modeles de langage

Un LLM (Large Language Model) est un reseau de neurones entrave sur d enormes corpus textuels. Il ne « comprend » pas au sens humain : il predit le token suivant avec une probabilite apprise.

schema LLM

Le pipeline

  1. Prompt — texte d entree.
  2. Tokenisation — decoupe en unites.
  3. Couches — transformeurs a attention.
  4. Logits — scores du token suivant.

Le schema illustre ce flux de gauche a droite, puis la boucle de sortie. Les modeles open-weights (Llama, Mistral, Qwen) permettent un deploiement local, sans dependance cloud — un atout pour la confidentialite.

Comprendre cette mecanique evite les illusions : le modele hallucine quand la probabilite le lui dicte.

Laisser un commentaire