// modeles de langage
Un LLM (Large Language Model) est un reseau de neurones entrave sur d enormes corpus textuels. Il ne « comprend » pas au sens humain : il predit le token suivant avec une probabilite apprise.
Le pipeline
- Prompt — texte d entree.
- Tokenisation — decoupe en unites.
- Couches — transformeurs a attention.
- Logits — scores du token suivant.
Le schema illustre ce flux de gauche a droite, puis la boucle de sortie. Les modeles open-weights (Llama, Mistral, Qwen) permettent un deploiement local, sans dependance cloud — un atout pour la confidentialite.
Comprendre cette mecanique evite les illusions : le modele hallucine quand la probabilite le lui dicte.

