Grand modèle de langage (LLM)

Un grand modèle de langage (Large Language Model, LLM) est un système d'IA entraîné sur d'énormes quantités de texte pour comprendre et générer le langage humain. Au fond, il fonctionne en prédisant, mot après mot (ou token après token), la suite la plus probable d'un texte ; en répétant cette prédiction, il produit des réponses, des résumés, des traductions ou du code. C'est la technologie qui se cache derrière des assistants comme ChatGPT, Claude ou Gemini. Sa grande force est la polyvalence, mais il a aussi des limites claires : il peut inventer des faits avec un aplomb total (hallucinations), ne distingue pas de lui-même le vrai du faux, et son savoir se limite à ce qu'il a vu pendant l'entraînement. C'est pourquoi il vaut mieux traiter ses réponses comme un brouillon utile qu'il faut vérifier, et non comme une source infaillible.

Articles où il apparaît