Fenêtre de contexte
La fenêtre de contexte est la quantité maximale de texte — mesurée en tokens — qu'un modèle de langage peut prendre en compte d'un seul coup, y compris votre consigne et sa propre réponse. Elle agit comme sa mémoire de travail : tout ce qui y tient entre en compte dans la réponse ; ce qui la dépasse est perdu. Dans une longue conversation ou en collant un document volumineux, si la limite est dépassée, le modèle commence à « oublier » ce qui a été dit au début, ce qui peut entraîner des réponses incohérentes. Les fenêtres ont beaucoup grandi, de quelques milliers de tokens à des centaines de milliers dans les modèles les plus avancés, ce qui permet de travailler avec des livres entiers ou des bases de code. Connaître cette limite aide à bien structurer ses demandes et à comprendre pourquoi l'IA perd parfois le fil.