Une IA ne se souvient pas d’une conversation comme un humain. À chaque réponse, elle relit tout ce qu’on lui fournit : vos messages, ses réponses précédentes, les documents joints, ses instructions. La fenêtre de contexte, c’est la taille maximale de cet ensemble. Elle se mesure en tokens, des morceaux de mots.
Pensez à un bureau : plus il est grand, plus on peut y étaler de dossiers à la fois. Les modèles récents acceptent l’équivalent de plusieurs centaines, voire milliers de pages, ce qui permet d’analyser un long contrat ou un rapport annuel d’un seul coup. Mais quand le bureau est plein, il faut faire de la place : selon l’application, le début de l’échange est résumé, laissé de côté, ou la conversation ne peut plus continuer.
Les conséquences sont très concrètes :
- une très longue conversation finit par perdre des détails donnés au début ;
- pour un nouveau sujet, mieux vaut ouvrir une nouvelle conversation ;
- les informations importantes gagnent à être rappelées, ou rangées dans un document que l’IA relit.
Si vous fabriquez un outil interne avec Claude Code, c’est tout l’intérêt du fichier CLAUDE.md : les règles de l’outil y sont notées une fois, et l’IA les relit au début de chaque séance au lieu de compter sur sa mémoire. Quand la conversation s’allonge trop, Claude Code la résume de lui-même pour libérer de la place.
Exemple
Au service juridique, Juliette joint à sa demande un contrat de quatre-vingts pages : il tient dans la fenêtre de contexte, et l’IA peut en comparer les clauses d’un bout à l’autre.