La fenêtre de contexte est la mémoire de travail de l’IA dans une conversation. Elle explique les oublis, les coupures et les collages trop longs.
Définition en une phrase claire
La fenêtre de contexte est la capacité limitée de texte qu’un modèle peut considérer en même temps pour produire sa prochaine réponse.
Dans un assistant fondé sur un LLM, cette fenêtre joue le rôle d’un bureau de travail : tout ce qui est dessus peut influencer la suite ; ce qui est tombé par terre n’existe plus pour le calcul. La taille dépend du modèle et du produit. Certains affichent un chiffre ; d’autres se contentent d’un message d’erreur ou d’un oubli progressif.
Important : la fenêtre n’est pas « votre compte » ni « le savoir du modèle ». Le savoir issu de l’entraînement est déjà dans le moteur. La fenêtre, elle, concerne seulement ce fil de conversation (et ce que vous y collez). Fermer le chat, changer de fil, ou dépasser la limite change ce qui reste disponible — sans pour autant « désapprendre » le français au modèle.
Expliqué avec une image concrète
Imaginez un tableau blanc de réunion, de taille fixe. Vous y écrivez la question du jour, les notes utiles, les corrections. Quand le tableau est plein, quelqu’un efface le haut pour écrire en bas. Les premières lignes ne sont pas « trahies » : elles ne sont plus visibles. L’assistant ne peut raisonner que sur ce qui reste au tableau.
Autre image : une table de cuisine étroite. Vous y posez les ingrédients du repas. Si vous empilez aussi le courrier de la semaine, les notices d’appareils et trois livres de recettes « au cas où », il n’y a plus de place pour cuisiner. La fenêtre de contexte, c’est cette table : trop d’objets inutiles, et la consigne importante tombe par terre.
Ces images aident à écrire une demande sans noyer le modèle. Mettez au centre l’objectif, les faits à respecter, la limite « ne rien inventer ». Gardez hors table ce qui n’aide pas la tâche du moment. Si la conversation s’allonge, résumez vous-même les décisions déjà prises dans un court paragraphe, puis repartez propre — comme on nettoie le tableau avant un nouveau point.
Un exemple du quotidien
Vous discutez avec un assistant pour préparer un courriel. Au message 1, vous donnez le destinataire et le ton. Au message 5, vous corrigez deux phrases. Au message 12, vous demandez « reprends comme tout à l’heure » — et la réponse ignore une consigne du début. Ce n’est pas forcément de la négligence : la fenêtre a glissé, et le début n’est plus dans le calcul.
Autre cas : vous collez un long PDF, puis posez une question précise en bas. Si le document remplit déjà presque toute la fenêtre, la question peut être mal prise en compte, ou le service refuse. Découper (« voici la section budget seulement ») restaure de l’espace pour la consigne.
Vous pouvez aussi « remplir » la fenêtre sans vous en rendre compte en collant plusieurs fois le même texte, ou en laissant l’assistant régénérer de longs pavés que vous ne lisez pas. Chaque pavé occupe de la place pour la suite. Alléger, c’est aussi supprimer du fil ce qui n’est plus utile.
Un exemple en Hauts-de-France
À Amiens, le secrétaire d’une association enchaîne dix allers-retours sur un compte-rendu. L’assistant finit par « oublier » qu’une décision était reportée. Solution : un nouveau fil avec un résumé humain en dix lignes et la consigne de structure. La fenêtre repart propre.
Dans une mairie de l’Aisne, coller tout l’arrêté plus trois mails internes remplit la mémoire de travail et multiplie le risque d’invention. Trois faits publics et « n’ajoute aucune date », puis vérification sur l’affichage officiel, suffisent. À Tourcoing ou Valenciennes, une TPE gagne à coller un modèle de devis + les champs du jour, pas la fiche client entière : place libérée, données protégées.
En Maison régionale de l’IA, l’exercice « même demande, collage court vs long » montre souvent mieux le concept qu’un schéma : quand le tableau déborde, la qualité chute. Le geste reste : faire de la place à l’essentiel.
On confond souvent
On confond souvent fenêtre de contexte et mémoire humaine. L’outil n’a pas « vécu » votre réunion. Il dispose d’un tampon de texte limité pour ce fil. Hors tampon, pas de souvenir magique — sauf si vous avez branché un carnet externe, une base documentaire, ou un résumé sauvegardé par le produit.
On confond aussi fenêtre et token. Le token est l’unité de mesure ; la fenêtre est le réservoir. Dire « mon modèle a 128k de contexte » parle en tokens (ordre de grandeur), pas en pages Word exactes. Le nombre de pages « senties » varie selon la densité du texte.
Autre confusion : croire qu’une grande fenêtre dispense de cadrer. Plus de place permet de coller plus — y compris plus de bruit. Une longue fenêtre mal remplie reste une mauvaise conversation. La clarté de la demande compte autant que la taille du réservoir.
Enfin, on confond fenêtre de contexte et entraînement. L’entraînement construit le modèle, souvent loin de vous, sur d’énormes corpus. La fenêtre gère votre échange du jour. Corriger un brouillon dans le chat n’équivaut pas à réentraîner le moteur ; cela oriente seulement ce qui est encore sur le tableau blanc.
Ce qu’il faut retenir
La fenêtre de contexte est la mémoire de travail d’une conversation : limitée, partagée entre ce que vous envoyez, ce qui a déjà été dit, et ce qui reste à répondre. Quand elle déborde, le début s’efface du calcul. Ce n’est pas une conscience qui « se lasse ».
Pour travailler proprement : un fil = un objectif ; collages minimaux ; résumé humain si le fil s’allonge ; consignes critiques répétées si besoin ; nouveau fil plutôt qu’un chaos de trente messages. Croisez avec token pour l’unité, LLM pour le moteur, écrire une demande pour la méthode.
En Hauts-de-France comme ailleurs, ce mot sert à expliquer calmement un oubli d’outil sans dramatiser, et à éviter le réflexe « je colle tout le dossier ». Moins sur le tableau, mieux pour la réponse — et mieux pour les données que vous ne deviez pas coller.
Questions fréquentes
Pourquoi l’IA oublie-t-elle le début de la conversation ?
Parce que la fenêtre de contexte est limitée. Message, historique et réponse partagent le même espace. Quand il est plein, les parties les plus anciennes sortent du calcul. L’outil n’a pas « décidé » de vous ignorer : il ne voit plus ces lignes. Résumez l’essentiel et rouvrez un fil propre si besoin.
Une plus grande fenêtre règle-t-elle tous les problèmes ?
Non. Elle permet d’en coller davantage, y compris du bruit. Sans objectif clair et sans tri, la réponse reste médiocre. Une fenêtre large mal remplie n’excuse pas une demande floue, ni l’absence de vérification sur les faits. La taille aide ; la méthode décide.
Comment gérer un long document sans dépasser la fenêtre ?
Découpez par sections utiles. Donnez à chaque fois la consigne et le passage concerné. Synthétisez vous-même entre deux étapes. Évitez de coller trois fois le même fichier « pour être sûr ». Si l’outil accepte un dépôt de fichier dédié, lisez quand même ce qu’il en retient : la relecture humaine reste nécessaire.
Fenêtre de contexte et mémoire du compte, c’est pareil ?
En général, non. La fenêtre concerne le fil en cours (mémoire de travail). Certains produits proposent aussi des souvenirs ou des espaces documentaires séparés — ce sont d’autres mécanismes, avec leurs réglages de confidentialité. Ne supposez pas qu’un détail dit hier dans un autre chat sera connu aujourd’hui.
