La fenêtre de contexte expliquée simplement
Jetons, fenêtre de contexte, mémoire d'une conversation : ce que ces notions veulent dire et ce qu'elles changent quand vous travaillez sur de longs documents.
La fenêtre de contexte, c'est la quantité de texte qu'une IA peut « avoir sous les yeux » en même temps : votre demande, les documents collés, l'historique de la conversation et la réponse en cours d'écriture. Tout ce qui dépasse cette limite est ignoré ou oublié. Comprendre cette notion explique pourquoi un long document est parfois mal résumé et pourquoi une conversation interminable finit par dériver.
Une image pour comprendre
Imaginez un bureau sur lequel on ne peut poser qu'un nombre limité de feuilles. Chaque message que vous écrivez, chaque document collé, chaque réponse de l'IA ajoute des feuilles. Quand le bureau est plein, il faut en retirer : selon l'outil, les plus anciennes disparaissent, le document est tronqué, ou un message vous prévient que la limite est atteinte.
L'IA ne garde rien en tête en dehors de ce bureau. Elle ne « se souvient » pas de la conversation comme vous : à chaque réponse, elle relit tout ce qui est posé devant elle. Si une information a glissé hors du bureau, elle n'existe plus pour elle.
Certains outils proposent une fonction de mémoire entre conversations. Il s'agit en général de notes courtes gardées à part et réinjectées dans le contexte, pas d'un souvenir complet de vos échanges passés.
Les jetons, unité de mesure
La taille de la fenêtre ne se compte ni en pages ni en mots, mais en jetons (en anglais tokens). Un jeton est un morceau de texte : un mot court, une partie de mot long, un signe de ponctuation. Le découpage dépend du modèle.
Quelques repères utiles, à retenir comme des ordres de grandeur et non des valeurs exactes :
- un mot français correspond souvent à plus d'un jeton, car les mots longs et les accents sont découpés en plusieurs morceaux ;
- le même texte coûte en général un peu plus de jetons en français qu'en anglais ;
- les tableaux, le code et les caractères spéciaux consomment beaucoup de jetons pour peu de contenu lisible.
Les jetons servent aussi d'unité de facturation pour les usages professionnels par API. Les tarifs et les tailles de fenêtre varient d'un modèle à l'autre et changent souvent : consultez la documentation de l'éditeur plutôt qu'un chiffre lu ailleurs.
Ce que cela change pour les longs documents
Les fenêtres de contexte des grands assistants sont devenues larges, au point d'accepter des documents de plusieurs centaines de pages selon l'outil et la formule. Mais « tenir dans la fenêtre » ne veut pas dire « être bien lu ».
| Situation | Ce qui peut se passer | Parade |
|---|---|---|
| Document plus long que la fenêtre | Une partie est coupée sans prévenir, ou refusée | Découper en sections et traiter chaque partie |
| Document long mais qui tient | L'attention se disperse, des passages du milieu sont moins bien exploités | Poser des questions ciblées, demander des citations |
| Plusieurs documents à la fois | Confusion entre les sources | Nommer chaque document et préciser lequel utiliser |
| PDF scanné ou mal converti | Le texte lu est incomplet ou brouillé | Vérifier que le texte est sélectionnable, sinon passer par une reconnaissance de caractères |
Pour un résumé fiable d'un gros document, la méthode pas à pas de l'article résumer un PDF avec l'IA repose justement sur ces limites. Et quand le volume devient vraiment grand, des outils fondés sur la recherche dans vos sources, comme Gemini Notebook, contournent le problème : voir le RAG expliqué simplement.
Pourquoi les longues conversations dérivent
Vous avez peut-être remarqué qu'après une longue séance de travail, l'IA oublie une consigne donnée au début, mélange deux versions d'un texte ou revient à un ton que vous aviez corrigé. Plusieurs causes se combinent.
- Le début sort de la fenêtre, dans les outils qui retirent les messages les plus anciens.
- Les consignes se contredisent : vous avez demandé « court » au début, puis « plus détaillé » plus tard. L'IA doit arbitrer.
- Le bruit s'accumule : versions abandonnées, essais ratés, digressions. Tout cela reste posé sur le bureau et brouille la lecture.
La solution est souvent de repartir d'une page blanche avec un état propre, plutôt que d'empiler les corrections.
Nous allons poursuivre ce travail dans une nouvelle conversation. Rédige un récapitulatif complet que je pourrai coller au début : l'objectif, le public visé, les décisions prises, les consignes de ton et de format à respecter, la dernière version validée du texte, et ce qu'il reste à faire.
Copiez ce récapitulatif, relisez-le, corrigez ce qui ne va pas, puis ouvrez une nouvelle conversation en le collant en premier message.
Bonnes pratiques au quotidien
Quelques habitudes suffisent pour tirer parti de la fenêtre de contexte sans en subir les limites.
- Une conversation par sujet. Ne mélangez pas la préparation d'une réunion et la rédaction d'une annonce dans le même fil.
- Les consignes importantes au début, et rappelées si besoin. Si une règle compte (vouvoiement, longueur maximale), répétez-la dans les demandes clés.
- Ne collez que l'utile. Un extrait pertinent de dix pages donne souvent un meilleur résultat qu'un rapport entier.
- Nommez vos documents. « Document A : contrat de 2025 ; Document B : avenant » évite les confusions.
- Utilisez les projets ou espaces de travail que proposent certains assistants pour y ranger des consignes et des documents permanents, plutôt que de tout recoller.
Pour aller plus loin
Ces notions sont reprises en pratique dans la formation Bien parler à l'IA de Genialab, ainsi que dans les cours Claude et ChatGPT, où vous apprenez à organiser vos conversations et vos projets. Le parcours certificat IA en 28 jours les aborde avec d'autres bases utiles.
Questions fréquentes
L'IA se souvient-elle de mes anciennes conversations ?
Par défaut, chaque conversation repart de zéro. Certains outils proposent une mémoire qui conserve des informations choisies d'une conversation à l'autre ; ce réglage se vérifie et se désactive dans les paramètres de l'outil.
Comment savoir si mon document est trop long ?
Certains outils affichent un message ou refusent le fichier, d'autres le tronquent sans prévenir. Un test simple : demandez le contenu de la dernière section. Si la réponse est vague ou fausse, découpez le document.
Une fenêtre plus grande donne-t-elle de meilleures réponses ?
Elle permet de traiter plus de texte d'un coup, mais la qualité dépend aussi de la clarté des demandes. Un contexte court et ciblé reste souvent plus efficace.
Qu'est-ce qu'un jeton, en une phrase ?
C'est un petit morceau de texte (mot court, fragment de mot ou ponctuation) qui sert d'unité pour mesurer ce qu'un modèle lit et écrit.