Aller au contenu
Préversion · paiement de test Stripe, aucune somme réelle
Commencer
Menu

Guides IA

La fenêtre de contexte expliquée simplement

Jetons, fenêtre de contexte, mémoire d'une conversation : ce que ces notions veulent dire et ce qu'elles changent quand vous travaillez sur de longs documents.

Par La rédaction Genialab · publié le · mis à jour le · 4 min de lecture

La fenêtre de contexte, c'est la quantité de texte qu'une IA peut « avoir sous les yeux » en même temps : votre demande, les documents collés, l'historique de la conversation et la réponse en cours d'écriture. Tout ce qui dépasse cette limite est ignoré ou oublié. Comprendre cette notion explique pourquoi un long document est parfois mal résumé et pourquoi une conversation interminable finit par dériver.

Une image pour comprendre

Imaginez un bureau sur lequel on ne peut poser qu'un nombre limité de feuilles. Chaque message que vous écrivez, chaque document collé, chaque réponse de l'IA ajoute des feuilles. Quand le bureau est plein, il faut en retirer : selon l'outil, les plus anciennes disparaissent, le document est tronqué, ou un message vous prévient que la limite est atteinte.

L'IA ne garde rien en tête en dehors de ce bureau. Elle ne « se souvient » pas de la conversation comme vous : à chaque réponse, elle relit tout ce qui est posé devant elle. Si une information a glissé hors du bureau, elle n'existe plus pour elle.

Certains outils proposent une fonction de mémoire entre conversations. Il s'agit en général de notes courtes gardées à part et réinjectées dans le contexte, pas d'un souvenir complet de vos échanges passés.

Les jetons, unité de mesure

La taille de la fenêtre ne se compte ni en pages ni en mots, mais en jetons (en anglais tokens). Un jeton est un morceau de texte : un mot court, une partie de mot long, un signe de ponctuation. Le découpage dépend du modèle.

Quelques repères utiles, à retenir comme des ordres de grandeur et non des valeurs exactes :

  • un mot français correspond souvent à plus d'un jeton, car les mots longs et les accents sont découpés en plusieurs morceaux ;
  • le même texte coûte en général un peu plus de jetons en français qu'en anglais ;
  • les tableaux, le code et les caractères spéciaux consomment beaucoup de jetons pour peu de contenu lisible.

Les jetons servent aussi d'unité de facturation pour les usages professionnels par API. Les tarifs et les tailles de fenêtre varient d'un modèle à l'autre et changent souvent : consultez la documentation de l'éditeur plutôt qu'un chiffre lu ailleurs.

Ce que cela change pour les longs documents

Les fenêtres de contexte des grands assistants sont devenues larges, au point d'accepter des documents de plusieurs centaines de pages selon l'outil et la formule. Mais « tenir dans la fenêtre » ne veut pas dire « être bien lu ».

SituationCe qui peut se passerParade
Document plus long que la fenêtreUne partie est coupée sans prévenir, ou refuséeDécouper en sections et traiter chaque partie
Document long mais qui tientL'attention se disperse, des passages du milieu sont moins bien exploitésPoser des questions ciblées, demander des citations
Plusieurs documents à la foisConfusion entre les sourcesNommer chaque document et préciser lequel utiliser
PDF scanné ou mal convertiLe texte lu est incomplet ou brouilléVérifier que le texte est sélectionnable, sinon passer par une reconnaissance de caractères

Pour un résumé fiable d'un gros document, la méthode pas à pas de l'article résumer un PDF avec l'IA repose justement sur ces limites. Et quand le volume devient vraiment grand, des outils fondés sur la recherche dans vos sources, comme Gemini Notebook, contournent le problème : voir le RAG expliqué simplement.

Pourquoi les longues conversations dérivent

Vous avez peut-être remarqué qu'après une longue séance de travail, l'IA oublie une consigne donnée au début, mélange deux versions d'un texte ou revient à un ton que vous aviez corrigé. Plusieurs causes se combinent.

  • Le début sort de la fenêtre, dans les outils qui retirent les messages les plus anciens.
  • Les consignes se contredisent : vous avez demandé « court » au début, puis « plus détaillé » plus tard. L'IA doit arbitrer.
  • Le bruit s'accumule : versions abandonnées, essais ratés, digressions. Tout cela reste posé sur le bureau et brouille la lecture.

La solution est souvent de repartir d'une page blanche avec un état propre, plutôt que d'empiler les corrections.

Demande à copier
Nous allons poursuivre ce travail dans une nouvelle conversation. Rédige un récapitulatif complet que je pourrai coller au début : l'objectif, le public visé, les décisions prises, les consignes de ton et de format à respecter, la dernière version validée du texte, et ce qu'il reste à faire.

Copiez ce récapitulatif, relisez-le, corrigez ce qui ne va pas, puis ouvrez une nouvelle conversation en le collant en premier message.

Bonnes pratiques au quotidien

Quelques habitudes suffisent pour tirer parti de la fenêtre de contexte sans en subir les limites.

  1. Une conversation par sujet. Ne mélangez pas la préparation d'une réunion et la rédaction d'une annonce dans le même fil.
  2. Les consignes importantes au début, et rappelées si besoin. Si une règle compte (vouvoiement, longueur maximale), répétez-la dans les demandes clés.
  3. Ne collez que l'utile. Un extrait pertinent de dix pages donne souvent un meilleur résultat qu'un rapport entier.
  4. Nommez vos documents. « Document A : contrat de 2025 ; Document B : avenant » évite les confusions.
  5. Utilisez les projets ou espaces de travail que proposent certains assistants pour y ranger des consignes et des documents permanents, plutôt que de tout recoller.

Pour aller plus loin

Ces notions sont reprises en pratique dans la formation Bien parler à l'IA de Genialab, ainsi que dans les cours Claude et ChatGPT, où vous apprenez à organiser vos conversations et vos projets. Le parcours certificat IA en 28 jours les aborde avec d'autres bases utiles.

Questions fréquentes

L'IA se souvient-elle de mes anciennes conversations ?

Par défaut, chaque conversation repart de zéro. Certains outils proposent une mémoire qui conserve des informations choisies d'une conversation à l'autre ; ce réglage se vérifie et se désactive dans les paramètres de l'outil.

Comment savoir si mon document est trop long ?

Certains outils affichent un message ou refusent le fichier, d'autres le tronquent sans prévenir. Un test simple : demandez le contenu de la dernière section. Si la réponse est vague ou fausse, découpez le document.

Une fenêtre plus grande donne-t-elle de meilleures réponses ?

Elle permet de traiter plus de texte d'un coup, mais la qualité dépend aussi de la clarté des demandes. Un contexte court et ciblé reste souvent plus efficace.

Qu'est-ce qu'un jeton, en une phrase ?

C'est un petit morceau de texte (mot court, fragment de mot ou ponctuation) qui sert d'unité pour mesurer ce qu'un modèle lit et écrit.

notions contexte documents

À lire ensuite

Passer de la lecture à la pratique

Des leçons de dix minutes avec exercices, pour refaire ces gestes vous-même. Le questionnaire d'entrée est gratuit.

Voir mon parcours