Fenêtre de contexte
- Concept
- Intermédiaire
- Transversal
- Toujours utilisé
En bref
Quantité maximale de texte qu'un modèle d'intelligence artificielle peut prendre en compte en même temps pour répondre à une demande.
Définition complète
La fenêtre de contexte désigne la quantité maximale de texte, mesurée en unités appelées « tokens » (des fragments de mots), qu’un modèle d’intelligence artificielle peut prendre en compte en même temps pour comprendre une demande et produire une réponse. Tout ce qui dépasse cette limite, dans une longue conversation ou un document trop volumineux, n’est plus pris en compte par le modèle au moment de répondre.
Par exemple, si un utilisateur colle un document de deux cents pages dans une conversation dont la fenêtre de contexte est limitée à l’équivalent d’une centaine de pages, le modèle ne pourra pas tenir compte de l’intégralité du texte : une partie sera ignorée ou tronquée, selon la façon dont l’outil gère ce dépassement.
Attention : la taille de la fenêtre de contexte varie fortement d’un modèle à l’autre, et a beaucoup augmenté ces dernières années, mais elle reste toujours limitée, même si la limite se fait de plus en plus rarement sentir au quotidien.
À quoi ça sert
Comprendre la fenêtre de contexte sert à anticiper les limites d’un outil d’intelligence artificielle avant de lui soumettre un document long ou une conversation qui s’étire dans le temps : au-delà d’un certain volume, l’outil peut « oublier » des informations données plus tôt.
Cette notion aide aussi à choisir le bon outil selon le besoin : certains modèles disposent d’une fenêtre de contexte beaucoup plus large que d’autres, ce qui est déterminant pour analyser un contrat entier, un long rapport ou plusieurs documents à la fois.
Enfin, elle permet d’expliquer pourquoi un assistant peut sembler « perdre le fil » d’une conversation très longue : ce n’est pas un caprice de l’outil, mais une limite technique connue et mesurable.
Cas d'usage typiques
– Vérifier : contrôler la taille d’un document avant de le soumettre entièrement à un modèle / éviter une analyse tronquée sans le savoir.
– Choisir : sélectionner un modèle adapté à la taille des documents à traiter / meilleure fiabilité sur les documents longs.
– Résumer : découper un très long document en plusieurs parties avant analyse / contournement des limites de la fenêtre de contexte.
– Rappeler : réintroduire une information importante donnée plus tôt dans une longue conversation / éviter que le modèle ne la perde de vue.
– Comparer : évaluer la taille de fenêtre de contexte de plusieurs outils avant de choisir une solution / décision plus éclairée pour l’entreprise.
Ce que tu sauras faire
Savoir estimer si un document ou une conversation dépasse la fenêtre de contexte d'un outil, et adapter sa façon de l'utiliser en conséquence (découpage, résumé, rappel des informations clés).
Mises en situation
Situation 1 : un juriste et un contrat de cinquante pages
Contexte : un juriste souhaite faire analyser un contrat très long par un assistant d’intelligence artificielle pour repérer les clauses sensibles.
Application : il vérifie d’abord que la fenêtre de contexte de l’outil utilisé peut réellement contenir la totalité du document avant de lancer l’analyse.
Résultat attendu : il choisit un outil adapté à la taille du document, évitant une analyse partielle et donc potentiellement incomplète du contrat.
Situation 2 : un consultant et une conversation qui s’éternise
Contexte : un consultant échange depuis plusieurs heures avec un assistant sur un même projet, en ajoutant régulièrement de nouvelles informations.
Application : il remarque que l’assistant semble avoir oublié une contrainte donnée en tout début d’échange, et la rappelle explicitement dans son message suivant.
Résultat attendu : l’assistant retrouve la bonne piste, car l’information a été réintroduite dans la partie récente de la fenêtre de contexte.
Situation 3 : une équipe qui doit analyser plusieurs rapports
Contexte : une équipe doit comparer trois rapports annuels très volumineux à l’aide d’un assistant d’intelligence artificielle.
Application : elle découpe chaque rapport en sections et demande un résumé de chaque section avant de comparer les résumés entre eux.
Résultat attendu : l’analyse reste fiable malgré le volume important de texte, car aucun document entier ne dépasse la fenêtre de contexte de l’outil au moment de l’analyse.
Application guidée : estimer un dépassement de fenêtre de contexte
Contexte : un document de cent cinquante pages doit être analysé par un outil dont la fenêtre de contexte correspond, dans les faits, à environ cent pages de texte.
Question : que risque-t-il de se passer si l’utilisateur soumet le document en une seule fois ?
Résultat attendu : une partie du document, souvent la fin, risque de ne pas être prise en compte par le modèle ; il vaut mieux découper le document en deux ou trois parties et analyser chacune séparément.
Application guidée : diagnostiquer une réponse incohérente
Contexte : dans une longue conversation, un assistant contredit une consigne donnée plus de deux heures d’échange plus tôt, alors que cette consigne n’a jamais été explicitement annulée.
Question : quelle est l’explication la plus probable de cette incohérence ?
Résultat attendu : la consigne initiale est probablement sortie de la fenêtre de contexte active du modèle, qui ne peut donc plus s’appuyer dessus ; il faut la rappeler explicitement pour que l’assistant en tienne à nouveau compte.
Pour bien le retenir
L'analogie
La fenêtre de contexte, c’est comme la mémoire de travail d’une personne qui prend des notes sur un tableau blanc de taille limitée : tant qu’il reste de la place, on peut ajouter des informations, mais dès que le tableau est plein, il faut effacer les notes les plus anciennes pour continuer à écrire, au risque d’oublier ce qui a été noté au tout début.
« Le tableau blanc de taille limitée : au-delà, il faut effacer les notes les plus anciennes. »
Pièges à éviter
À ne pas confondre avec
Ne confondez pas fenêtre de contexte et mémoire permanente d'un assistant : la fenêtre de contexte concerne uniquement la conversation ou le document en cours, alors que certains outils disposent, en plus, d'une mémoire à long terme distincte, qui fonctionne selon des règles différentes.
Autre piège fréquent : croire qu'une fenêtre de contexte plus large règle automatiquement tous les problèmes d'analyse de documents longs. Même dans une fenêtre large, un modèle peut accorder moins d'attention à certaines parties du texte, notamment celles situées au milieu d'un très long document.
Évolution historique
Apparition : Notion technique liée aux modèles de langage, connue des spécialistes depuis la fin des années 2010, popularisée auprès d'un public plus large à partir des années 2020
Quels changements depuis l’arrivée de l’IA ?
Avant
Les premiers modèles de langage disposaient de fenêtres de contexte très réduites, suffisantes pour quelques paragraphes tout au plus, ce qui limitait fortement les usages possibles sur des documents longs.
Aujourd’hui
La taille des fenêtres de contexte a considérablement augmenté depuis le début des années 2020, permettant d’analyser des documents beaucoup plus longs, voire plusieurs documents à la fois, ce qui a ouvert de nouveaux usages professionnels, notamment dans l’analyse de contrats ou de rapports volumineux.
Évolution historique
Fin des années 2010 : les premiers modèles de langage à grande échelle disposent de fenêtres de contexte limitées à quelques milliers de mots.
Début des années 2020 : les modèles conversationnels grand public élargissent progressivement cette capacité, tout en restant limités pour les documents très longs.
2023 : plusieurs éditeurs annoncent des fenêtres de contexte nettement plus grandes, capables de traiter des documents entiers.
2023-2024 : l’analyse de très longs documents ou de plusieurs fichiers simultanément devient un usage courant en entreprise.
Aujourd’hui : la taille de la fenêtre de contexte continue de progresser, mais reste un critère technique important à vérifier selon l’usage prévu.
Simulateur