IA
Fenêtre de contexte
Aussi : context window · fenêtre de contexte · context length
En clair
La fenêtre de contexte est la quantité de texte qu’un modèle peut prendre en compte en une seule fois — l’équivalent de ce qu’il garde sous les yeux. Au-delà, il faut résumer, découper, ou ne lui envoyer que les passages utiles. Une grande fenêtre ne rend pas le modèle plus intelligent : elle lui permet seulement de lire plus long d’un coup.
Concrètement
Une fenêtre de 128 000 tokens absorbe l’équivalent d’un rapport de quatre-vingts pages, renvoyé et refacturé à chaque question posée.
Pourquoi ça compte
Dépasser la limite sans s’en apercevoir produit des coupures silencieuses : le modèle perd le début. À l’inverse, payer pour une fenêtre énorme sans en avoir l’usage gonfle la facture, puisque tout ce qu’on envoie est refacturé à chaque appel.
Définition technique
Quantité maximale de tokens qu’un modèle peut prendre en entrée (et parfois en sortie) dans une même requête.