Quand le contexte est presque plein, l'IA commence à oublier des choses. Dans la plupart des cas, ce n'est pas une question d'attitude, mais le signe que le début de la conversation a été tronqué ou compressé. La méthode la plus fiable consiste à lui demander d'abord de résumer les points essentiels, puis d'ouvrir une nouvelle conversation, d'y coller le résumé et de continuer là, plutôt que de lui répéter dans la conversation d'origine qu'elle s'est trompée.
Quatre signes que le contexte est presque plein
Le premier signe : elle oublie les consignes et les noms donnés au départ. Par exemple, un nom de personnage, une formule d'adresse ou une exigence de format fixés au début changent soudain plus tard, ou ne sont plus utilisés du tout. Le deuxième signe : elle repropose une solution que vous aviez déjà écartée, comme si cette discussion n'avait jamais eu lieu. Le troisième signe : ses réponses deviennent nettement plus courtes et plus expéditives. Les détails et les exemples qu'elle pouvait fournir avant disparaissent peu à peu, et il ne reste que des conclusions vagues. Le quatrième signe : elle confond les informations, en mélangeant des éléments issus de paragraphes différents, de personnes différentes ou de versions différentes, et la chronologie comme les liens de cause à effet commencent à ne plus correspondre. Si deux ou trois de ces signes apparaissent, on peut en conclure que le problème ne vient pas d'un manque de clarté de votre part, mais simplement d'une conversation devenue trop longue.
Pourquoi elle oublie après une longue discussion
La raison tient à la fenêtre de contexte, qui est limitée. Dans une conversation, le modèle ne peut voir qu'une certaine quantité de texte à la fois. Plus la discussion dure, plus le contenu du début risque d'être évincé, ou compressé par le système en une version abrégée, et les détails ne peuvent naturellement pas être conservés. Même si le contenu n'a pas été entièrement évincé, l'attention est diluée par la grande quantité d'échanges intermédiaires : les informations les plus éloignées et les moins mentionnées sont plus facilement recouvertes par ce qui suit. C'est aussi pour cela que la qualité peut baisser dans la seconde partie d'une longue conversation, même lorsque la fenêtre est présentée comme très grande. Pour en savoir plus, voir Une fenêtre de contexte plus grande n'est pas toujours mieux : le coût d'attention derrière 1M de tokens et trois malentendus.
Une fois les oublis commencés, voici la manière la plus fiable de continuer
Premièrement, demandez à l'IA de produire un résumé de reprise, en exigeant explicitement quatre éléments : l'objectif actuel, les conclusions déjà arrêtées, les questions encore sans réponse et le texte original essentiel à conserver, comme les noms, les chiffres et les formulations fixes. Deuxièmement, ouvrez une nouvelle conversation, collez-y d'abord le résumé, ajoutez une phrase du type « Merci de continuer à partir de ce résumé, sans remettre en cause les conclusions déjà arrêtées », et posez seulement ensuite votre nouvelle question. Après avoir collé le résumé, demandez-lui de reformuler l'objectif et les conclusions arrêtées, et vérifiez qu'il n'y a pas de malentendu avant de continuer. C'est moins fastidieux que d'enchaîner directement avec la question suivante, et cela évite qu'elle poursuive dans une mauvaise direction à partir d'une compréhension erronée. Vous pouvez aussi conserver à part les noms, les formulations et les interdits que vous réutilisez souvent, et les coller à chaque nouvelle conversation, au lieu de compter sur sa propre mémoire. Troisièmement, divisez autant que possible les tâches longues en étapes, consacrez une conversation distincte à chaque étape et ne reprenez que le résumé et le résultat de l'étape précédente, au lieu de tout faire tenir dans une seule conversation tirée en longueur jusqu'au bout. Quatrièmement, placez les consignes importantes au début de chaque conversation et répétez-les au bon moment aux étapes clés. Cinquièmement, ne mélangez pas plusieurs tâches sans rapport dans la même conversation : plus il y a de sujets, plus les informations interfèrent entre elles, et les oublis et confusions arriveront seulement plus tôt.
Deux limites faciles à confondre
Les versions payantes disposent en général d'une fenêtre de contexte plus grande et tiennent plus longtemps, mais elles ont elles aussi une limite, et une conversation suffisamment longue finira par les remplir. Un abonnement n'est donc pas une solution définitive. Par ailleurs, la fonction « mémoire » de nombreux produits n'est pas la même chose que le contexte d'une conversation unique : la mémoire conserve un petit nombre de préférences et de faits d'une conversation à l'autre, tandis que le contexte correspond à tout ce qu'elle peut voir à cet instant précis dans la conversation en cours. Si cette conversation oublie une consigne que vous venez de donner, il s'agit en général d'un problème de contexte, que l'activation ou la désactivation de la mémoire dans les paramètres ne résoudra pas.