RAPHAEL THYS
Prendre RDV
← Tous les articles

Maîtrise de l'IA

Quand ouvrir une nouvelle conversation IA, et quand continuer ?

La fenêtre de contexte est une ressource finie. Savoir quand réinitialiser et quand poursuivre est l'une des compétences les plus utiles en maîtrise de l'IA.

Raphael Thys 7 min de lecture FR
Read in English
Un homme transfère le contexte essentiel d'un récipient encombré vers un espace de conversation propre

Une petite question pratique qui cache une grande décision de conception. Toute longue conversation avec un assistant IA équilibre le contexte, utile, et l’encombrement, qui dégrade. Cet article propose une règle empirique de travail.

Le coût caché d’une longue conversation

Chaque message envoyé est traité avec toute la conversation précédente. C’est une fonction utile : c’est ce qui permet au modèle de garder votre style, votre projet et vos consignes antérieures. C’est aussi une taxe : plus il y a de tokens derrière la barre de défilement, plus l’attention du modèle doit se répartir, et plus il risque de faire remonter un détail périmé au mauvais moment.

Le symptôme est facile à reconnaître : plus une conversation s’allonge, plus les réponses se dégradent. Pas d’un coup, progressivement. Le modèle se met à donner des réponses génériques, oublie des consignes posées au début, contredit parfois ce qu’il affirmait une heure plus tôt. Il ne devient ni paresseux ni fatigué : il manque simplement de place. Je vois trois mécanismes à l’œuvre.

La limite du tableau blanc

Imaginez la mémoire de travail du modèle comme un petit tableau blanc. Tout ce qui passe dans la conversation s’y inscrit : vos messages, ses réponses, chaque fichier joint. Ce tableau, c’est la fenêtre de contexte, et sa taille est strictement limitée. Une fois plein, les lignes les plus anciennes sont effacées pour faire de la place aux nouvelles. Le modèle n’oublie pas comme un humain oublie : vos premières consignes ne sont tout simplement plus sur le tableau.

Le biais de récence

Avant même que le tableau soit plein, l’attention n’est pas répartie uniformément. Le modèle accorde beaucoup plus de poids à ce que vous venez de dire qu’à ce que vous disiez vingt messages plus tôt. Des règles strictes posées au premier message peuvent cesser d’être appliquées au quinzième, non pas parce que le modèle a décidé de les ignorer, mais parce qu’elles sont trop loin derrière pour peser encore.

L’effet d’encombrement

Chaque message occupe de la place sur le tableau, y compris ceux que vous préféreriez oublier : les fautes de frappe, les brouillons rejetés, les digressions, chaque reprenons depuis le début. Rien ne disparaît. Tout s’accumule, entre en concurrence avec votre véritable objectif, et tire la qualité des réponses vers le bas.

Une règle de travail

  • Rester quand le nouveau tour dépend de ce qui a été dit trois ou quatre échanges plus tôt.
  • Réinitialiser quand le nouveau tour est une autre tâche sous le même chapeau.
  • Brancher (une nouvelle conversation amorcée par un résumé d’un paragraphe) quand vous voulez garder l’élan sans transporter les bagages.

Trois habitudes rendent cette règle facile à appliquer.

Repartir à neuf, avec un résumé

Quand le modèle devient confus ou générique, inutile d’insister : redémarrer vaut mieux que forcer. Ouvrez une nouvelle conversation et amorcez-la avec le meilleur de l’ancienne, c’est-à-dire un court résumé de ce dont vous avez besoin et le brouillon le plus abouti obtenu jusqu’ici. Par exemple :

Voici un résumé de ce dont j’ai besoin : [résumé]. Voici le meilleur brouillon obtenu jusqu’ici : [texte]. Révisons le deuxième paragraphe en suivant ces règles.

La première réponse d’une conversation neuve, bien amorcée, est presque toujours plus nette que la quinzième d’un fil encombré.

Demander une synthèse en cours de route

Si vous devez vraiment rester dans le même fil, parce qu’il contient des décisions difficiles à reconstituer, demandez au modèle de résumer tout ce qui a été convenu jusqu’ici. Cela ramène vos règles les plus importantes au premier plan de son attention :

Résume les décisions et les règles que nous avons établies dans cette conversation. Nous utiliserons ce résumé comme référence pour la suite.

Ma variante préférée : demander un résumé de passation, avec tout ce dont une nouvelle conversation aurait besoin pour reprendre le travail. Votre paragraphe d’amorce s’écrit tout seul, et l’option brancher décrite plus haut devient triviale.

Une tâche par conversation

La règle d’or. Ne mélangez pas des sujets sans rapport dans un même fil : vous réfléchissiez à une recette et il vous faut soudain un e-mail pour votre patron ? Ouvrez une nouvelle fenêtre. Plus le fil reste focalisé, plus longtemps il reste utile.

Cette mémoire qui s’estompe n’est pas un bug : c’est ainsi que ces systèmes sont construits. Bien travailler avec l’IA, c’est gérer son attention, pas tester son endurance. Les personnes qui tirent le plus de ces outils ne sont pas celles qui mènent les conversations les plus longues, mais celles qui savent exactement quand cliquer sur Nouvelle conversation.

Pour sentir la différence, faites le test une fois. La prochaine fois qu’une conversation dépasse une quinzaine de messages, guettez le moment où les réponses commencent à passer à côté. Quand il arrive, ouvrez une conversation neuve, rédigez un résumé de deux paragraphes de ce dont vous avez besoin, et comparez cette première réponse aux dernières de l’ancien fil. L’écart suffit généralement à convaincre.

À lire aussi