Trois heures après le début d'une session, Claude Code commence à répéter des questions auxquelles vous avez déjà répondu. Il réintroduit une convention de nommage que vous avez supprimée il y a une heure. Il « corrige » un fichier qu'il a cassé d'une manière que vous n'aviez jamais demandée. Rien n'a planté. Aucune erreur n'est apparue. Le modèle a simplement commencé à déprioritiser silencieusement les parties de la conversation qui importaient.
Ce n'est pas un bug que vous pouvez corriger. C'est ainsi que fonctionnent les fenêtres de contexte, et c'est la raison principale pour laquelle les sessions de codage IA passent de brillantes à frustrantes sans avertissement.
Nous travaillons avec des startups qui embauchent des ingénieurs qui construisent avec ces outils chaque jour, et les équipes qui tirent le plus parti de Claude Code ne sont pas celles avec les invites les plus ingénieuses. Ce sont celles qui ont arrêté de traiter le contexte comme infini et ont commencé à l'ingéniérer. L'outil au cœur de ce changement est un simple fichier Markdown appelé CLAUDE.md.
Ce Qui Se Passe Réellement Quand Claude Code « Oublie »
Claude Code est livré avec une fenêtre de contexte de 200 000 jetons par défaut, avec une option de 1 million de jetons disponible sur les nouveaux modèles. Cela semble énorme, mais une session nouvelle consomme déjà des milliers de jetons avant que vous ayez tapé un mot : l'invite système, les compétences chargées et tous les schémas du serveur MCP consomment d'abord le budget. Ajoutez un fichier CLAUDE.md, quelques intégrations d'outils et quelques lectures de fichiers, et une part importante de la fenêtre est déjà utilisée.
Le problème plus profond n'est pas de manquer d'espace. C'est ce qui se passe bien avant que la fenêtre soit pleine. Plusieurs équipes d'ingénierie travaillant avec Claude Code sont indépendamment arrivées à la même conclusion : la qualité de la sortie commence à se dégrader une fois que l'utilisation du contexte dépasse environ 20 à 40 pour cent, bien avant qu'une limite stricte soit atteinte. Les mécanismes d'attention pondèrent plus fortement les jetons récents à mesure qu'une conversation se développe, donc les instructions du début de la session perdent silencieusement leur influence même si elles sont techniquement toujours « en mémoire ».
Cela a une importance pratique. Une session de trois heures qui commence par une tâche claire et n'est jamais vérifiée produira du code visiblement pire à la deuxième heure, non pas parce que le modèle est devenu moins intelligent, mais parce que les approches abandonnées, les erreurs surpassées et les détours exploratoires sont tous toujours dans la fenêtre, diluant le signal qui compte vraiment.
La Dégradation du Contexte Est Réelle et Mesurée
Ce n'est pas une particularité spécifique à Claude. Un benchmarking indépendant de Chroma a testé 18 modèles de pointe, y compris Claude Opus, et a constaté que chacun d'entre eux perd en précision à mesure que l'entrée augmente, dans certains cas tombant de 95 pour cent à 60 pour cent au-delà d'un certain seuil. Les chercheurs appellent cela la « dégradation du contexte », et cela se manifeste par un effet « perdu au milieu » : les modèles traitent bien le début et la fin d'un long contexte, mais survolent le milieu, ce qui est exactement là où vos décisions architecturales d'il y a 40 minutes ont tendance à se situer.
Pour un fondateur ou un responsable de l'ingénierie, le constat est brutal : une fenêtre de contexte plus grande n'est pas la même chose qu'une fenêtre plus utilisable. Les nouveaux modèles peuvent techniquement lire un million de jetons, mais les tests du monde réel montrent des taux de compréhension très différents à cette échelle, c'est pourquoi une session propre et bien gérée de 200 000 jetons surpasse fréquemment une session surchargée de 1 million.
Ce Que CLAUDE.md Corrige Réellement
CLAUDE.md est un fichier Markdown que Claude Code charge automatiquement au début de chaque session. Pensez-y comme un mémoire d'intégration permanent pour un entrepreneur sans mémoire du jour précédent. Cela ne rend pas le modèle plus intelligent. Cela empêche le modèle de regretter les choses que vous avez déjà décidées : quelle commande de test exécuter, quel dossier est interdit, quel motif utiliser à la place de celui par défaut.
Sans lui, chaque session recommence à zéro, et vous vous retrouvez à retaper la même correction pendant une semaine. Avec lui, cette correction devient une règle permanente que le modèle lit avant de faire quoi que ce soit d'autre.
Comment Écrire un CLAUDE.md Qui Tient Réellement
Limitez-vous à moins de 200 lignes. Les modèles de pointe suivent de manière fiable environ 150 à 200 instructions avant que l'adhésion ne commence à glisser, et l'invite système de Claude Code lui-même utilise déjà une partie de ce budget.
Commencez par des commandes, pas de prose. Les invocations exactes de construction, de test et de vérification de lintage sont les lignes de plus grande valeur du fichier.
Pointez, ne collez pas. Référencez le chemin du fichier au lieu de coller son contenu dans le fichier. Chaque ligne que vous collez est une taxe sur chaque session future.
Ne dupliquez jamais le linteur. Si un formateur applique déjà une règle de style automatiquement, ne dépensez pas l'attention du modèle à la réexpliquer.
Élaguez impitoyablement. Un CLAUDE.md qui s'est transformé en documentation est un que le modèle a commencé à ignorer au milieu.
Utilisez /clear entre les tâches sans rapport, et vérifiez toutes les 45 à 60 minutes lors de longues sessions au lieu de laisser une conversation s'exécuter pendant des heures sans surveillance.
FAQ : Contexte, CLAUDE.md et Embauche de Personnes Qui Comprennent Cela
Q. Une fenêtre de contexte plus grande résout-elle le problème d'oubli ?
Non. Une fenêtre plus grande donne au modèle plus d'espace pour conserver les informations, mais la compréhension de lecture réelle à cette échelle varie toujours énormément entre les modèles. Gérer ce qui entre dans la fenêtre est plus important que sa taille.
Q. CLAUDE.md est-il la même chose que la documentation ?
Non. La documentation est pour les humains qui survolent à leur propre rythme. CLAUDE.md est chargé en entier chaque session, qu'il soit pertinent pour la tâche actuelle ou non, il doit donc être court, universellement vrai et axé sur les commandes.
Q. Comment savons-nous si un candidat comprend vraiment cela, par rapport au simple fait de connaître la syntaxe ?
Demandez-leur de vous montrer un CLAUDE.md qu'ils ont écrit pour un vrai projet, et demandez ce qu'ils ont coupé et pourquoi. Les ingénieurs qui ont expérimenté la dégradation du contexte en production parlent spécifiquement des décisions d'élagage. Les ingénieurs qui ne l'ont pas fait n'ont tendance pas à parler du fichier en abstrait.
Q. Où trouvons-nous des ingénieurs qui fonctionnent déjà de cette façon ?
C'est de plus en plus une compétence de base plutôt qu'une spécialité, mais elle est toujours inégale sur le marché. C'est l'une des choses que nous examinons directement lors du contrôle des développeurs pour les clients de MyNextDeveloper. C'est un bon indicateur de la façon dont quelqu'un travaille réellement avec les outils IA au jour le jour, pas seulement comment ils en parlent.
Points Clés À Retenir
Claude Code ne tombe pas en panne avec une erreur lorsque le contexte se dégrade. Il tombe en panne silencieusement, avec une sortie subtil moins bonne.
La qualité commence à chuter à 20 à 40 pour cent d'utilisation du contexte, bien avant que la fenêtre ne soit pleine.
La dégradation du contexte est mesurée par le comportement multi-modèles, pas un défaut spécifique à Claude.
CLAUDE.md corrige le problème d'oubli en transformant les corrections répétées en règles permanentes chargées à chaque session.
Les meilleurs fichiers CLAUDE.MD sont courts, axés sur les commandes et font référence aux fichiers au lieu d'être collés.
Tout Mettre Ensemble
Les longues sessions de codage IA ne tombe pas en panne parce que le modèle s'est détérioré au milieu de la conversation. Elles tombe en panne parce que personne ne gérait ce que le modèle tenait. Un CLAUDE.md serré, une habitude d'effacer le contexte entre les tâches, et des ingénieurs qui réfléchissent déjà de cette façon transforment un après-midi frustrant en un après-midi véritablement rapide.
Cette dernière partie est celle que la plupart des équipes sous-estiment. Les outils sont faciles à copier. Savoir comment les utiliser bien ne l'est pas. Si vous construisez une équipe où l'ingénierie assistée par IA est la norme plutôt que l'exception, c'est exactement le type de jugement que nous vérifions chez MyNextDeveloper lorsque nous appairons les fondateurs avec le meilleur niveau de talents en logiciels et IA.
TL;DR
Claude Code ne tombe pas en panne quand il oublie ; il se dégrade simplement silencieusement, produisant une sortie pire bien avant que la fenêtre de contexte ne se remplisse réellement. La recherche montre que chaque modèle de pointe, y compris Claude, perd en précision à mesure que l'entrée augmente, un phénomène connu sous le nom de « dégradation du contexte ». Une fenêtre de contexte plus grande ne corrige pas cela ; la compréhension à l'échelle varie énormément quelle que soit la taille. CLAUDE.md résout le vrai problème en transformant les corrections répétées en un fichier court et permanent axé sur les commandes que le modèle lit à chaque session. Le meilleur correctif combine un CLAUDE.md maigre avec des habitudes disciplinées telles que l'effacement du contexte entre les tâches et la vérification des points pendant les longues sessions.
Vous Cherchez À Construire Une Équipe Technologique Performante En Télétravail ?
Découvrez MyNextDeveloper, une plateforme où vous pouvez trouver les 3 % meilleurs d'ingénieurs logiciels qui sont profondément passionnés par l'innovation. Nos solutions de talents logiciels personnalisées, dédiées et approfondies offrent une solution complète pour tous vos besoins en logiciels.
Visitez notre site web pour découvrir comment nous pouvons vous aider à assembler votre équipe parfaite.



