Den stille byrde i din AI: Hvorfor CLAUDE.md langsomt fortærer dit repository
Når dokumentation bliver til digitalt rod
Forestil dig dette: Du starter et nyt projekt med en ren CLAUDE.md-fil. Et par nyttige tips. Nogle kontekstnoter. En advarsel om det mærkelige edge case i din authentication-flow. Måneder senere åbner du filen, og den ligner en roman fyldt med modstridende instruktioner, forældede påmindelser og desperate bilag, som ingen rigtig forstår længere.
Det er ikke kun dig. Det er et universelt fænomen.
De nøgne tal
En forskningsanalyse af 247.694 instruktioners levetid på tværs af 1.867 repositories afslører et overraskende mønster: agentiske prompts vokser ikke bare – de vokser uden grænser, mere end tredobler sig over deres levetid (+226%). I gennemsnit tilføjer disse filer +4,9 netto-instruktioner med hver eneste commit. Filen skrumper aldrig. Den ekspanderer kun.
Men det mest fascinerende er: jo ældre en instruktion bliver, jo mindre sandsynligt er det, at den bliver slettet. Data viser en log-hazard på -0,032 per commit – altså bliver instruktioner stadigt mere udødelige, jo længere de har ligget der. Det er ikke fordi, ingen vil rydde op – det er fordi, ingen ved, om de trygt kan fjerne noget som helst.
Problemet med eksponentiel tænkning
Hvorfor sker det her? Forskerne kalder det "katastrofal hukommelse" – det modsatte af det velkendte "katastrofale glemmer"-problem i machine learning. Men du behøver ikke en ph.d. for at forstå mekanismen.
Tænk på omkostningen: at tilføje en ny instruktion er billigt. Du ser et problem, skriver en løsning, går videre. Den umiddelbare pris er lav, og den oplevede værdi er klar.
Men at fjerne en instruktion? Det er en helt anden snage. Du skal forstå hvert sted, hvor den instruktion måske betyder noget. Du skal reasone over interaktioner med alle de andre instruktioner. Du skal verificere, at fjernelsen ikke ødelægger noget subtilt og vigtigt. Forskerne beregnede denne kognitive omkostning til O(2^|D|) i en prompt med |D| instruktioner – altså eksponentielt voksende.
Så udviklere gør, hvad rationelle mennesker gør: de stopper med at prøve. Nye instruktioner bliver tilføjet. Gamle forbliver. Filen vokser.
Kommentarer: Den oversete helt
Her bliver forskningen virkelig spændende. Løsningen er hverken bedre prompting-teknikker eller klogere modeller. Det er noget, udviklere har brugt siden programmeringens barndom: kommentarer.
Forskerne tog en interessant tilgang – de inverterede IFEval, en standard benchmark, for at skabe "verifiable worlds", hvor de optimale prompts faktisk er kendte. Da de tilføjede kommentarer med latent reasoning til prompts, faldt den ekscessive instruktionsvækst fra +211,3% til blot +1,4%.
Det er en reduktion på 99,3%.
Men den virkelige kicker? Disse kommentarer kontrollerede ikke bare væksten – de forbedrede den faktiske instruction-following performance med op til 23,1% på virkelige opgaver. Kommentarer er ikke bare organistorisk rod. De er bærende strukturer, der hjælper AI-assistenter med at reasone korrekt om kontekst.
Hvorfor det betyder noget nu
Vi lever i en fundamental forskydning af, hvad "kode" betyder. Forskerne stiller et provokerende spørgsmål: "Hvis engelsk er den nye kode, hvorfor har vi så ikke kommentarer endnu?"
Det er et fair point. I årtier har udviklere forstået, at kode uden kommentarer er teknisk gæld. Kommentarer forklarer "hvorfor", ikke bare "hvad". De fanger intent, edge cases og institutionel viden, som ikke kan udledes af syntaksen alene.
Men i vores hast for at overlade mere og mere til AI-kodningsassistenter har vi behandlet naturlige sprog-instruktioner, som om de var noget andet. Vi skriver imperativer – gør dette, gør ikke dat, husk at tjekke X – uden at forklare vores reasoning.
Resultatet er det, vi ser i de eksploderende CLAUDE.md-filer: instruktioner, som ingen rigtig forstår, der måske konflikter med hinanden, og som vokser uden nogen mekanisme til rationalisering.
Vejen fremad
Hvis du vedligeholder en CLAUDE.md eller lignende agentisk prompt-fil, så er her, hvad forskningen antyder:
Kommentér dine instruktioner, ikke kun din kode. Forklar, hvorfor en regel eksisterer. Dokumentér edge cases. Fang reasoningen bag beslutninger.
Omfavn periodisk rationalisering. Stop med bare at tilføje – omskriv. Forskerne bemærker eksplicit, at total omskrivninger er en af de eneste ting, der stopper væksten.
Behandl dine AI-instruktioner som onboarding-dokumentation. Ville du give en ny udvikler en 400-linjes fil med udifferentierede regler? Din AI-assistent fortjener samme klarhed.
Trajektet vi er på, er ikke bæredygtigt. Hvert nyt projekt starter med gode intentioner og ender med en uvedligeholdelig rod. Men rettelsen er måske simplere, end vi troede: skriv til mennesket (eller AI'en), der læser dine instruktioner om seks måneder, ikke kun til den, der besvarer dit spørgsmål i dag.
Kommentarer er ikke rod. De er arkitekturen bag forståelse.