Proč váš AI coding assistant zapomíná, co právě udělal
Proč AI nástroje pořád zapomínají to důležité
Přiznejme si to. Pokud používáte AI agenty na seriózní vývoj, určitě jste ten moment zažili.
Vrátíte se k projektu další den. Otevřete chat. Požádáte agenta, aby pokračoval tam, kde jste skončili. A pak jen sledujete, jak se zmateně snaží zrekonstruovat, co se vlastně dělo, co selhalo, co fungovalo a co bylo opuštěno.
Že vám to zní povědomě?
Tady je ten háček, o kterém se nemluví dost často: problém není v tom, že by agenti neměli dost paměti. Problém je v tom, že mají špatný typ paměti.
Context versus kontinuita: Podstatný rozdíl
Zamyslete se nad tímhle. Context je všechno, co má agent právě teď k dispozici – soubory, historii chatu, dokumentaci, stažené poznámky. To je užitečné. Kontinuita je to, co vašemu agentovi umožní přijít zítra a přesně vědět, kde věci stojí.
Zní to podobně. Ale není to totéž.
Velké context window umožňuje agentovi pracovat s více informacemi najednou. Ale když ta session skončí, když přepnete nástroj, když se další ráno vrátíte – narazíte na stejnou zeď: co se vlastně dělo? Co se změnilo? Co selhalo? Co jen zdánlivě fungovalo?
Větší context window to nevyřeší. Jen vám dají víc textu k procházení, zatímco pořád míjíte podstatu.
Problém šuplíku plného haraburdí
Instinktivní řešení? Postavit větší úložiště. Delší historii chatu. Větší vector databáze. Komplexní archivy všeho, čeho se agent kdy dotkl.
Videl jsem týmy, které to implementovaly. Působí to mocně. Působí to jako pokrok.
Ale tady je to, co se ve skutečnosti děje: systém se stane velmi drahým šuplíkem na haraburdí. Souhrny zastarávají. Neúspěšné přístupy sedí vedle úspěšných se stejnou vizuální váhou. Agent najde něco, co zní relevantně, ale nikdo neví, jestli je to aktuální, užitečné, nebo jen plausibilní halucinace z minulého týdne.
Když agent potřebuje operačně důvěryhodné informace – proběhl ten příkaz úspěšně? který soubor byl upraven? – dostane sémanticky podobný šum místo toho.
To je horší než žádná paměť.
Jak by měla vypadat skutečná kontinuita
Dovolte mi nakreslit obrázek toho, co skutečná kontinuita vyžaduje.
Místo vágní poznámky „pravděpodobně jsme opravili auth issue" chcete strukturované záznamy, které sledují skutečný operační stav: které soubory byly upraveny, které příkazy běžely, jaký byl výsledek, co zůstává nevyřešené, a co by mělo být další krok.
Tohle není o zapamatování si všeho. Je to o uchování správných faktů v formátu, který přežije hranice session.
Paměťová položka říká: „Udělali jsme pokrok na parseru."
Kontinuální záznam říká: „Parser úloha pozastavena. tokenizer.py upraven. pytest tests/test_parser.py prošel. Celá testovací sada ještě neběžela. Další krok: spustit celou parser testovací skupinu před rozšířením scope."
Rozdíl je jako mezi kolegou, který si vágně pamatuje konverzaci, a tím, který vám předá detailní poznámky s jasnými dalšími kroky.
Co to znamená pro váš workflow
Tady se to dostává k praktickým věcem. Pokud stavíte AI-asistované vývojové workflow – a pokud jste tady, pravděpodobně ano – potřebujete nad touto architekturou přemýšlet od prvního dne.
Statické instrukce o vašem repozitáři jsou cenné. Říkají agentům, jak spouštět testy, kde moduly žijí, jaké konvence dodržovat. Ale jsou statické. Nevědí, že úloha byla přerušena, že validace selhala, nebo že jste zúžili scope uprostřed session.
Potřebujete obojí: stabilní instrukce a měnící se pracovní stav. Jedno bez druhého je neúplné.
Tohle je důvod, proč přístup „větší paměť" pořád selhává. Řeší špatný problém špatným nástrojem. Vector databáze vynikají v sémantickém vyhledávání – nacházení související dokumentace, podobných minulých poznámek, odpovídajících knowledge base chunků. Ale ty nejdůležitější fakta pro pokračování jsou malá, nudná a operační: který příkaz selhal, který soubor byl upraven, který test prošel, co zůstává hotovo.
Skutečná příležitost
Tady je můj pohled: další hranice v AI-asistovaném vývoji nejsou větší modely ani delší contexty. Jsou to lepší handoff systémy.
Stavíme se k světu, kde budou moct coding agenty skutečně pokračovat tam, kde skončily – ne tím, že budou mít víc informací, ale tím, že budou mít ty správné informace strukturované tak, aby přežily hranice session.
To znamená pečlivě přemýšlet o tom, jaký stav zachovat, jak ho strukturovat, a jak ho udělat operačně důvěryhodným místo jen sémanticky plausibilním.
Když přemýšlíme o vibe coding a AI-asistovaném vývoji, je to přesně ten druh infrastruktury, na kterém záleží. Nejde jen o to dát vývojářům výkonné nástroje – jde o to dát jim nástroje, které si skutečně pamatují, co dělaly, když se druhý den ráno vrátíte k práci.
Agenti, kteří vyhrají, nebudou ti s největší pamětí. Budou to ti, u kterých nikdy nebudete muset dělat ten samý orientační tanec dvakrát.
Shrnutí
Příště, až budete znovu vysvětlovat svůj projekt AI agentovi, nesáhněte po větším context window. Zeptejte se sami sebe: dávám mu context, nebo mu dávám kontinuitu?
Context je snadný. Kontinuita je to, na čem záleží.