Přestali jsme číst logy - ale stále opravujeme problémy dříve, než si jich uživatelé všimnou
Anotace
Když udržujete dlouhodobý projekt, nejspíš máte logy. My jich máme opravdu hodně – tisíce a tisíce denně z různých částí systému. Tyto logy jsme filtrovali a každý den ručně kontrolovali. Člověk je rychle prošel, vyhodnotil, co se zdá podezřelé, a případné problémy eskaloval. Fungovalo to skvěle – dařilo se nám odhalovat a opravovat chyby ještě dříve, než je nahlásili uživatelé.
Jenže jako správně líný vývojář jsem nikdy neměl v plánu dělat tohle ručně navždy. Proto jsem každý týden věnoval pár hodin tomu, abych si pomocí vibe codingu vytvořil dokonalé řešení, které mě nahradí.
Dnes máme automatizovanou pipeline využívající LLM, která sbírá logy z frontendu, API i všech neúspěšných volání do služeb třetích stran, normalizuje je, propojuje chyby z frontendu s chybami v backendu s ohledem na obě kódové základny, udržuje historii incidentů, správně eskaluje nové problémy, potlačuje známý šum a každé ráno doručí do našeho Slacku lepší report, než bych vytvořil já sám.
A to nejlepší? Implementace je mnohem jednodušší, než byste čekali, řešení je mnohem determinističtější, než se zdá a jeho provoz stojí výrazně méně, než byste předpokládali.