AI agenti, kteří odvedou práci, ne demo
Složitější úkol nedělá jeden prompt v chatu, ale několik specializovaných agentů s rolemi: průzkum, implementace, kontrola. Nad tím dlouhodobá paměť, aby se stejná věc neřešila podruhé.
Firma AI vyzkouší, první týden je nadšení a po měsíci se to odloží. Důvod bývá pořád stejný: jeden dlouhý chat zvládne ukázku, ale ne provozní práci. Dojde mu kontext, zapomene rozhodnutí z minula a nikdo výstup nekontroluje dřív, než se použije.
Pracuju proto jinak. Úkol rozdělím mezi agenty s jasně vymezenou rolí a hranicemi: jeden zmapuje terén a nesahá na kód, druhý provede změnu, třetí ji zkontroluje proti zadání dřív, než se cokoli nasadí. Nad tím běží dlouhodobá paměť nad vektorovou databází, takže si nástroje pamatují rozhodnutí, pasti a slepé uličky napříč sezeními. Co se smí nasadit bez potvrzení člověka, je součástí zadání, ne dobré vůle modelu.
Výsledek je práce, která se dá zkontrolovat a zopakovat. Tenhle web, doplňky i většina automatizací, které dodávám, vznikly přesně takhle, takže to není teorie z konference.