
Čo automatizovať ako prvé vo firme
Prvú automatizáciu vyberte podľa práce, dát, rizika, vlastníka a možnosti návratu späť. Jeden pilot potom overte skôr, než ho rozšírite.
Koncom júla 2026 vložil Matt Shumer do Claude Code tri odseky textu a nechal to bežať. Vrátila sa mu strieľačka z prvej osoby, ktorá beží v prehliadači. Zhruba 55 000 riadkov JavaScriptu v jedenástich podsystémoch a ani jeden grafický súbor. Každá textúra, každý model, animácia aj zvuk vznikajú z kódu až pri načítaní stránky. Repozitár je verejný pod licenciou MIT, na YouTube je záznam hrania, ak to chcete vidieť v pohybe, a tou istou metódou odvtedy vzniklo niekoľko desiatok hier priamo do prehliadača.
Toto je celý prompt.
I want you to build a first-person shooter at the level of the most recent Call of Duty games. It should be utterly perfect, visually beautiful, with every single thing done at AAA quality—from textures to physics to anything you could think of.
Fan out sub-agents and have sub-agents tackle each one individually so that the game is utterly perfect. You should /loop on each item and have a separate sub-agent check it visually to ensure it looks triple A. That separate sub-agent should be a really harsh critic, and if it doesn't look triple A, it should keep going.
Don't stop until each sub-agent is utterly wowed with the quality when compared with the actual Call of Duty game. It should literally compare them side by side blind and say which one looks better. Do this in ThreeJS. /loop until it's utterly perfect. Fan out sub-agents and ultracode.
Shumer neskôr túto schému pomenoval Gauntlet Loop. Číta sa to ako hádka s počítačom a slová, ktoré robia tú prácu, nie sú „utterly“ ani „perfect“.

Toto vzniklo z jedného promptu. Každá textúra, každý model aj zvuk v zábere sa dopočíta z kódu pri načítaní stránky. V repozitári nie je jediný grafický súbor.
Vlastná snímka zo zdrojového kódu Claude of Duty, licencia MITV súbore README je sekcia s názvom Honest assessment. Je to najužitočnejšia časť celého experimentu.
Jedenásť nezávislých kritikov hodnotilo hotové snímky proti skutočným záberom z Call of Duty. Skóre šlo 3,59, potom 4,14, potom 4,05 a nakoniec 5,05 z desiatich. Dva zábery dosiahli stupeň „close“, ostatné zostali na „amateur“. V každom slepom porovnaní, v každom kole si kritik vybral skutočnú hru.
Nedostatky sú pomenované konkrétne. Ruky vyzerajú ako hranaté kusy, ktoré zbraň nedržia. Povrchy pôsobia ako procedurálny šum, nie ako odfotený materiál. Nepriateľ na diaľku pripomína figurínu. Nepriame osvetlenie je odhad. Hotová verzia beží na notebooku s čipom Apple pri 28 až 30 snímkach za sekundu.

Ruky dostali od kritikov najhoršie známky. Autor ich sám popísal ako hranaté kusy, ktoré zbraň nedržia presvedčivo. Takto vyzerá 5,05 z 10 zblízka.
Vlastná snímka zo zdrojového kódu Claude of Duty, licencia MITSlučka teda prehrala. Zároveň po každom kole vedela povedať číslo aj dôvod, prečo prehrala. To je ten rozdiel, ktorý stojí za kopírovanie. Väčšina práce s AI sa zastaví vo chvíli, keď výsledok prestane pôsobiť trápne, čo je pocit, nie meranie.
Keď z promptu odmyslíme krik, zostanú štyri pokyny.
Prvý pokyn je latka mimo modelu. Nie „AAA kvalita“, ktorú si model dokáže nadefinovať tak nízko, až ju splní. Skutočný záber z Call of Duty, ktorý si nadefinovať nedokáže.
Potom je tu povolenie rozdeliť si prácu. Prompt nemenuje podsystémy. Agent sám rozhoduje, čo sú tie kusy, a práve toto rozhodnutie mu ľudia najčastejšie berú z rúk a spravia ho horšie.
Kritik nie je staviteľ. Dostane cieľ, latku a hotový výstup. Nedostane úvahy staviteľa ani jeho zhrnutie toho, čo urobil. Anthropic túto schému volá evaluator-optimizer a odporúča ju tam, kde existujú jasné hodnotiace kritériá a druhý priechod merateľne pomáha.
Nakoniec povolenie pokračovať. Bez neho sa agent po jednom kole vráti, pretože vracať sa je presne to, na čo je trénovaný.
Pôvodný prompt píše /loop ako bežnú angličtinu vo význame pokračuj. V dnešnom Claude Code majú tie slová presný význam a zámena stojí peniaze.
Príkaz /goal nastaví podmienku dokončenia. Po každom ťahu prečíta malý rýchly model konverzáciu a odpovie, či podmienka platí. Ak nie, Claude začne ďalší ťah namiesto toho, aby vrátil riadenie. To je tá cieľová slučka.
Príkaz /loop spúšťa ďalší ťah po uplynutí časového intervalu. Slúži na opakovanú prácu a sledovanie, nie na brúsenie k latke.
Kľúčové slovo ultracode je zase niečo iné. Napísané priamo v prompte spôsobí, že Claude na tú jednu úlohu napíše a spustí dynamický workflow, teda skript, ktorý na pozadí riadi podagentov. Nastavené cez /effort ultracode spojí najvyššiu úroveň uvažovania s automatickým riadením workflow na celú reláciu. Runtime dovolí naraz šestnásť agentov, na strojoch s málo jadrami menej, a tisíc na jeden beh. Beh, ktorý naplánuje viac než dvadsaťpäť agentov alebo prekročí odhad 1,5 milióna tokenov, vypíše upozornenie. V relácii so zapnutým ultracode sa však neukáže, lebo tým nastavením ste veľké behy už povolili.
Na Gauntlet Loop teda chcete /goal na podmienku zastavenia a ultracode na rozvetvenie.
Vyplňte štyri miesta. Referencia musí byť niečo, čo agent vie reálne otvoriť, spustiť, odfotiť alebo prečítať.
Postav <VEC>, ktorá <ČO MUSÍ ROBIŤ>, na úrovni kvality <POMENOVANÁ REFERENCIA>.
Postup si zvoľ sám.
Rozdeľ prácu na najmenšie kusy, ktoré sa dajú hodnotiť samostatne.
Na každý kus spusti staviteľského podagenta a samostatného kritického podagenta.
Kritik dostane cieľ, latku a hotový výstup. Nedostane úvahy staviteľa ani jeho
zhrnutie. Pozrie si skutočný výstup, porovná ho naslepo s <POMENOVANÁ REFERENCIA>,
povie, ktorý je lepší, a pomenuje jednu najväčšiu zostávajúcu medzeru aj s dôkazom.
Ak prehráme, vráť tú medzeru staviteľovi a choď znova.
Skonči, keď kritik vyberie náš výstup, alebo po <N> kolách, alebo keď kolo zlepší
skóre o menej než <X>. Po každom kole vypíš skóre a najväčšiu medzeru.
Prompt pre kritika je tá časť, ktorú ľudia preskakujú. Napísaný zle vyrobí staviteľa s druhým názorom. Napísaný poriadne vyzerá takto.
Hodnotíš výstup, ktorý si nestaval. Nedostaneš históriu ani vysvetlenie a nemáš
si o ne pýtať.
Náš výstup: <CESTA ALEBO SNÍMKA>
Referencia: <CESTA ALEBO SNÍMKA>
Ohodnoť náš výstup od 1 do 10 voči referencii. Potom odpovedz na jednu otázku.
Keby zákazník videl oba bez popisiek, ktorý si vyberie a podľa akého viditeľného
detailu sa rozhodne?
Pomenuj jednu najväčšiu medzeru. Ukáž na dôkaz. Nevymenúvaj desať drobností
a nezmäkčuj skóre preto, že tá práca vyzerá ťažko.
Pôvodný prompt stále funguje a oplatí sa prečítať tak, ako bol napísaný. Utiahnutejšia verzia, ktorá zlyháva menej často, vyzerá takto.
ultracode Postav v Three.js prehliadačovú motokárovú hru na vizuálnej úrovni
Mario Kart 8 Deluxe. Architektúru si zvoľ sám.
Rozdeľ to na trať, jazdný model, materiály, efekty, zvuk a HUD. Každému daj
staviteľského podagenta. Po každom kole spusti samostatného kritického podagenta,
ktorý odfotí našu hru, porovná ju naslepo s referenčnými zábermi, dá jej známku
1 až 10 a pomenuje jednu najväčšiu vizuálnu medzeru.
Pracuj vždy na jednom previazanom systéme, nie na všetkých šiestich naraz.
Osvetlenie, tonemapping a materiály sú jeden systém, nie tri.
/goal každý kritik dá 7 alebo viac, alebo prejdú štyri kolá so zlepšením
menším než 0,3
Ten riadok o jednom previazanom systéme nie je ozdoba. Dôvod je v predposlednej kapitole.
Na tejto metóde nie je nič špecifické pre grafiku. Potrebuje výstup, ktorý sa dá preskúmať, a referenciu, ktorú viete pomenovať. Cenníková stránka to spĺňa. Štvrťročná správa nie, pokiaľ si najprv nepoviete, ako vyzerá dobrá.
Dva prompty, ktoré fungujú.
ultracode Prepíš našu cenníkovú stránku v src/app/cennik tak, aby si prvý
návštevník vedel vybrať balík do tridsiatich sekúnd. Latkou je cenníková stránka
Stripe a cenníková stránka Linear. Obe sú verejné, tak si ich stiahni a prečítaj.
Rozdeľ prácu na štruktúru, porovnanie balíkov, texty, prácu s námietkami
a mobilné zobrazenie.
Po každom kole samostatný kritický podagent načíta v prehliadači našu stránku aj
obe referenčné, pri šírke 390 px a 1440 px, so snímkami obrazovky. Naše texty
predtým nevidel. Odpovie na tri otázky. Ktorá stránka vysvetlí voľbu najrýchlejšie.
Kde sa na našej stránke čitateľ zastaví a musí premýšľať. Ktorá jedna zmena zavrie
najväčšiu časť medzery.
Ceny nemeň a nevymýšľaj funkcie, ktoré nepredávame.
/goal kritik vyberie našu stránku pred oboma referenciami v tridsaťsekundovom
teste, alebo prejde šesť kôl
A jeden, v ktorom nie je ani riadok kódu.
Napíš ponukový dokument na našu službu automatizácie dokumentov, pre slovenskú
firmu s dvadsiatimi zamestnancami, ktorá spracúva faktúry ručne.
Latkou je stránka s cenami Basecamp a príručka Stripe Atlas, obe verejné.
Rovnaký test. Zaneprázdnený majiteľ to prečíta raz a vie, čo dostane, čo to stojí
a čo bude nasledovať.
Rozdeľ to na pomenovanie problému, čo dodáme, cenu, harmonogram a námietky.
Samostatný kritický podagent prečíta iba hotový dokument. Moje poznámky nevidí.
Odpovie, čo by čitateľ stále nevedel, čomu by neveril a pri ktorom odseku by
prestal čítať. Ohodnotí to voči referenčným dokumentom.
Prepíš najslabšiu časť. Opakuj, kým kritik prestane nachádzať odsek, pri ktorom
by čitateľ skončil, alebo kým neprejde päť kôl.
Ten istý repozitár zaznamenal zistenie, ktoré protirečí promptu, čo ho vyrobil. Je to najcennejšia vec na celom experimente.
Paralelné rozvetvenie prehralo. Tri kolá po šiestich agentoch, každý vlastnil jeden adresár, posunuli skóre o 0,46 a počet chýb kaziacich obraz nechali vyšší, než bol na začiatku, teda 60, potom 47, potom 66. Tonemapping, obloha a nepriame svetlo sú jeden previazaný systém a samostatní agenti si navzájom rozbíjali predpoklady. Jeden sekvenčný priechod s jedným vlastníkom na jednu previazanú oblasť posunul skóre o celý bod a znížil počet chýb zo 66 na 26.
Rozvetvujte cez veci, ktoré sa nedotýkajú. Cez veci, ktoré sa dotýkajú, choďte postupne.

Tá istá ulica v noci. Nepriame svetlo je odhad, nie skutočné globálne osvetlenie, a práve to patrí medzi pomenované medzery voči latke, ktorú si model postavil.
Vlastná snímka zo zdrojového kódu Claude of Duty, licencia MITZa pomenovanie stoja ešte tri spôsoby zlyhania. Latka, ktorú si agent nadefinuje sám, nie je latka, takže „profesionálna kvalita“ neplatí a „lepšie než táto konkrétna stránka“ platí. Kritik, ktorý dostane zhrnutie od staviteľa, hodnotí to zhrnutie, nie výstup. A slučka bez stropu beží, kým si toho nevšimne rozpočet. James Altucher spustil pôvodný prompt na zhruba desať hodín a 1,3 milióna tokenov. Anthropic pri vlastnom výskumnom systéme s viacerými agentmi nameral asi pätnásťnásobok tokenov oproti bežnej konverzácii a odporúča tú schému len tam, kde hodnota úlohy tie náklady unesie.
Slučka sa sama nezastaví. Podmienkou zastavenia ste Vy.
V Rise.sk beží verzia s bránou na review. Agent stavia, čerstvý agent bez histórie stavby kontroluje a človek merguje. Ten postup sme popísali samostatne, rovnako ako súvisiacu otázku, kam v AI vývoji patrí človek.
Gauntlet Loop je tá istá schéma namierená na kvalitu namiesto na správnosť. Oplatí sa vtedy, keď sa výstup dá preskúmať, keď existuje pomenovaná referencia a keď „dosť dobré“ ticho niečo stojí. Neoplatí sa vtedy, keď nikto nerozhodol, čo znamená dobré.
Ak riešite, ktorý z Vašich procesov by takúto slučku uniesol, staviame AI automatizácie a workflow a robíme technologické audity, ktoré sa začínajú presne touto otázkou.

Prvú automatizáciu vyberte podľa práce, dát, rizika, vlastníka a možnosti návratu späť. Jeden pilot potom overte skôr, než ho rozšírite.
MCP pripája agenta k nástrojom a dátam. A2A prepája samostatných agentov. Pozrite si, kde protokoly dávajú zmysel a čo musí zabezpečiť firma.
Každý hovorí o AI agentoch. Väčšina firiem ho však nepotrebuje, stačí im dobre nastavená automatizácia. Tu je návod, ako sa rozhodnúť.