
Čo automatizovať ako prvé vo firme
Prvú automatizáciu vyberte podľa práce, dát, rizika, vlastníka a možnosti návratu späť. Jeden pilot potom overte skôr, než ho rozšírite.
Tridsiateho júla 2026 znížila OpenAI cenu modelu GPT-5.6 Luna o 80 percent. Vstupný token spadol na 20 centov za milión, výstupný na 1,20 dolára. Terra zlacnela o pätinu. O šesť dní skôr vydal Anthropic Opus 5 za rovnakú cenu, akú mala predchádzajúca generácia, pričom podľa vlastných meraní firmy zvládne viac než dvojnásobok úloh. Google medzitým predstavil Gemini 3.6 Flash, ktorý na porovnateľnú prácu spotrebuje o 17 percent menej výstupných tokenov.
Ak sledujete iba cenníky, vyzerá to ako najlepší mesiac pre firmy, ktoré za AI platia.
Účtovníctvo hovorí niečo iné. Prieskum State of FinOps 2026, do ktorého sa zapojilo 1 192 odborníkov spravujúcich viac než 83 miliárd dolárov ročných výdavkov na cloud, zistil, že 73 percent organizácií prekročilo svoj rozpočet na AI. Priemerný firemný rozpočet na AI pritom medzi rokmi 2024 a 2026 vyrástol z 1,2 milióna na 7 miliónov dolárov ročne.
Ceny klesajú. Účty rastú. Obe veci sú pravdivé naraz a dôvod stojí za pochopenie skôr, než budete schvaľovať ďalší AI projekt.
Za jeden mesiac vydali štyri veľké laboratóriá vlajkové alebo takmer vlajkové modely a k tomu pribudli najväčšie otvorené váhy, aké kedy niekto zverejnil.
Na menšej obrazovke posuňte tabuľku vodorovne.
| Model | Vydanie | Vstup / výstup za 1 M tokenov | Kontext |
|---|---|---|---|
| GPT-5.6 Sol | 9. júla | 5 / 30 USD | 1 M |
| GPT-5.6 Terra | 9. júla, zlacnené 30. júla | 2 / 12 USD | 1 M |
| GPT-5.6 Luna | 9. júla, zlacnené 30. júla | 0,20 / 1,20 USD | 1 M |
| Grok 4.5 | 8. júla | 2 / 6 USD | 500 K |
| Kimi K3 | 16. júla, váhy 27. júla | 3 / 15 USD | 1 M |
| Gemini 3.6 Flash | 21. júla | 1,50 / 7,50 USD | 1 M |
| Claude Opus 5 | 24. júla | 5 / 25 USD | 1 M |
Kimi K3 od Moonshotu má 2,8 bilióna parametrov a je najväčší otvorene dostupný model vôbec. Celý balík váh má okolo 1,56 TB, takže ho vo vlastnej serverovni rozbehne málokto. Podstatné je niečo iné. Modely, ktoré ešte pred rokom patrili do hornej cenovej hladiny, sú dnes v strede tabuľky.
Keď GPT-4 v marci 2023 debutoval, stál vstupný milión tokenov 30 dolárov. Koncom júla 2026 sa dá porovnateľná kvalita kúpiť za 14 centov. To je 214-násobné zlacnenie za 40 mesiacov, teda deflačná krivka, akú podnikový softvér nikdy predtým nezažil.
Napriek tomu rozpočty praskajú. Vysvetlenie nie je v cenníku, ale v tom, ako sa modely dnes používajú.
Chatbot dostane otázku a vráti odpoveď. Jedno volanie, jedna fakturovaná dávka tokenov. Agentické workflow, ktoré spracuje prichádzajúcu faktúru, si vyžiada dokument, klasifikuje ho, vytiahne položky, overí ich voči objednávke, skontroluje rozpor a napíše návrh odpovede. To je pokojne dvadsať volaní na jeden dokument. Rovnaká cena tokenu, dvadsaťnásobná spotreba.
K tomu sa pridávajú uvažovacie modely. Tie pred odpoveďou generujú vnútorné myslenie, ktoré nevidíte, ale platíte zaň ako za výstup. Päťsto viditeľných slov v odpovedi môže mať za sebou desaťtisíce fakturovaných tokenov.
Analytik Jacob Bourne to pre VentureBeat zhrnul stručne. „The era of tokenmaxxing is over. Enterprises have figured out how easy it is to burn tokens without getting value back.“
Prestaňte porovnávať cenu za milión tokenov. Porovnávajte cenu za dokončenú úlohu.
Rozdiel medzi tými dvoma číslami je väčší, než sa zdá, a najlepšie to vidno na zverejnených meraniach z benchmarku SWE-Bench Pro. Grok 4.5 vyrieši priemernú úlohu za 15 954 výstupných tokenov. Opus 4.8 v režime maximálneho úsilia potrebuje 67 020 tokenov.
Na menšej obrazovke posuňte tabuľku vodorovne.
| Model | Cena výstupu za 1 M | Výstupné tokeny na úlohu | Výstup na jednu úlohu |
|---|---|---|---|
| Grok 4.5 | 6 USD | 15 954 | 0,10 USD |
| Opus 4.8 (max) | 25 USD | 67 020 | 1,68 USD |
Cenníkový rozdiel je 4,2-násobný. Rozdiel v spotrebe je tiež zhruba 4,2-násobný. Lenže tie dva násobky sa nesčítajú, ale násobia, takže reálny rozdiel na jednej úlohe je približne sedemnásťnásobný.
Berte to ako ilustráciu mechaniky, nie ako verdikt o modeloch. Sú to publikované benchmarkové čísla, nie naše meranie, a na inej úlohe vyjde poradie inak. Dôležitý je princíp. Spotreba tokenov je druhá polovica ceny a väčšina firiem ju vôbec nesleduje.
Laboratóriá to už vedia. Preto Google pri Gemini 3.6 Flash inzeroval o 17 percent nižšiu spotrebu výstupných tokenov ako hlavné vylepšenie. Nie vyššiu inteligenciu. Menšiu ukecanosť.
Druhá zmena z júla je menej viditeľná a v praxi dôležitejšia. Model už nie je jedna vec s jednou cenou.
Opus 5 prišiel s nastaviteľnou úrovňou úsilia. Nízke, stredné alebo vysoké. Tá istá otázka, ten istý model, iná spotreba aj iná odpoveď. GPT-5.6 Sol dostal rýchly režim, ktorý beží asi 2,5-krát rýchlejšie za dvojnásobnú cenu. Grok 4.5 účtuje inak pod hranicou 200-tisíc tokenov kontextu a inak nad ňou, pričom pri prekročení sa preceňuje celá požiadavka.
Prakticky to znamená, že rozhodnutie „použijeme tento model" už nie je jedno rozhodnutie. Je to model, úroveň úsilia, veľkosť kontextu a spôsob cachovania. Firma, ktorá si to nastaví raz a nechá tak, platí za triedenie e-mailov rovnakým režimom ako za analýzu zmluvy.
Faktúra od poskytovateľa Vám povie, koľko ste minuli. Nepovie Vám, ktorý workflow to minul. Označte volania podľa procesu, ktorý ich vyvolal, a sledujte cenu za spracovaný dokument, za vybavený ticket alebo za pripravenú ponuku. Až toto číslo sa dá porovnať s prácou človeka.
V júli sa zmenilo poradie na cenníku trikrát. Ak je model konštanta rozsypaná po dvadsiatich súboroch, každá zmena je projekt. Ak je to jedna konfiguračná hodnota za rozhraním, je to úprava na desať minút. Toto je najlacnejšia poistka, akú si viete kúpiť, a stojí Vás jedno popoludnie.
Bez tridsiatich až päťdesiatich reálnych prípadov s očakávaným výsledkom je prechod na lacnejší model hazard. S nimi je to otázka jedného merania. Táto sada je zároveň jediná obrana proti tichému zhoršeniu kvality po aktualizácii modelu.
Alert na celkovú mesačnú útratu Vás upozorní, keď je neskoro. Limit na počet volaní a tokenov v jednom behu agenta zastaví slučku, ktorá sa zacyklila, ešte v ten deň. Väčšina drahých prekvapení nie je pomalý rast, ale jedna chyba, ktorá bežala cez víkend.
Cachovaný vstup stojí u väčšiny poskytovateľov zlomok bežnej sadzby. Grok 4.5 účtuje cachovaný vstup za 0,50 dolára namiesto dvoch. Pri agentovi, ktorý v každom kroku posiela ten istý systémový kontext, to nie je detail. A na klasifikáciu, routing či extrakciu polí stačí najlacnejšia trieda modelov, ktorá je dnes takmer zadarmo.
Pre firmu s dvadsiatimi ľuďmi nie je rozdiel medzi piatimi dolármi a dvadsiatimi centami za milión tokenov tým, čo rozhodne o návratnosti projektu. Pri bežnej záťaži ide o desiatky eur mesačne.
Váha je inde. Ak výmena modelu znamená prepísať dvadsať súborov, každé zlacnenie na trhu Vám je nanič, lebo sa k nemu jednoducho nedostanete. Druhá vec je viditeľnosť. Firma, ktorá vie na požiadanie povedať, koľko ju stojí spracovanie jednej faktúry, dokáže to číslo aj stlačiť. Firma, ktorá to nevie, sa o rastúcej spotrebe dozvie až z faktúry.
Trh sa bude hýbať aj naďalej. Za posledný mesiac zlacnela stredná trieda o pätinu, spodná o štyri pätiny a vlajkové modely zdraželi. Firmy, ktoré si postavili AI ako vymeniteľnú súčiastku, na tom zarobia. Firmy, ktoré si vybrali jedného dodávateľa a zabetónovali ho do kódu, budú platiť za rozhodnutie z minulej sezóny.
Ak riešite, ktorý model má zmysel pre konkrétny proces, k tomu sme písali samostatne v článku o multi-model stratégii a o porovnaní GPT-5.6 a Claude Fable 5. Ak Vás zaujíma, ako sa cena tokenov porovnáva s hodinou programátora, to sme rozobrali tu.
V Rise.sk staviame automatizácie a AI workflow tak, aby sa model dal vymeniť bez zásahu do architektúry. Cenu za spracovanú jednotku meriame od prvého dňa. Ak potrebujete zistiť, koľko Vás dnes stojí jeden proces a či sa to dá zlacniť, ozvite sa.

Prvú automatizáciu vyberte podľa práce, dát, rizika, vlastníka a možnosti návratu späť. Jeden pilot potom overte skôr, než ho rozšírite.
GrantAI sleduje grantové výzvy, páruje ich s profilom firmy, pripraví analýzu oprávnenosti a draft žiadosti. Demo a pilot pre grantové tímy.
Poradenské tímy strácajú maržu vtedy, keď každá nová výzva začína ručným čítaním, internou debatou a opakovaným overovaním profilov klientov. V článku ukazujeme, ako GrantAI skracuje grant screening bez toho, aby odstraňoval expertný review.