
Mit automatizáljon először egy kisvállalatban
Az első automatizálást a munka, az adatok, a kockázat, a felelős és a visszaállíthatóság alapján válassza ki. Bővítés előtt egy pilotot mérjen meg.
Aki csak az árlistákat nézi, a valaha volt legjobb hónapot látja azoknak a cégeknek, amelyek fizetnek az AI-ért.
A könyvelés mást mond. A State of FinOps 2026 felmérés, amelyben 1192 szakember vett részt, együtt több mint 83 milliárd dollár éves felhőköltést kezelve, azt találta, hogy a szervezetek 73 százaléka túllépte az AI-költségkeretét. Ugyanebben az időszakban az átlagos vállalati AI-büdzsé a 2024-es évi 1,2 millió dollárról 2026-ra 7 millióra nőtt.
Az árak esnek. A számlák nőnek. Mindkettő egyszerre igaz, és érdemes megérteni az okát, mielőtt jóváhagyja a következő AI-projektet.
Harminc nap alatt négy nagy labor adott ki zászlóshajó vagy majdnem zászlóshajó modellt, és mellettük megjelentek a valaha publikált legnagyobb nyílt súlyok is.
Kisebb képernyőn a táblázat vízszintesen görgethető.
| Modell | Megjelenés | Bemenet / kimenet 1 M tokenenként | Kontextus |
|---|---|---|---|
| GPT-5.6 Sol | július 9. | 5 / 30 USD | 1 M |
| GPT-5.6 Terra | július 9., árcsökkentés július 30. | 2 / 12 USD | 1 M |
| GPT-5.6 Luna | július 9., árcsökkentés július 30. | 0,20 / 1,20 USD | 1 M |
| Grok 4.5 | július 8. | 2 / 6 USD | 500 E |
| Kimi K3 | július 16., súlyok július 27. | 3 / 15 USD | 1 M |
| Gemini 3.6 Flash | július 21. | 1,50 / 7,50 USD | 1 M |
| Claude Opus 5 | július 24. | 5 / 25 USD | 1 M |
A Moonshot Kimi K3 modellje 2,8 billió paraméterrel a legnagyobb nyíltan elérhető modell. A teljes súlycsomag nagyjából 1,56 TB, saját szerverteremben tehát kevesen futtatják. A lényeg máshol van. Azok a modellek, amelyek egy éve még a felső árszinten álltak, ma a táblázat közepén ülnek.
Amikor a GPT-4 2023 márciusában indult, egymillió bemeneti token 30 dollárba került. 2026 július végén hasonló minőség 14 centért kapható. Ez negyven hónap alatt 214-szeres árzuhanás, olyan deflációs görbe, amilyet a vállalati szoftver korábban soha nem látott.
A költségkeretek mégis szétrepednek. A magyarázat nem az árlistában van, hanem abban, ahogyan a modelleket ma használjuk.
Egy chatbot kap egy kérdést és ad egy választ. Egy hívás, egy kiszámlázott tokenadag. Egy ügynöki munkafolyamat, amely egy beérkező számlát dolgoz fel, lekéri a dokumentumot, osztályozza, kiszedi a tételeket, összeveti a megrendeléssel, megjelöli az eltérést és megfogalmaz egy választ. Ez könnyen húsz hívás egyetlen dokumentumra. Ugyanaz a tokenár, húszszoros fogyasztás.
Ehhez jönnek a gondolkodó modellek. Ezek a válasz előtt belső gondolatmenetet generálnak, amit Ön soha nem lát, de kimeneti áron mindig kifizet. Ötszáz látható szó mögött több tízezer kiszámlázott token állhat.
Jacob Bourne elemző a VentureBeatnek tömören fogalmazott. „The era of tokenmaxxing is over. Enterprises have figured out how easy it is to burn tokens without getting value back.“
Hagyja abba a millió tokenenkénti ár összehasonlítását. Hasonlítsa össze a befejezett feladat árát.
A két szám közötti különbség nagyobb, mint amekkorának látszik, és a SWE-Bench Pro publikált mérései tisztán mutatják. A Grok 4.5 egy átlagos feladatot 15 954 kimeneti tokenből old meg. Az Opus 4.8 maximális erőfeszítésű módban 67 020 tokent igényel.
Kisebb képernyőn a táblázat vízszintesen görgethető.
| Modell | Kimeneti ár 1 M-ért | Kimeneti token feladatonként | Kimenet egy feladatra |
|---|---|---|---|
| Grok 4.5 | 6 USD | 15 954 | 0,10 USD |
| Opus 4.8 (max) | 25 USD | 67 020 | 1,68 USD |
Az árlista 4,2-szeres különbséget mutat. A fogyasztás szintén nagyjából 4,2-szereset. Csakhogy ez a két szorzó nem összeadódik, hanem összeszorzódik, így a tényleges feladatonkénti különbség körülbelül tizenhétszeres.
Ezt a mechanizmus szemléltetéseként vegye, ne a modellekről szóló ítéletként. Publikált benchmarkszámokról van szó, nem saját mérésről, és más terhelésen a sorrend felborul. Az elv marad. A tokenfogyasztás az ár másik fele, és a legtöbb cég egyáltalán nem követi.
A laborok ezt már tudják. A Google a Gemini 3.6 Flash bejelentését 17 százalékkal alacsonyabb kimeneti tokenfogyasztással vezette fel, nem magasabb intelligenciával. Kevesebb beszéd, nem több gondolkodás.
A július második elmozdulása csendesebb, a gyakorlatban viszont fontosabb. Egy modell már nem egyetlen dolog egyetlen áron.
Az Opus 5 állítható erőfeszítési szinttel érkezett, alacsony, közepes vagy magas fokozattal. Ugyanaz a kérdés, ugyanaz a modell, más fogyasztás és más válasz. A GPT-5.6 Sol kapott egy gyors üzemmódot, amely körülbelül 2,5-szer gyorsabban fut kétszeres áron. A Grok 4.5 másképp számláz 200 ezer token kontextus alatt és felett, a határ átlépésekor pedig az egész kérés átárazódik.
Gyakorlatilag ez azt jelenti, hogy a „ezt a modellt használjuk" mondat már nem egy döntés. Modell, erőfeszítési szint, kontextusméret és gyorsítótárazási stratégia együtt. Aki ezt egyszer beállítja és otthagyja, szerződéselemzési tarifán fizeti az e-mailek szortírozását.
A szolgáltató számlája megmondja, mennyit költött. Azt nem mondja meg, melyik munkafolyamat költötte el. Címkézze a hívásokat a kiváltó folyamat szerint, és kövesse a feldolgozott dokumentumra, a lezárt ticketre vagy az elkészült ajánlatra jutó költséget. Csak ez a szám tehető egy emberi óradíj mellé.
Csak júliusban háromszor változott a sorrend. Ha a modell neve húsz fájlban szétszórt konstans, minden váltás projekt. Ha egyetlen konfigurációs érték egy interfész mögött, tízperces módosítás. Ez a legolcsóbb biztosítás a piacon, és egy délutánjába kerül.
Harminc-ötven valós eset és elvárt eredmény nélkül az olcsóbb modellre váltás szerencsejáték. Velük egyetlen mérés kérdése. Ugyanez a készlet az egyetlen védelem a csendes minőségromlás ellen, amikor a szolgáltató Ön alatt frissíti a modellt.
A havi összköltésre beállított riasztás akkor szól, amikor már késő. Az egy ügynökfutáson belüli hívás- és tokenkorlát még aznap megállítja a végtelen ciklust. A drága meglepetések többsége nem lassú növekedés, hanem egyetlen hiba, amely átfutott a hétvégén.
A gyorsítótárazott bemenet a legtöbb szolgáltatónál a normál díj töredéke. A Grok 4.5 két dollár helyett 0,50 dollárért számlázza. Egy ügynöknél, amely minden lépésben ugyanazt a rendszerkontextust küldi el, ez nem kerekítési hiba. Osztályozásra, útválasztásra és mezőkinyerésre pedig elég a legolcsóbb modellosztály, amely ma már szinte ingyen van.
Egy húszfős cégnél nem az öt dollár és a húsz cent közötti különbség dönti el egy projekt megtérülését. Szokásos terhelésnél havi néhány tíz euróról van szó.
A súly máshol van. Ha egy modellcsere húsz fájl átírását jelenti, semmit nem ér Önnek a piaci árcsökkenés, mert egyszerűen nem jut hozzá. A másik dolog a láthatóság. Az a cég, amelyik kérésre meg tudja mondani, mibe kerül egy számla feldolgozása, le is tudja szorítani ezt a számot. Amelyik nem tudja, a növekvő fogyasztásról a számlából értesül.
A piac tovább mozog. Egyetlen hónap alatt a középkategória egyötödével, az alsó négyötödével olcsóbb lett, a zászlóshajók pedig drágultak. Aki cserélhető alkatrészként építette be az AI-t, azon nyer. Aki egyetlen szállítót választott és beleöntötte a kódba, továbbra is a múlt szezon döntéséért fizet.
A Rise.sk-nál úgy építjük az automatizálást és az AI-munkafolyamatokat, hogy a modell az architektúra érintése nélkül cserélhető legyen. A feldolgozott egységre jutó költséget az első naptól mérjük. Ha szeretné megtudni, mibe kerül ma egy folyamat és olcsóbbá tehető-e, írjon nekünk.

Az első automatizálást a munka, az adatok, a kockázat, a felelős és a visszaállíthatóság alapján válassza ki. Bővítés előtt egy pilotot mérjen meg.
A GrantAI figyeli a pályázati felhívásokat, összepárosítja azokat a cégprofilokkal, jogosultsági elemzést készít, és megfogalmazza a pályázati anyagokat. Demó és pilot pályázati csapatoknak.
A tanácsadó csapatok árrést veszítenek, amikor minden új felhívás kézi olvasással, belső vitával és a profilok ismételt ellenőrzésével kezdődik. Ez a cikk bemutatja, hogyan segít a GrantAI a tanácsadóknak lerövidíteni a pályázati szűrést anélkül, hogy megszüntetné a szakértői áttekintést.