ATAILA Sajtószoba · Budapest · 2026. szeptember 4.
2026-W36
A tokenár nem mozdult. A számla akár 40 százalékkal is nőhet.
Szeptember 3-án a HWSW egy csendes, de fontos hírt írt meg a Google Gemini Flash 3.8-ról: a közzétett ár egyáltalán nem változott. Ugyanaz a 0,75 dollár millió bemeneti tokenenként és 3,75 dollár millió kimeneti tokenenként, mint az előző verziónál. Az Artificial Analysis első mérései szerint viszont a feladatonkénti költség akár 40 százalékkal magasabb lehet, mert az új modell összetett munkánál több következtetési lépést hajt végre. Senki nem emelt árat. A számla mégis nőhet.
A cikk, amelyre válaszolunk
„Keményebben dolgozik a Google új modellje, de ennek ára van”
HWSW · 2026. szeptember 3.
Mit ír a cikk
A cikk szerint a modell valóban jobb szoftverfejlesztésben és ügynöki munkában, mint az azonos listaáron elérhető alternatívák. A történet arról szól, hogy a tokenalapú árlista mit tud és mit nem tud megmondani. A szállító tisztessége itt nem kérdés.
Mit gondolunk
Az egységárból csak akkor lesz költségvetés, ha tudod, hány egységet fogsz elhasználni. Következtető modelleknél ezt nem tudod, és egyre kevésbé tudhatod: a fogyasztást a modell viselkedése határozza meg, ez a viselkedés pedig akkor változik, amikor a szállító olyan frissítést ad ki, amelyet nem te választottál, és vissza sem utasíthatsz.
A frissítés, amelyet nem kértél, átírja a költségeidet
A Google senkinek nem küldött áremelést. Jött egy jobb modell, több lépésben gondolkodik, és ugyanannak a munkafolyamatnak a futtatása most többe kerül. Ha a pénzügy a régi számokra hagyott jóvá keretet, az a keret rossz, és erről senki nem szólt nekik.
Az „olcsóbb tokenenként” és az „olcsóbb” két különböző dolog
A modellek közötti tokenalapú összehasonlítás nagyjából értelmét veszti, amint eltér a lépésszám. Egyetlen szám számít: mennyibe kerül a te munkádból egy elkészült egység, vagyis egy feldolgozott számla, egy átnézett szerződés, egy megválaszolt kérdés. Ez pedig egyetlen árlistán sem szerepel.
Ez tervezési probléma, nem árazási
Írtuk már: a vállalati AI többsége a próbaprojekt és az éles üzem között hal el. A fogyasztás alapján számlázott inferencia (vagyis a modell futtatása) ennek egyik oka. Az a próbaprojekt, amelynek költsége kerekítési hiba, százszoros mennyiségnél olyan tétellé válik, amelyet senki nem tud megindokolni. A pénzügyi vezető kérdésére pedig, hogy mennyibe fog ez kerülni jövőre, nincs őszinte válasz.
Üzemeltetett, bizalmas munkafolyamatot fix havidíjjal árazunk. Soha nem felhasználónként, soha nem tokenenként: a számládon nincs fogyasztási tétel. Amikor jobb modellt állítunk üzembe, a számlád nem mozdul. Ez az árazás lényege, nem akció.
Hol állunk
A fogyasztásalapú árazásnak is megvan a helye. Eseti, kísérleti, kis kockázatú munkára pontosan az a helyes, és mi magunk is használunk nyilvános modelleket ott, ahol az adat engedi. A gond akkor kezdődik, amikor a cég mindennapi munkája fogyasztás alapján számlázott függőségre épül. Onnantól a számla a szállító kiadási ütemtervétől függ, az ingadozást pedig te viseled.
Ha jövő évre tervezel AI-költséget, végezd el azt a próbát, amelyet ez a cikk sugall: vedd a legterheltebb munkafolyamatodat, és számold ki, mennyibe kerül ma, és mennyibe kerülne, ha a szolgáltatód kiadna egy kétszer alaposabban gondolkodó modellt. Ha a második kérdésre nem tudsz válaszolni, nincs előrejelzésed. Csak a múlt havi számlád van, meg egy kis remény.
Az eredeti cikk
„Keményebben dolgozik a Google új modellje, de ennek ára van”
HWSW · 2026. szeptember 3.
← Vissza a Sajtószobába Sajtómegkeresés: kapcsolat