ATAILA Sajtószoba · Budapest · 2026. szeptember 4.
2026-W36
A nyilvános AI nem lesz olcsóbb. Egy negyedév három bejelentése mutat erre.
A GitHub a fix „premium request” egységekről tokenfogyasztás-alapú számlázásra váltott a Copilotnál, és egy megjegyzésre érdemes mondatban meg is mondta, miért: „GitHub has absorbed much of the escalating inference cost behind that usage, but the current premium request model is no longer sustainable.” Vagyis a szállító hivatalosan kimondta: eddig támogatta a terméket, és ezt abbahagyja. És ebben a negyedévben nem ő az egyetlen.
A cikk, amelyre válaszolunk
„GitHub Copilot is moving to usage-based billing”
The GitHub Blog · 2026. április 27.
Mi történik valójában
Három külön bejelentés, egy negyedév, egy irány:
1 · GitHub
A fix díjból fogyasztásalapú díj lett
A Copilot a „premium request” egységekről tokenfogyasztás szerinti számlázásra váltott: bemeneti, kimeneti és gyorsítótárazott tokenek, az egyes modellek API-díjszabása szerint. Az előfizetési alapárak maradtak, a tartalmuk változott. A GitHub indoklása: az ügynöki használat lényegesen nagyobb számítási igényű, miközben eddig egy gyors kérdés és egy többórás önálló munkamenet ugyanannyiba került az ügyfélnek.
2 · Anthropic
Lejár egy ideiglenes keretbővítés
Május 13-tól egy akció 50%-kal magasabb heti keretet adott a Claude Code-előfizetőknek. Ez szeptember 13-án lejár, és a keretek visszaállnak az alapszintre. Pontosan fogalmazva: bónusz jár le, az alapszint és az ár változatlan. A gyakorlatban mégis ugyanaz az előfizetés jövő héten kevesebb munkát vesz meg, mint a múlt héten.
3 · Google
Ugyanaz az egységár, nagyobb számla
A Gemini Flash 3.8 tokenenként pontosan annyiba kerül, mint az elődje. Az Artificial Analysis első mérései szerint viszont a feladatonkénti költség akár 40%-kal magasabb, mert több lépésben következtet. Senki nem emelt árat, a számla mégis emelkedik. Külön is írtunk róla.
Miért szerkezeti ez
Kényelmes volna három egymástól független üzleti döntésként olvasni. A három bejelentés összefügg: ügyféloldalról így néz ki egy támogatott korszak vége, és a mögötte álló számtan nyilvános.
A PwC adatközpont-előrejelzése, amelyről az economx szeptember 2-án számolt be, csak 2026-ban mintegy 800 milliárd dollárnyi adatközpont-beruházásra számít, 2050-re évi 1,8 ezermilliárd dollárra, halmozottan pedig a 31,6 ezermilliárd dollárt közelítő összegre. És megjegyzi azt a részletet, amelyen az egész gazdaságosság áll vagy bukik: a középpontban álló GPU-k hasznos élettartama négy–hat év.
Ennyi a történet. Ekkora tőkét ilyen gyors leírás mellett valakinek ki kell fizetnie, és ez a valaki az, aki az inferenciát bérli. A piac megnyerésére szabott ár más, mint amelyik a mögötte álló tőkét kiszolgálja.
Ettől még nem lesznek gazemberek a szállítók. A GitHub kimondta, amit mások nem, és tisztességesen járt el: többé nem tartja fenn a látszatot, hogy egy ügynöki munkamenet annyiba kerül, mint egy chatüzenet. Az európai cégeknek viszont, ha jövő évre terveznek, fel kell hagyniuk azzal a feltételezéssel, hogy a trend lefelé mutat. A negyedév minden jelzése szerint felfelé mutat.
Mit gondolunk, és hol túl könnyű a saját érvünk
A csábító változat így szólna: vegyél saját hardvert, és onnantól csak az áramot fizeted. Ezt nem írjuk le, mert a saját honlapunk ellene érvel. Aki dobozt vesz, dobozt kap. A frissítés, a mentés, a hajnali háromkor meghibásodó GPU, a modellek életciklusa és az értékvesztés, amelyet a PwC most számszerűsített: ez mind marad. És ez a drága rész.
Az őszinte állítás szűkebb:
A saját kapacitás azt változtatja meg, mitől függ a költséged
Fogyasztásalapú nyilvános AI mellett a működési költséged mások árazási döntéseitől, kiadási ütemtervétől és finanszírozási nyomásától függ. A dedikált kapacitás (a miénk vagy a tiéd) a saját terhelésedtől teszi függővé. Tervezhető lesz, márpedig a pénzügynek pontosan erre van szüksége: nem mozdul el akkor, amikor egy szállító igazgatósága úgy dönt, hogy vége a támogatásnak. Az első napon automatikusan olcsóbb viszont nem lesz.
A munka a teljes rendszerben van, nem a vasban
Ha tényleg a tiéd a hardver, akkor az áram valóban közel van a következő inferencia határköltségéhez. De onnantól, hogy „van GPU-nk”, odáig, hogy „egy bizalmas munkafolyamat éles üzemben fut, mentéssel, monitorozással, release-úttal és SLA-val”, az út maga a platform. És ha ezt saját kézzel építed meg, a projekt felemészti a megtakarítást. Ezt a részt mi üzemeltetjük.
2027-ben az lesz a legolcsóbb AI, amelyhez nem kellett újraírni a költségvetést
Egy-egy üzemeltetett munkafolyamatot fix havidíjon árazunk, tokenalapú tétel nélkül. Ha az inferencia költsége elmozdul, azt mi nyeljük le, és a te számládon nem jelenik meg meglepetésként.
Azt állítjuk, hogy ha egy munkafolyamat elég fontos ahhoz, hogy minden nap fusson, akkor tudnod kell, mennyibe fog kerülni jövőre. A fogyasztásalapú nyilvános AI-nál ezt most senki nem tudja őszintén megmondani. Azt viszont nem állítjuk, hogy a privát AI mindig olcsóbb egy nyilvános API-nál: alkalmi, kevésbé fontos munkára jellemzően nem az, és ezt ki is mondjuk.
Hol állunk
Mi magunk is használunk nyilvános modelleket ott, ahol az adat engedi, és ezt folytatni is fogjuk. Arra kérünk, hogy vedd észre az irányt, nem arra, hogy mindent hozz házon belülre.
Egy negyedév alatt három szállító vagy elkezdett pénzt kérni azért, ami eddig benne volt, vagy kevesebbet tesz bele. A kiépítés mögötti tőke szerint ez így is marad. Ha a jövő évi terved azt feltételezi, hogy az AI munkaegységenként olcsóbb lesz, akkor abba a tervbe most kell egy második oszlop.
Az eredeti cikk
„GitHub Copilot is moving to usage-based billing”
The GitHub Blog · 2026. április 27.
← Vissza a Sajtószobába Sajtómegkeresés: kapcsolat