ATAILA Sajtószoba · Hibrid · Budapest · 2026. szeptember 11.

2026-W37

Az AWS Outpostsban nincs mai generációs GPU. Ezért mi építjük azt a hibridet, amely on-prem teszi.

Ha az ágenseid az AWS-en futnak, a következtetésnek pedig a saját telephelyeden kell maradnia, hardverproblémád van: az AWS Outposts nem kínál mai generációs GPU-t. Az Outposts egyetlen GPU-s példánycsaládja a g4dn — NVIDIA T4, egy 2019-es kártya —, és az is csak az első generációs rackekben; a 2025 áprilisi második generációs rackek és a 2026 szeptemberi egyrackes Outposts CPU-családokat hoznak, a GPU-támogatás a bejelentés óta „hamarosan érkezik”. Az AWS saját válasza a peremhálózati GPU-ra az EKS Hybrid Nodes: a te hardvered, az ő vezérlősíkjuk. Pontosan ez az ATAILA GPU-s node-ja. Ezért megépítjük — az AWS megoldásarchitektjeivel, egy valódi ügyfélesetre, fix áras, hathetes pilotként.

A rés, az AWS saját szavaival

A második generációs AWS Outposts rackek (2025. április) a C7i, M7i és R7i példányokat hozták; 2026 februárjában jött a C8i, M8i és R8i; a 2026 szeptemberi második generációs egyrackes Outposts ugyanezeket a CPU-családokat sorolja fel, gyorsított hálózati példányokkal. GPU-s példány egyik bejelentésben sem szerepel. A második generáció bejelentő cikke azt írta, hogy további példányok támogatása, „köztük GPU-s példányoké”, hamarosan érkezik — és 2026 szeptemberében még mindig érkezik. Az egyetlen GPU-s család, amelyet az Outposts támogat, a g4dn: NVIDIA T4 GPU-k 2019-es CPU-kkal, csak az első generációs rackekben.

Az AWS saját útja a mai GPU-khoz a peremhálózaton más: az Amazon EKS Hybrid Nodes, amely 2024 decembere óta általánosan elérhető, on-prem vagy peremhálózati gépeket — bármilyen hardvert, bármilyen GPU-val, amelyhez telepíted az illesztőprogramot — csatlakoztat egy régióban futó EKS-vezérlősíkhoz. Az AWS mérnökei publikáltak generatív AI-következtetést hibrid node-okon, ügyfél-GPU-kkal, és egy NVIDIA DGX Sparkot is hibrid node-ként. A hardvert az ügyfélnek kell hoznia. Mi hozzuk.

g4dn
Az egyetlen GPU-s példánycsalád az AWS Outpostsban — NVIDIA T4 (2019), csak első generációs rackekben
2024. dec.
Az Amazon EKS Hybrid Nodes általánosan elérhető — on-prem GPU-s node-ok EKS-vezérlősík alatt
2025. okt.
Az Amazon Bedrock AgentCore általánosan elérhető — átjáró guardrailekkel és szabályokkal, amely OpenAI-kompatibilis végpontokra irányítja a következtetést
6 hét
A pilot — tervezés, hibrid alap, ágens-alapvonal, döntés — fix áron, Buildbe beszámítva

Mit építünk, kivel

Ezen a héten egy AWS-megoldásarchitekt hozott nekünk egy ügyfélesetet: egy európai AWS-ügyfél, amely a felhőben fejlesztett ágenseket és on-prem következtetést akar, változtathatatlan tárolót on-prem hardveren futó tesztekkel, okos átjárót következtetés-irányítással, és egy megfigyelési és irányítási réteget a felhő és az on-prem felett. Még aznap délelőtt igent mondtunk. Ez mérnökök technikai együttműködése egy ügyfélesetre — nem AWS-partnerség, és nem az AWS jóváhagyása; ha bármelyik igazzá válik, ide írjuk.

Az architektúra, amelyet építünk, blokkonként:

A pilot terméke egy összehasonlítás, nem egy dia: ugyanaz az ágens, ugyanaz a tesztcsomag, lefuttatva a felhős modell és az on-prem GPU-k ellen, késleltetéssel, költséggel, minőséggel és adatrezidenciával egy irányítópulton. Egy igazgatóság erről dönt.

Amazon Web Services (AWS)
Az Amazon Web Services és az AWS logó az Amazon.com, Inc. vagy leányvállalatai védjegye. Az ATAILA nem áll kapcsolatban az AWS-szel, az AWS nem szponzorálja és nem hagyta jóvá; ez technikai együttműködés egy ügyfélesetre.

1 · 1. hét

Tervezési műhely.

Egyeztetett célarchitektúra, modellista, a tesztcsomag és az elfogadási feltételei, a hálózati terv, a sikerkritériumok. Távolról, vagy az Executive Briefing Centerünkben.

2 · 2–3. hét

A hibrid alap.

VPN felépítve; egy ATAILA GPU-s node hibrid node-ként az ügyfél EKS-fürtjében; a vLLM az első modellt szolgálja ki; az átjáró-lánc végponttól végpontig működik; OpenTelemetry mindkét Grafanába.

3 · 4–5. hét

Az ágens-alapvonal.

Az ügyfél első ágense konténerbe csomagolva, az ECR-ben és a Harborban, az AWS-en tesztelve az alapvonalhoz, on-prem az összehasonlításhoz; guardrailek és szabályok az átjárón.

4 · 6. hét

A döntés.

Jelentés, amelyet egy igazgatóság el tud olvasni: minőség, késleltetés, költség és adatrezidencia helyszínenként, és a döntés az éles üzemről az ügyfél saját hardverén vagy az ATAILA Cloudon. Fix ár a hat hétre, Buildbe beszámítva, ha folytatod.

Hol áll ez a küldetésben

A Service Provider küldetés a hiperskálázók felé csatlakozókat ígért, opcióként, soha nem függőségként. Az AWS az első, és azért hibrid, nem csatlakozó, mert az ügyfél igénye hibrid: az ágensek ott élnek, ahol a fejlesztők, a következtetés ott, ahol az adat. Az Azure, az Oracle Cloud és a Huawei Cloud az ütemterven követi — mindegyik akkor, ha egy ügyfél kéri vagy a gyártó elkötelezi magát. Minden ATAILA-változat bármelyikük nélkül is fut.

Technikai együttműködésnek hívjuk, mert az. Az ATAILA ma nem AWS-partner, és az AWS nem hagyta jóvá ezt a munkát; ha bármelyik megváltozik, ez az oldal ki fogja mondani. A pilot összehasonlítását az ügyfél megkapja, bármit is mutat — azt az esetet is beleértve, amikor az őszinte válasz az, hogy a felhős modell nyer.

Források

Beszéljünk

Ha az ágenseid az AWS-en futnak, és a következtetésnek a saját telephelyeden kell maradnia — vagy te vagy az a szolgáltató, akinek az ügyfelei így vannak vele —, írj két mondatot az űrlapon. Közvetlenül az alapítóhoz jut el.