ATAILA Sajtószoba · Hibrid · Budapest · 2026. szeptember 11.
2026-W37
Az AWS Outpostsban nincs mai generációs GPU. Ezért mi építjük azt a hibridet, amely on-prem teszi.
Ha az ágenseid az AWS-en futnak, a következtetésnek pedig a saját telephelyeden kell maradnia, hardverproblémád van: az AWS Outposts nem kínál mai generációs GPU-t. Az Outposts egyetlen GPU-s példánycsaládja a g4dn — NVIDIA T4, egy 2019-es kártya —, és az is csak az első generációs rackekben; a 2025 áprilisi második generációs rackek és a 2026 szeptemberi egyrackes Outposts CPU-családokat hoznak, a GPU-támogatás a bejelentés óta „hamarosan érkezik”. Az AWS saját válasza a peremhálózati GPU-ra az EKS Hybrid Nodes: a te hardvered, az ő vezérlősíkjuk. Pontosan ez az ATAILA GPU-s node-ja. Ezért megépítjük — az AWS megoldásarchitektjeivel, egy valódi ügyfélesetre, fix áras, hathetes pilotként.
A rés, az AWS saját szavaival
A második generációs AWS Outposts rackek (2025. április) a C7i, M7i és R7i példányokat hozták; 2026 februárjában jött a C8i, M8i és R8i; a 2026 szeptemberi második generációs egyrackes Outposts ugyanezeket a CPU-családokat sorolja fel, gyorsított hálózati példányokkal. GPU-s példány egyik bejelentésben sem szerepel. A második generáció bejelentő cikke azt írta, hogy további példányok támogatása, „köztük GPU-s példányoké”, hamarosan érkezik — és 2026 szeptemberében még mindig érkezik. Az egyetlen GPU-s család, amelyet az Outposts támogat, a g4dn: NVIDIA T4 GPU-k 2019-es CPU-kkal, csak az első generációs rackekben.
Az AWS saját útja a mai GPU-khoz a peremhálózaton más: az Amazon EKS Hybrid Nodes, amely 2024 decembere óta általánosan elérhető, on-prem vagy peremhálózati gépeket — bármilyen hardvert, bármilyen GPU-val, amelyhez telepíted az illesztőprogramot — csatlakoztat egy régióban futó EKS-vezérlősíkhoz. Az AWS mérnökei publikáltak generatív AI-következtetést hibrid node-okon, ügyfél-GPU-kkal, és egy NVIDIA DGX Sparkot is hibrid node-ként. A hardvert az ügyfélnek kell hoznia. Mi hozzuk.
Mit építünk, kivel
Ezen a héten egy AWS-megoldásarchitekt hozott nekünk egy ügyfélesetet: egy európai AWS-ügyfél, amely a felhőben fejlesztett ágenseket és on-prem következtetést akar, változtathatatlan tárolót on-prem hardveren futó tesztekkel, okos átjárót következtetés-irányítással, és egy megfigyelési és irányítási réteget a felhő és az on-prem felett. Még aznap délelőtt igent mondtunk. Ez mérnökök technikai együttműködése egy ügyfélesetre — nem AWS-partnerség, és nem az AWS jóváhagyása; ha bármelyik igazzá válik, ide írjuk.
Az architektúra, amelyet építünk, blokkonként:
- Ágensek az AWS-ben. Strands Agentsszel (Apache-2.0) vagy azzal a keretrendszerrel, amelyet az ügyfél már használ; Bedrock AgentCore Runtime-on vagy EKS-en futtatva.
- Következtetés az ATAILA GPU-s node-jain. vLLM — vagy NVIDIA NIM, ahol egy modell licence ezt kéri — OpenAI-kompatibilis végpontokat szolgál ki a csupasz vasra telepített GPU-s node-jainkról, amelyek hibrid node-ként csatlakoznak az ügyfél EKS-fürtjéhez.
- Két átjáró, egy szabályrendszer. Az Amazon Bedrock AgentCore Gateway a peremen, Bedrock Guardrailsszel és AgentCore Policyvel, amely a következtetési célpontokat az on-prem végpontra irányítja; on-prem az ATAILA saját AI-átjárója a modell-irányításra, a bérlőnkénti mérésre és a felhős tartalékra, ha az on-prem sor megtelik. A B terv semmit nem kér az AWS-től: az ATAILA-átjáró egyedül — ez fut ma a platformunkon.
- Egy image, két registry. Egyszer építve, az Amazon ECR-be tolva és on-prem a Harborba tükrözve, változtathatatlan címkékkel — az AWS-en tesztelve az alapvonalhoz, az on-prem node-okon tesztelve az összehasonlításhoz.
- Egy megfigyelési réteg. AWS Distro for OpenTelemetry minden node-on, felhőben és on-prem, az Amazon Managed Grafanába és az ATAILA Grafanájába; AgentCore-megfigyelés az ágensek nyomkövetésére; az ATAILA bérlőnkénti használati bizonyítéka az irányítási jelentéshez.
- Hibrid hálózat. AWS Site-to-Site VPN az ügyfél VPC-jébe, vagy WireGuard — a mi oldalunkon bérlőnként egy projektzóna, pontosan úgy, ahogy a platform minden mást is elszigetel.
A pilot terméke egy összehasonlítás, nem egy dia: ugyanaz az ágens, ugyanaz a tesztcsomag, lefuttatva a felhős modell és az on-prem GPU-k ellen, késleltetéssel, költséggel, minőséggel és adatrezidenciával egy irányítópulton. Egy igazgatóság erről dönt.
1 · 1. hét
Tervezési műhely.
Egyeztetett célarchitektúra, modellista, a tesztcsomag és az elfogadási feltételei, a hálózati terv, a sikerkritériumok. Távolról, vagy az Executive Briefing Centerünkben.
2 · 2–3. hét
A hibrid alap.
VPN felépítve; egy ATAILA GPU-s node hibrid node-ként az ügyfél EKS-fürtjében; a vLLM az első modellt szolgálja ki; az átjáró-lánc végponttól végpontig működik; OpenTelemetry mindkét Grafanába.
3 · 4–5. hét
Az ágens-alapvonal.
Az ügyfél első ágense konténerbe csomagolva, az ECR-ben és a Harborban, az AWS-en tesztelve az alapvonalhoz, on-prem az összehasonlításhoz; guardrailek és szabályok az átjárón.
4 · 6. hét
A döntés.
Jelentés, amelyet egy igazgatóság el tud olvasni: minőség, késleltetés, költség és adatrezidencia helyszínenként, és a döntés az éles üzemről az ügyfél saját hardverén vagy az ATAILA Cloudon. Fix ár a hat hétre, Buildbe beszámítva, ha folytatod.
Hol áll ez a küldetésben
A Service Provider küldetés a hiperskálázók felé csatlakozókat ígért, opcióként, soha nem függőségként. Az AWS az első, és azért hibrid, nem csatlakozó, mert az ügyfél igénye hibrid: az ágensek ott élnek, ahol a fejlesztők, a következtetés ott, ahol az adat. Az Azure, az Oracle Cloud és a Huawei Cloud az ütemterven követi — mindegyik akkor, ha egy ügyfél kéri vagy a gyártó elkötelezi magát. Minden ATAILA-változat bármelyikük nélkül is fut.
Technikai együttműködésnek hívjuk, mert az. Az ATAILA ma nem AWS-partner, és az AWS nem hagyta jóvá ezt a munkát; ha bármelyik megváltozik, ez az oldal ki fogja mondani. A pilot összehasonlítását az ügyfél megkapja, bármit is mutat — azt az esetet is beleértve, amikor az őszinte válasz az, hogy a felhős modell nyer.
Források
- AWS What's New: second-generation AWS Outposts racks (2025. április); C8i, M8i and R8i on Outposts (2026. február); second-generation single-rack Outposts (2026. szeptember); a második generáció bejelentő cikke a „GPU-enabled instances coming soon” ígérettel; Amazon EC2 G4 instances.
- AWS: Amazon EKS Hybrid Nodes (2024. december); Run GenAI inference across environments with Amazon EKS Hybrid Nodes.
- AWS: Amazon Bedrock AgentCore generally available (2025. október); AgentCore Gateway inference targets; Strands Agents SDK.
Beszéljünk
Ha az ágenseid az AWS-en futnak, és a következtetésnek a saját telephelyeden kell maradnia — vagy te vagy az a szolgáltató, akinek az ügyfelei így vannak vele —, írj két mondatot az űrlapon. Közvetlenül az alapítóhoz jut el.
← Vissza a Sajtószobába Sajtómegkeresés: kapcsolat