AIDAT je výpočtová platforma IOAS pre prevádzku veľkých jazykových modelov na dedikovanom hardvéri v Európskej únii — bez odosielania dát do komerčných AI služieb tretích strán, s auditovateľnou stopou a napojením na bezpečnostný stack.

Abstrakt

AIDAT (AI Data Center) je projekt IOAS zameraný na bezpečné využívanie veľkých jazykových modelov (LLM) v organizáciách, ktoré nemôžu alebo nechcú posielať svoje dáta do verejných AI služieb. Namiesto zdieľanej služby, kde promptom odovzdávate obsah dokumentov prevádzkovateľovi mimo EÚ, poskytuje AIDAT dedikovaný výpočtový uzol s otvorenými modelmi (open-weight), fyzicky umiestnený v dátovom centre na území Európskej únie, prevádzkovaný pre jedného zákazníka a odstavený v okamihu, keď prácu dokončí.

Cieľová skupina: advokátske kancelárie, zdravotnícke zariadenia, samosprávy, priemyselné podniky a subjekty pod NIS2, ktoré spracúvajú dôverné, osobné alebo utajované obchodné údaje a potrebujú preukázať, kde a ako sa tieto dáta spracovali.

1. Prečo dedikovaná infraštruktúra

Bežné využitie komerčného AI asistenta znamená tri veci, ktoré sú v regulovanom prostredí problematické:

  1. Odovzdanie obsahu tretej strane. Dokument, zdravotný záznam alebo zmluva opúšťajú organizáciu. Aj pri zmluvnom záväzku netrénovať na dátach ide o sprístupnenie osobných údajov spracovateľovi mimo priamej kontroly.
  2. Neznámy geografický a právny režim spracovania. Prenos do tretích krajín vyžaduje právny základ a posúdenie vplyvu; pri zmene subdodávateľa poskytovateľa sa mení aj mapa spracovania.
  3. Chýbajúca auditná stopa na úrovni organizácie. Nie je preukázateľné, kto konkrétne, kedy a s akým dokumentom pracoval — čo je práve to, čo požaduje dozor pri kontrole.

AIDAT rieši všetky tri: model beží na hardvéri vyhradenom výhradne pre danú úlohu, v dátovom centre na území Európskej únie, a každý prístup k dátam sa zapisuje do auditného logu na strane zákazníka. Dáta ostávajú počas celého spracovania v EÚ — nedochádza k prenosu do tretích krajín, takže odpadá potreba osobitného právneho základu a posúdenia vplyvu pre cezhraničný prenos.

2. Architektúra

Výpočtová vrstva. Dedikované GPU inštancie (NVIDIA Blackwell, Hopper, Ampere, profesionálne RTX) v dátových centrách na území Európskej únie. Uzol sa vytvára pre konkrétnu úlohu alebo obdobie a po skončení sa ničí — neplatí sa za nečinný stroj.

Modelová vrstva. Otvorené modely s voľne dostupnými váhami, nasadené cez inferenčný server (vLLM) s OpenAI-kompatibilným rozhraním. Model beží v procese zákazníka; váhy ani prompty neodchádzajú z uzla. Pre špecializované úlohy (právny jazyk, zdravotná dokumentácia, technická diagnostika) je možné model doladiť na dátach zákazníka — dolaďovanie prebieha na tom istom izolovanom uzle.

Dátová vrstva. Vektorové indexy a dokumentové korpusy sú uložené šifrované v Európskej únii; prístup k nim má výhradne inferenčný uzol daného zákazníka. Zdrojové súbory sa neduplikujú do zdieľaného úložiska.

Bezpečnostná vrstva. Platforma je od návrhu security-stack ready: autentifikácia s MFA, RBAC, šifrovanie dát v pokoji, zálohy s overenou obnovou a štruktúrovaný auditný log (časová pečiatka, aktér, akcia, zdroj, tenant, IP, výsledok, závažnosť) exportovateľný do SIEM. Kritické udalosti (neúspešné prihlásenia, hromadný export, zmena oprávnení) vedia spustiť incident a s ním aj lehoty oznamovania podľa čl. 23 NIS2 (24 h / 72 h / 1 mesiac). Kontroly zodpovedajú základnému rámcu čl. 21 NIS2.

3. Aplikačné rozhranie a MCP server

AIDAT nie je len prenajatý hardvér — dodávame k nemu hotové rozhrania, cez ktoré model napojíte na svoje systémy.

Aplikačné rozhranie (API). Uzol vystavuje REST API kompatibilné s rozhraním OpenAI — chat/completions, embeddingy, streamovanie odpovedí. Vaše existujúce aplikácie, doplnky a knižnice tak stačí prepnúť na našu adresu a kľúč; prepis integrácie nie je potrebný. Každý zákazník má vlastný prístupový kľúč, limity požiadaviek a oddelený auditný log volaní.

MCP server. Prevádzkujeme server podľa protokolu Model Context Protocol (MCP), ktorým sprístupníte modelu vlastné zdroje a nástroje — dokumentové úložisko, vyhľadávanie v internej báze, databázy, ticketing či podpisové a spisové systémy. Klienti s podporou MCP (napr. AI asistenti a agentné nástroje) sa pripoja na jedno rozhranie a pracujú nad vašimi dátami bez toho, aby dáta opustili uzol v EÚ. Prístup jednotlivých nástrojov je riadený rolami (RBAC) a každé volanie nástroja sa zapisuje do auditného záznamu.

Integrácia do vášho prostredia. Rozhranie sprístupníme cez privátny tunel alebo VPN do vašej siete, prípadne s obmedzením na zoznam povolených IP adries. Podporujeme automatizované pipeline (dávkové spracovanie dokumentov) aj interaktívnu prácu používateľov.

4. Typické nasadenia

5. Model prevádzky

Platí sa za skutočne využitý strojový čas — hodinovo, bez viazanosti. Uzol vytvárame na požiadanie, sledujeme jeho vyťaženie a po skončení úlohy ho okamžite rušíme, aby zákazník neplatil nečinný hardvér. Dostupné sú dva režimy:

6. Cenník strojového času

Ceny sú uvedené v eurách za hodinu prevádzky jedného uzla a zahŕňajú prevádzku, dohľad a správu prostredia zo strany IOAS. Ceny sú konečné — IOAS nie je platiteľom DPH. Fakturuje sa začatá hodina. Úložisko, prenos dát a prípadné dolaďovanie modelu sa účtujú osobitne podľa rozsahu.

Odporúčané konfigurácie

Inštancia GPU GPU RAM vCPU RAM Cena €/h Spot €/h Vhodné pre
IOASTN-RTX6000P 1× RTX PRO 6000 96 GB 96 GB 30 90 GB 3,32 1,16 Najlepší pomer ceny a pamäte — inferencia stredných modelov, RAG, embeddingy
IOASTN-H100 1× H100 SXM5 80 GB 80 GB 30 120 GB 5,71 2,00 Produkčná inferencia pre tím, dolaďovanie metódou LoRA
IOASTN-H200 1× H200 SXM5 141 GB 141 GB 44 182 GB 7,02 2,46 Veľké modely a dlhý kontext na jednom GPU (rozsiahle spisy, korpusy)
IOASTN-B200 1× B200 SXM6 180 GB 180 GB 30 170 GB 10,73 3,76 Najnovšia generácia — najvyšší výkon na jedno GPU
IOASTN-H200-8 8× H200 SXM5 141 GB 1 128 GB 176 1 450 GB 56,19 19,67 Najväčšie modely, plné dolaďovanie, vysoká priepustnosť
IOASTN-CPU16 16 64 GB 0,196 0,069 Dátové pipeline, OCR, predspracovanie a indexovanie dokumentov

Pre dlhodobú rezerváciu (od jedného mesiaca) a pre projekty s garantovanou kapacitou pripravíme individuálnu ponuku.

7. Ako začať

  1. Úvodná konzultácia — aký typ dokumentov spracúvate, aké sú požiadavky na dôvernosť a aký objem dát predpokladáte.
  2. Voľba konfigurácie — model a veľkosť uzla podľa úlohy; pre väčšinu firemných nasadení postačuje jedna GPU triedy H100/H200 alebo RTX PRO 6000.
  3. Nasadenie a odovzdanie prístupov — uzol, inferenčné rozhranie, auditné logovanie a napojenie na vaše prostredie.
  4. Prevádzka — priebežný dohľad, mesačné vyúčtovanie skutočne využitého času.

Máte záujem o AIDAT alebo potrebujete posúdiť, či je vaša úloha vhodná na dedikovaný uzol? Kontaktujte nás.