AIDAT je výpočtová platforma IOAS pre prevádzku veľkých jazykových modelov na dedikovanom hardvéri v Európskej únii — bez odosielania dát do komerčných AI služieb tretích strán, s auditovateľnou stopou a napojením na bezpečnostný stack.
Abstrakt
AIDAT (AI Data Center) je projekt IOAS zameraný na bezpečné využívanie veľkých jazykových modelov (LLM) v organizáciách, ktoré nemôžu alebo nechcú posielať svoje dáta do verejných AI služieb. Namiesto zdieľanej služby, kde promptom odovzdávate obsah dokumentov prevádzkovateľovi mimo EÚ, poskytuje AIDAT dedikovaný výpočtový uzol s otvorenými modelmi (open-weight), fyzicky umiestnený v dátovom centre na území Európskej únie, prevádzkovaný pre jedného zákazníka a odstavený v okamihu, keď prácu dokončí.
Cieľová skupina: advokátske kancelárie, zdravotnícke zariadenia, samosprávy, priemyselné podniky a subjekty pod NIS2, ktoré spracúvajú dôverné, osobné alebo utajované obchodné údaje a potrebujú preukázať, kde a ako sa tieto dáta spracovali.
1. Prečo dedikovaná infraštruktúra
Bežné využitie komerčného AI asistenta znamená tri veci, ktoré sú v regulovanom prostredí problematické:
- Odovzdanie obsahu tretej strane. Dokument, zdravotný záznam alebo zmluva opúšťajú organizáciu. Aj pri zmluvnom záväzku netrénovať na dátach ide o sprístupnenie osobných údajov spracovateľovi mimo priamej kontroly.
- Neznámy geografický a právny režim spracovania. Prenos do tretích krajín vyžaduje právny základ a posúdenie vplyvu; pri zmene subdodávateľa poskytovateľa sa mení aj mapa spracovania.
- Chýbajúca auditná stopa na úrovni organizácie. Nie je preukázateľné, kto konkrétne, kedy a s akým dokumentom pracoval — čo je práve to, čo požaduje dozor pri kontrole.
AIDAT rieši všetky tri: model beží na hardvéri vyhradenom výhradne pre danú úlohu, v dátovom centre na území Európskej únie, a každý prístup k dátam sa zapisuje do auditného logu na strane zákazníka. Dáta ostávajú počas celého spracovania v EÚ — nedochádza k prenosu do tretích krajín, takže odpadá potreba osobitného právneho základu a posúdenia vplyvu pre cezhraničný prenos.
2. Architektúra
Výpočtová vrstva. Dedikované GPU inštancie (NVIDIA Blackwell, Hopper, Ampere, profesionálne RTX) v dátových centrách na území Európskej únie. Uzol sa vytvára pre konkrétnu úlohu alebo obdobie a po skončení sa ničí — neplatí sa za nečinný stroj.
Modelová vrstva. Otvorené modely s voľne dostupnými váhami, nasadené cez inferenčný server (vLLM) s OpenAI-kompatibilným rozhraním. Model beží v procese zákazníka; váhy ani prompty neodchádzajú z uzla. Pre špecializované úlohy (právny jazyk, zdravotná dokumentácia, technická diagnostika) je možné model doladiť na dátach zákazníka — dolaďovanie prebieha na tom istom izolovanom uzle.
Dátová vrstva. Vektorové indexy a dokumentové korpusy sú uložené šifrované v Európskej únii; prístup k nim má výhradne inferenčný uzol daného zákazníka. Zdrojové súbory sa neduplikujú do zdieľaného úložiska.
Bezpečnostná vrstva. Platforma je od návrhu security-stack ready: autentifikácia s MFA, RBAC, šifrovanie dát v pokoji, zálohy s overenou obnovou a štruktúrovaný auditný log (časová pečiatka, aktér, akcia, zdroj, tenant, IP, výsledok, závažnosť) exportovateľný do SIEM. Kritické udalosti (neúspešné prihlásenia, hromadný export, zmena oprávnení) vedia spustiť incident a s ním aj lehoty oznamovania podľa čl. 23 NIS2 (24 h / 72 h / 1 mesiac). Kontroly zodpovedajú základnému rámcu čl. 21 NIS2.
3. Aplikačné rozhranie a MCP server
AIDAT nie je len prenajatý hardvér — dodávame k nemu hotové rozhrania, cez ktoré model napojíte na svoje systémy.
Aplikačné rozhranie (API). Uzol vystavuje REST API kompatibilné s rozhraním OpenAI — chat/completions, embeddingy, streamovanie odpovedí. Vaše existujúce aplikácie, doplnky a knižnice tak stačí prepnúť na našu adresu a kľúč; prepis integrácie nie je potrebný. Každý zákazník má vlastný prístupový kľúč, limity požiadaviek a oddelený auditný log volaní.
MCP server. Prevádzkujeme server podľa protokolu Model Context Protocol (MCP), ktorým sprístupníte modelu vlastné zdroje a nástroje — dokumentové úložisko, vyhľadávanie v internej báze, databázy, ticketing či podpisové a spisové systémy. Klienti s podporou MCP (napr. AI asistenti a agentné nástroje) sa pripoja na jedno rozhranie a pracujú nad vašimi dátami bez toho, aby dáta opustili uzol v EÚ. Prístup jednotlivých nástrojov je riadený rolami (RBAC) a každé volanie nástroja sa zapisuje do auditného záznamu.
Integrácia do vášho prostredia. Rozhranie sprístupníme cez privátny tunel alebo VPN do vašej siete, prípadne s obmedzením na zoznam povolených IP adries. Podporujeme automatizované pipeline (dávkové spracovanie dokumentov) aj interaktívnu prácu používateľov.
4. Typické nasadenia
- Právo — analýza spisu, rešerš judikatúry, kontrola zmlúv a redline nad internou dokumentáciou kancelárie.
- Zdravotníctvo — štruktúrovanie a sumarizácia zdravotnej dokumentácie bez odoslania osobných údajov mimo prevádzkovateľa.
- Samospráva — spracovanie podaní, zápisníc a zmlúv; anonymizácia a cenzúra dokumentov pred zverejnením.
- Priemysel — technická dokumentácia, protokoly NDT, prevádzkové denníky a údržbové záznamy.
- Compliance — audítorské a metodické podklady (GDPR, NIS2), kde je vylúčené použitie verejnej AI služby.
5. Model prevádzky
Platí sa za skutočne využitý strojový čas — hodinovo, bez viazanosti. Uzol vytvárame na požiadanie, sledujeme jeho vyťaženie a po skončení úlohy ho okamžite rušíme, aby zákazník neplatil nečinný hardvér. Dostupné sú dva režimy:
- On-demand — garantovaný beh, uzol drží zákazník po celý čas rezervácie. Vhodné pre interaktívnu prácu a produkčnú inferenciu.
- Spot — výrazne nižšia cena, uzol však môže byť poskytovateľom kedykoľvek uvoľnený. Vhodné pre dávkové spracovanie s možnosťou obnovy z checkpointu (dolaďovanie, hromadné indexovanie, spracovanie korpusov).
6. Cenník strojového času
Ceny sú uvedené v eurách za hodinu prevádzky jedného uzla a zahŕňajú prevádzku, dohľad a správu prostredia zo strany IOAS. Ceny sú konečné — IOAS nie je platiteľom DPH. Fakturuje sa začatá hodina. Úložisko, prenos dát a prípadné dolaďovanie modelu sa účtujú osobitne podľa rozsahu.
Odporúčané konfigurácie
| Inštancia | GPU | GPU RAM | vCPU | RAM | Cena €/h | Spot €/h | Vhodné pre |
|---|---|---|---|---|---|---|---|
| IOASTN-RTX6000P | 1× RTX PRO 6000 96 GB | 96 GB | 30 | 90 GB | 3,32 | 1,16 | Najlepší pomer ceny a pamäte — inferencia stredných modelov, RAG, embeddingy |
| IOASTN-H100 | 1× H100 SXM5 80 GB | 80 GB | 30 | 120 GB | 5,71 | 2,00 | Produkčná inferencia pre tím, dolaďovanie metódou LoRA |
| IOASTN-H200 | 1× H200 SXM5 141 GB | 141 GB | 44 | 182 GB | 7,02 | 2,46 | Veľké modely a dlhý kontext na jednom GPU (rozsiahle spisy, korpusy) |
| IOASTN-B200 | 1× B200 SXM6 180 GB | 180 GB | 30 | 170 GB | 10,73 | 3,76 | Najnovšia generácia — najvyšší výkon na jedno GPU |
| IOASTN-H200-8 | 8× H200 SXM5 141 GB | 1 128 GB | 176 | 1 450 GB | 56,19 | 19,67 | Najväčšie modely, plné dolaďovanie, vysoká priepustnosť |
| IOASTN-CPU16 | — | — | 16 | 64 GB | 0,196 | 0,069 | Dátové pipeline, OCR, predspracovanie a indexovanie dokumentov |
Pre dlhodobú rezerváciu (od jedného mesiaca) a pre projekty s garantovanou kapacitou pripravíme individuálnu ponuku.
7. Ako začať
- Úvodná konzultácia — aký typ dokumentov spracúvate, aké sú požiadavky na dôvernosť a aký objem dát predpokladáte.
- Voľba konfigurácie — model a veľkosť uzla podľa úlohy; pre väčšinu firemných nasadení postačuje jedna GPU triedy H100/H200 alebo RTX PRO 6000.
- Nasadenie a odovzdanie prístupov — uzol, inferenčné rozhranie, auditné logovanie a napojenie na vaše prostredie.
- Prevádzka — priebežný dohľad, mesačné vyúčtovanie skutočne využitého času.
Máte záujem o AIDAT alebo potrebujete posúdiť, či je vaša úloha vhodná na dedikovaný uzol? Kontaktujte nás.