Nederlandse publieke organisatie

GPU-capaciteit die meebeweegt met het werk.

Een GPU-cluster waarin rekenkracht via een PCIe-fabric aan hosts kan worden toegewezen, met Slurm voor workload scheduling.

De opgave

GPU-capaciteit flexibeler gebruiken dan met een vaste koppeling tussen server en accelerator.

Wat is gebouwd

Een composable inrichting met RTX 8000-GPU’s, een PCIe-fabric en Slurm.

De afbakening

Het project beschrijft de infrastructuur en toewijzing van GPU’s. Er worden geen niet-onderbouwde bezettings-, kosten- of snelheidswinsten genoemd.

VF / 01REFERENTIEARCHITECTUUR
JOUW OMGEVING01Medewerkers & applicatiesCHAT / API / DEVELOPER TOOLS02Toegang · API-gatewayIDENTITY / LIMITS / ROUTING03AI-agents, retrieval & modellenTOOLS / SOURCES / MODELS04GPU · Opslag · MLOpsKUBERNETES / NVMe-oF / OBSERVABILITYON-PREMISES / EUROPEES GEHOST / AIR-GAPPED
Een gecontroleerde keten. Een heldere grens.
  1. Medewerkers & applicaties: CHAT / API / DEVELOPER TOOLS
  2. Toegang · API-gateway: IDENTITY / LIMITS / ROUTING
  3. AI-agents, retrieval & modellen: TOOLS / SOURCES / MODELS
  4. GPU · Opslag · MLOps: KUBERNETES / NVMe-oF / OBSERVABILITY

REFERENTIE, GEEN NETWERKKAART

Het patroon achter de oplossing.

Een generiek overzicht van de bouwstenen. Technische adressen, interne systemen en klantidentiteiten blijven buiten de publicatie.

Bekijk de architectuur ↗

DE VOLGENDE STAP

Wat moet er bij jullie werken?

Begin met de documenten, het proces of de technische vraag. We denken mee over een passende eerste stap.

Plan een gesprek