VFUSION AI / TECHNOLOGIE

De volledige keten. Zichtbaar gemaakt.

Van document tot antwoord, van GPU tot API. Dit is onze referentiearchitectuur: de bouwstenen kiezen we per opdracht, met expliciete grenzen en meetpunten.

VF / 01REFERENTIEARCHITECTUUR
JOUW OMGEVING01Medewerkers & applicatiesCHAT / API / DEVELOPER TOOLS02Toegang · API-gatewayIDENTITY / LIMITS / ROUTING03AI-agents, retrieval & modellenTOOLS / SOURCES / MODELS04GPU · Opslag · MLOpsKUBERNETES / NVMe-oF / OBSERVABILITYON-PREMISES / EUROPEES GEHOST / AIR-GAPPED
Een gecontroleerde keten. Een heldere grens.
  1. Medewerkers & applicaties: CHAT / API / DEVELOPER TOOLS
  2. Toegang · API-gateway: IDENTITY / LIMITS / ROUTING
  3. AI-agents, retrieval & modellen: TOOLS / SOURCES / MODELS
  4. GPU · Opslag · MLOps: KUBERNETES / NVMe-oF / OBSERVABILITY

BINNEN DE GRENS

Elke laag heeft een taak.

Dit diagram is een referentieontwerp. De exacte invulling, actieve lagen en toegangsgrenzen worden per project vastgelegd.

Open componenten. Eén samenhangend systeem.

Kubernetes, Kubeflow, Argo Workflows, Harbor en MLflow vormen de platformlaag. Modelserving en retrieval sluiten aan via gecontroleerde API’s.

Documentverwerking als fundament

Docling op GPU, extractiemodellen voor OCR en tabellen, en Gemma voor visuele interpretatie. Nederlandstalige en Engelstalige documenten tellen beide mee.

Observeren, testen, beheren

OpenTelemetry en Loki maken verwerkingsstappen zichtbaar. Kwaliteitsevaluatie, versiebeheer en controle op toegangsrechten horen bij de architectuur.

Agentic verwerking over meerdere apps

Een gedeelde AI-interface verbindt modelserving, documentverwerking en orchestratietools met websites en apps. Per toepassing blijven gegevensscope, toegestane acties, goedkeuring en audit expliciet. Financiële bedragen en statusovergangen worden door de applicatie gecontroleerd.

WAT JE KRIJGT

01

Taal & code

gpt-oss, Gemma en een eigen gekwantiseerd 72B-codemodel.

02

Retrieval

BGE-M3, Qwen3-embeddings, BM25 en reranking.

03

Beeld & documenten

YOLO, vision-language modellen, Docling en OCR.

04

Compute & fabric

H100, Kubernetes, Slurm, NVMe-oF en RoCE.

LAYER 01 → 10

RAG in tien lagen.

Een referentie voor ontwerp en evaluatie. Geen belofte van foutloze antwoorden; iedere laag heeft een begrensde verantwoordelijkheid.

01Ingest & normaliseer

Docling, OCR en orchestratie brengen brondocumenten naar consistente tekst en metadata.

02Twee zoeksporen

BM25 en dense embeddings combineren exact zoeken met betekenis.

03Selecteer & herschik

HNSW-zoeken en reranking kiezen de meest relevante passages.

04Confidence gate

Relevantiescores, actualiteit, autoriteit en overeenstemming bepalen of er genoeg bewijs is.

05Antwoord uit context

Het model werkt met de geselecteerde bronnen en een versiegebonden instructie.

06Citeer de bron

Claims worden verbonden aan passages, documenten en pagina’s.

07Controleer onderbouwing

Een aanvullende NLI-controle kan ontbrekende of zwakke onderbouwing markeren.

08Meet de kwaliteit

Evaluatiesets, MLflow en alerts houden veranderingen zichtbaar.

09Cache met beleid

Exacte en semantische caches met versies en vervaltermijnen.

10Volg de hele keten

Tracing per stap met OpenTelemetry en Loki.

DE VOLGENDE STAP

Wat moet er bij jullie werken?

Begin met de documenten, het proces of de technische vraag. We denken mee over een passende eerste stap.

Plan een gesprek