Veel organisaties hebben de afgelopen jaren hun AI-capabilities gebouwd op een klein aantal (voornamelijk Amerikaanse) platformen. Dat is logisch: ze bieden snelheid, developer experience en een sterke modelkwaliteit.
Maar de markt is veranderd. We zien bij klanten steeds vaker expliciete requirements rondom data-soevereiniteit, risicospreiding, contractuele controle en het vermijden van vendor-lock-in. Bij Rubicon zijn we sterk in het Microsoft-ecosysteem en ontwerpen we veel oplossingen op Azure. Tegelijkertijd helpen we organisaties steeds vaker met architecturen waarin keuzevrijheid centraal staat, zodat je kunt schakelen tussen modellen, platformen en regio’s zonder je hele stack opnieuw te bouwen.
De belangrijkste ontwikkeling: keuzevrijheid gaat niet meer ten koste van kwaliteit. Open modellen bereiken inmiddels frontier-niveau en Europese providers bieden deze aan als volwaardige, beheerde AI-diensten, met flexibele kostenmodellen, API-toegang en Europese hostingopties.
De huidige generatie AI-modellen
De SOTA-modelwereld beweegt extreem snel. Waar closed modellen ooit dominant waren, is de realiteit nu dat meerdere open-weights modellen hetzelfde kwaliteitsniveau bereiken voor enterprise-use-cases (reasoning, tool-use, agents). De meest relevante modellen op dit moment zijn:
- DeepSeek: technisch zeer sterk (reasoning, agents, tool-use). Chinees van herkomst, dus governance is een aandachtspunt, maar dankzij open-weights en EU-hosting zijn risico’s goed beheersbaar.
- Qwen (Alibaba): snel evoluerende familie. Qwen3-Max is een volwaardig GPT-5-klasse alternatief, ook voor code en multi-step agent workflows.
- Mistral: Europees, breed portfolio, open-weights (o.a. Mistral Large 3). Iets minder SOTA dan sommige Chinese modellen, maar governance-voordeel is groot.
- GPT-OSS-120B (OpenAI): Amerikaans open-weight model van OpenAI dat laat zien dat open nu ook een optie is bij US-spelers.
- Llama (Meta): ecosysteem blijft relevant, maar momenteel minder leidend op absolute SOTA.
Naast DeepSeek en Qwen zijn er van Chinese komaf nog een aantal modellen die interessant zijn om te volgen: ERNIE 5 (Baidu), GLM-4.7 (Z.ai) en Kimi-K2 (MoonshotAI).
State-Of-The-Art (SOTA): zijn modellen die op dit moment de best presterende behoren.
De 5 Europese alternatieven voor inference en keuzevrijheid
Overzicht
|
Provider |
Primair voor |
Pay-per-token |
Europese basis |
|
Nebius Token Factory |
brede modelkeuze, “AI inference as a product” |
✅ |
✅ (NL) |
|
Mistral API |
EU-modelmaker + hosted API |
✅ |
✅ (FR) |
|
IONOS / STACKIT |
Duitse “sovereign” cloud |
✅ |
✅ (DE) |
|
Nebul |
EU-operated infra + serverless/dedicated keuze |
✅ |
✅(NL) |
|
Self-hosting |
maximale controle |
❌ |
✅ (eigen keuze) |
Nebius Token Factory (Nederland)
AI-inference-first platform dat zich volledig richt op hosted model serving met pay-per-token pricing. Nebius positioneert inference als product, niet als bijzaak van een algemene cloud.
Modellen
- DeepSeek-varianten
- Qwen3
- Mistral-familie
- GPT-OSS-120B
- Kimi-K2
- Diverse embedding-modellen
Waarom dit interessant is
- Brede en actuele modelcatalogus
- Betaal naar gebruik met pay-per-token pricing
- EU-hosting (Finland/Frankrijk) met expliciete regio-keuze
- Zero-retention opties beschikbaar
- Sterk geschikt voor multi-model routing architecturen
- Past goed in composable AI-architecturen (geen lock-in op model of provider)
Mistral API (Frankrijk)
Mistral is zowel modelmaker als platform. Je kunt hun modellen hosted gebruiken, maar ook zelf draaien, uniek in Europa op deze schaal.
Modellen
- Mistral Small / Medium / Large 3
- Ministral
- Embedding-modellen
- Multimodale varianten
Waarom dit interessant is
- Volledig Europees ontwikkeld
- Open-weights beschikbaar voor self-hosting
- Betaal naar gebruik met pay-per-token pricing
- Sterke documentatie en lifecycle-management
- Governance-voordeel bij Europese organisaties
IONOS (Duitsland)
(STACKIT is functioneel gelijkwaardig alternatief, zie onder)
IONOS biedt een duidelijke, transparante AI-hub met token-pricing en een portfolio gericht op enterprise-use.
Modellen
- GPT-OSS-120B
- Llama 3.1 / 3.3 (70B / 405B)
- Mistral Nemo
- FLUX (text-to-image)
- Diverse embedding-modellen
Waarom dit interessant is
- Duitse datacenters (sterke soevereiniteitspositie)
- Betaal naar gebruik met pay-per-token pricing
- Makkelijk te positioneren richting compliance en procurement
Alternatief:
STACKIT (Duitsland, Schwarz Group – Lidl/Kaufland)
Vrijwel identiek in modelkeuze en positionering, maar met nog sterkere “sovereign cloud” messaging.
Nebul (Nederland)
Nederlandse provider die inzet op Europese AI-infrastructuur met meer controle dan hyperscale platforms.
Modellen
- Qwen3
- Mistral Large 3
- GPT OSS 120b
- Llama 4
- Diverse embedding-modellen
Waarom dit interessant is
- Nederlandse partij
- Keuze tussen serverless en dedicated inference
- Geschikt voor organisaties die grip en maatwerk belangrijk vinden
- Minder self-service, maar meer controle
- Goede optie bij gevoelige data of specifieke eisen
Self-hosting
Voor organisaties die maximale controle willen en bereid zijn te investeren in expertise. Self-hosting is de meest soevereine vorm van AI-inference. Je draait modellen volledig binnen je eigen infrastructuur, met volledige controle over data, netwerk, logging, lifecycle en security. Dit kan met commerciële oplossingen zoals NVIDIA Enterprise, maar ook met open-source serving stacks zoals vLLM, SGLang of OpenLLM.
Modellen
- Alle open-weights modellen (DeepSeek, Qwen, Mistral, Llama, GPT-OSS, etc.)
- Eigen fine-tuned varianten
Waarom dit interessant is
- Volledige controle over data, logging, lifecycle
- Geen vendor-lock-in
- Zelf bepalen waar en hoe inference draait
- Maar: vereist expertise in serving, scaling, observability, security en de kosten zijn hoog
Ontwerp voor keuzevrijheid, niet voor één model
De belangrijkste les: AI-architectuur draait niet meer om één model of één provider. Het draait om flexibiliteit, dat je iets kunt maken wat niet veel later weer overbodig is geworden.
Bij Rubicon ontwerpen we daarom AI-platformen met de volgende uitgangspunten:
- Composable architecture: modellen, agents en tools zijn verwisselbare componenten
- Standaardiseren op protocollen (modellen, embeddings en tooling)
- De juiste modellen inzetten op basis van kosten, latency en policy
- Governance, observability en evaluatie als onderdeel van de architectuur, niet als afterthought
Zo kun je vandaag Azure maximaal benutten, en morgen probleemloos schakelen naar een Europese provider of self-hosted model, zonder dat je applicaties er last van hebben.