AI-kostencalculator
Wat kost uw AI-gebruik via een cloud-API — en wat zou een open-source model op eigen hardware kosten? Deze calculator rekent met actuele API-prijzen en bewust conservatieve (dus hoge) hardware-inschattingen. Alle aannames en bronnen staan onderaan deze pagina.
1 · Uw gebruiksprofiel
2 · Huidige cloud-API
3 · On-premise alternatief
Cumulatieve kosten over 36 maanden
Cloud-API stijgt lineair met het verbruik · on-premise start met de hardware-investering en stijgt daarna langzaam (energie + beheer).
Gekozen on-premise scenario
| Modellen in deze klasse | |
| Hardware | |
| Benodigd VRAM | |
| Indicatieve capaciteit |
Dit is een conservatieve indicatie, geen offerte. Hardware is bewust aan de hoge kant ingeschat (o.a. MSRP-prijzen in een krappe markt). In de praktijk liggen de kosten vaak lager, bijvoorbeeld door inkoopkorting, hergebruik van bestaande servers of een lager energietarief. Kwaliteit van open modellen verschilt per toepassing — test daarom altijd met uw eigen data voordat u investeert.
Welk open model past op welke hardware?
Vuistregel: bij 4-bit kwantisatie heeft een model ongeveer 0,5–0,6 GB VRAM per miljard parameters nodig, plus ruimte voor context. Onderstaande tabel is een praktische orientatie, geen garantie.
| Modelklasse | Voorbeelden (aug 2026) | VRAM @ 4-bit | Passende hardware | Licentie |
|---|---|---|---|---|
| Compact (7–20B) | gpt-oss-20b, Qwen3-14B, Gemma 4 12B | ~5–16 GB | RTX 4090/5090 workstation | Apache 2.0 / eigen voorwaarden |
| Midden (30–120B) | gpt-oss-120b, Qwen3-32B, Qwen3-Coder-30B | ~20–65 GB | 1× RTX PRO 6000 96GB | Apache 2.0 |
| Groot (MoE 235B) | Qwen3-235B-A22B | ~140 GB | 2× RTX PRO 6000 96GB of 2× H200 | Apache 2.0 |
| Enterprise (400B) | Llama 4 Maverick, GLM-4.6 | ~200–230 GB | 2–4× H200 141GB | MIT / Llama Community License |
| Frontier (1T+) | DeepSeek V4, Kimi K2, GLM-5.1 | ~550 GB+ | 8× H200 node (bijv. Dell XE9680) | MIT / Modified MIT |
Let op licenties: Qwen3 (Apache 2.0), DeepSeek V4 en GLM (MIT) kennen geen gebruiksbeperkingen. Llama 4 heeft een commerciële grens bij 700 miljoen maandelijkse gebruikers en EU-beperkingen voor multimodaal gebruik. Controleer de licentie van het model dat u kiest.
Aannames in deze berekening
- → Wisselkoers: $1 = €0,92 (augustus 2026)
- → Energie: €0,25 per kWh, gemiddelde belasting 50% (24/7 draaiend)
- → Afschrijving hardware over 36 maanden + 10% beheer per jaar
- → On-premise marginale kosten per token ≈ €0 (zit in energie/beheer)
- → Geen reducties voor caching of batchkorting (~50%) meegenomen; die verlagen ook de cloudkosten
- → API-prijzen zijn een momentopname van 21 juli 2026 en veranderen regelmatig
Bronnen
- API-prijzen OpenAI, Anthropic en Google per 21-07-2026, overgenomen uit de officiële prijsdocumentatie van de providers (verzameld door Vibe Engines). Controleer altijd de actuele prijzen bij de provider zelf.
- DeepSeek V4 Flash API: $0,14/$0,28 per 1M tokens (providerlijstprijs, juli 2026).
- VRAM-inschattingen open modellen: modelkaarten Hugging Face en OrcaRouter VRAM-gids (10-08-2026) en Tech Insider open-modelvergelijking (juni 2026).
- RTX PRO 6000 96GB: NVIDIA MSRP $13.250 (juni 2026); straatprijs eerder in 2026 $8.000–9.200 — wij rekenen met de hoge MSRP.
- H200: $35.000–45.000 per GPU (2026-marktprijzen, o.a. WECENT Enterprise-gids).
- Dell PowerEdge XE9680 met 8× H200: EU-winkellisting €504.143 incl. btw (ServerMall, juli 2026); wij rekenen met €500.000.
- Energietarief €0,25/kWh is een conservatieve aanname voor NL zakelijk kleinverbruik; grote afnemers betalen vaak minder.
Wilt u deze berekening met uw eigen cijfers doorspreken?
We nemen uw werkelijke tokenverbruik, workloads en datacenterkosten door en toetsen of on-premise voor u klopt — inclusief een kwaliteitstest van open modellen op uw eigen data.
Plan een kennismaking