Plan een kennismaking
Tools

AI-kostencalculator

Wat kost uw AI-gebruik via een cloud-API — en wat zou een open-source model op eigen hardware kosten? Deze calculator rekent met actuele API-prijzen en bewust conservatieve (dus hoge) hardware-inschattingen. Alle aannames en bronnen staan onderaan deze pagina.


1 · Uw gebruiksprofiel

2 · Huidige cloud-API

3 · On-premise alternatief

Cloud-API per maand
On-premise per maand
Besparing
Cloud-API
On-premise (TCO)
Terugverdientijd hardware

Cumulatieve kosten over 36 maanden

Cloud-API stijgt lineair met het verbruik · on-premise start met de hardware-investering en stijgt daarna langzaam (energie + beheer).

Cloud-API (cumulatief) On-premise (cumulatief) Break-evenpunt

Gekozen on-premise scenario

Modellen in deze klasse
Hardware
Benodigd VRAM
Indicatieve capaciteit

Dit is een conservatieve indicatie, geen offerte. Hardware is bewust aan de hoge kant ingeschat (o.a. MSRP-prijzen in een krappe markt). In de praktijk liggen de kosten vaak lager, bijvoorbeeld door inkoopkorting, hergebruik van bestaande servers of een lager energietarief. Kwaliteit van open modellen verschilt per toepassing — test daarom altijd met uw eigen data voordat u investeert.


Referentie

Welk open model past op welke hardware?

Vuistregel: bij 4-bit kwantisatie heeft een model ongeveer 0,5–0,6 GB VRAM per miljard parameters nodig, plus ruimte voor context. Onderstaande tabel is een praktische orientatie, geen garantie.

Modelklasse Voorbeelden (aug 2026) VRAM @ 4-bit Passende hardware Licentie
Compact (7–20B) gpt-oss-20b, Qwen3-14B, Gemma 4 12B ~5–16 GB RTX 4090/5090 workstation Apache 2.0 / eigen voorwaarden
Midden (30–120B) gpt-oss-120b, Qwen3-32B, Qwen3-Coder-30B ~20–65 GB 1× RTX PRO 6000 96GB Apache 2.0
Groot (MoE 235B) Qwen3-235B-A22B ~140 GB 2× RTX PRO 6000 96GB of 2× H200 Apache 2.0
Enterprise (400B) Llama 4 Maverick, GLM-4.6 ~200–230 GB 2–4× H200 141GB MIT / Llama Community License
Frontier (1T+) DeepSeek V4, Kimi K2, GLM-5.1 ~550 GB+ 8× H200 node (bijv. Dell XE9680) MIT / Modified MIT

Let op licenties: Qwen3 (Apache 2.0), DeepSeek V4 en GLM (MIT) kennen geen gebruiksbeperkingen. Llama 4 heeft een commerciële grens bij 700 miljoen maandelijkse gebruikers en EU-beperkingen voor multimodaal gebruik. Controleer de licentie van het model dat u kiest.


Transparantie

Aannames in deze berekening

  • Wisselkoers: $1 = €0,92 (augustus 2026)
  • Energie: €0,25 per kWh, gemiddelde belasting 50% (24/7 draaiend)
  • Afschrijving hardware over 36 maanden + 10% beheer per jaar
  • On-premise marginale kosten per token ≈ €0 (zit in energie/beheer)
  • Geen reducties voor caching of batchkorting (~50%) meegenomen; die verlagen ook de cloudkosten
  • API-prijzen zijn een momentopname van 21 juli 2026 en veranderen regelmatig
Feitencheck

Bronnen

  • API-prijzen OpenAI, Anthropic en Google per 21-07-2026, overgenomen uit de officiële prijsdocumentatie van de providers (verzameld door Vibe Engines). Controleer altijd de actuele prijzen bij de provider zelf.
  • DeepSeek V4 Flash API: $0,14/$0,28 per 1M tokens (providerlijstprijs, juli 2026).
  • VRAM-inschattingen open modellen: modelkaarten Hugging Face en OrcaRouter VRAM-gids (10-08-2026) en Tech Insider open-modelvergelijking (juni 2026).
  • RTX PRO 6000 96GB: NVIDIA MSRP $13.250 (juni 2026); straatprijs eerder in 2026 $8.000–9.200 — wij rekenen met de hoge MSRP.
  • H200: $35.000–45.000 per GPU (2026-marktprijzen, o.a. WECENT Enterprise-gids).
  • Dell PowerEdge XE9680 met 8× H200: EU-winkellisting €504.143 incl. btw (ServerMall, juli 2026); wij rekenen met €500.000.
  • Energietarief €0,25/kWh is een conservatieve aanname voor NL zakelijk kleinverbruik; grote afnemers betalen vaak minder.
Verlicht datacenter-gangpad dat naar een lichtpunt leidt
Volgende stap

Wilt u deze berekening met uw eigen cijfers doorspreken?

We nemen uw werkelijke tokenverbruik, workloads en datacenterkosten door en toetsen of on-premise voor u klopt — inclusief een kwaliteitstest van open modellen op uw eigen data.

Plan een kennismaking