Gratis tool
Wat zou uw LLM-werklast kosten — API of eigen hardware?
Vier deployment-opties, één werklast, bewerkbare aannames. Het interessante getal is de break-even: het volume waarbij een vaste zelf-gehoste opstelling goedkoper wordt dan per token betalen. Alles draait in uw browser.
Uw werklast
Eén verzoek ≈ één vraag over een set documentfragmenten, één extractie, één concept. 1.000 tokens ≈ 750 woorden.
Prijsaannames (pas aan naar uw offertes)
Vlaggenschip-API (frontier-model)
Efficiënte API (klein/snel model)
EU-gehoste open-weight API
Zelf gehost (open-weight op uw hardware)
Maandkost bij uw volume
De standaardwaarden zijn indicatieve grootteordes (herzien op 28 augustus 2026) — vervang ze door echte offertes. Niet in de berekening: de engineering van de pijplijn (in beide gevallen), kwaliteitsverschillen tussen modellen, en wat vaak de doorslag geeft — dataresidentie, vertrouwelijkheid, het AI Act-auditspoor. Goedkoopst en toegestaan zijn twee verschillende vragen; de picker hiernaast behandelt de tweede.
Standaardprijzen laatst herzien: 28 augustus 2026. Driemaandelijkse herziening.
Het spreadsheet-antwoord is niet het architectuur-antwoord
Wij draaien open-weight modellen in productie en verkopen niets per token — onze kijk op API vs zelf hosten bevat dus geen verborgen marge. Een debrief van 30 minuten geeft u een eerlijke lezing voor uw werklast.

Mohamed Ben Haddou
Oprichter & CEO · Onafhankelijk AI-expert voor de Europese Commissie
U praat met Mohamed, niet met een salesteam — en wie uw opdracht afbakent, voert ze ook uit.
