Gratis tool

Wat zou uw LLM-werklast kosten — API of eigen hardware?

Vier deployment-opties, één werklast, bewerkbare aannames. Het interessante getal is de break-even: het volume waarbij een vaste zelf-gehoste opstelling goedkoper wordt dan per token betalen. Alles draait in uw browser.

Uw werklast

Eén verzoek ≈ één vraag over een set documentfragmenten, één extractie, één concept. 1.000 tokens ≈ 750 woorden.

Prijsaannames (pas aan naar uw offertes)

Vlaggenschip-API (frontier-model)

Efficiënte API (klein/snel model)

EU-gehoste open-weight API

Zelf gehost (open-weight op uw hardware)

Maandkost bij uw volume

    De standaardwaarden zijn indicatieve grootteordes (herzien op 28 augustus 2026) — vervang ze door echte offertes. Niet in de berekening: de engineering van de pijplijn (in beide gevallen), kwaliteitsverschillen tussen modellen, en wat vaak de doorslag geeft — dataresidentie, vertrouwelijkheid, het AI Act-auditspoor. Goedkoopst en toegestaan zijn twee verschillende vragen; de picker hiernaast behandelt de tweede.

    Standaardprijzen laatst herzien: 28 augustus 2026. Driemaandelijkse herziening.

    Het spreadsheet-antwoord is niet het architectuur-antwoord

    Wij draaien open-weight modellen in productie en verkopen niets per token — onze kijk op API vs zelf hosten bevat dus geen verborgen marge. Een debrief van 30 minuten geeft u een eerlijke lezing voor uw werklast.

    Mohamed Ben Haddou

    Mohamed Ben Haddou

    Oprichter & CEO · Onafhankelijk AI-expert voor de Europese Commissie

    U praat met Mohamed, niet met een salesteam — en wie uw opdracht afbakent, voert ze ook uit.