Outil gratuit
Que coûterait votre charge LLM — API ou votre propre matériel ?
Quatre options de déploiement, une charge de travail, des hypothèses éditables. Le chiffre intéressant est le seuil de rentabilité : le volume à partir duquel une installation auto-hébergée à coût fixe devient moins chère que payer au token. Tout tourne dans votre navigateur.
Votre charge de travail
Une requête ≈ une question sur un jeu d’extraits, une extraction, un brouillon. 1 000 tokens ≈ 750 mots.
Hypothèses de prix (à ajuster selon vos devis)
API phare (modèle frontière)
API efficiente (petit modèle rapide)
API open-weight hébergée en UE
Auto-hébergé (open-weight sur votre matériel)
Coût mensuel à votre volume
Les valeurs par défaut sont des ordres de grandeur indicatifs (revus le 28 août 2026) — remplacez-les par vos devis réels. Hors calcul : l'ingénierie du pipeline (dans les deux cas), les écarts de qualité entre modèles, et ce qui tranche souvent — résidence des données, confidentialité, piste d'audit AI Act. « Le moins cher » et « le permis » sont deux questions différentes ; le picker d'à côté traite la seconde.
Prix par défaut revus le : 28 août 2026. Revue trimestrielle.
La réponse du tableur n’est pas la réponse d’architecture
Nous opérons des modèles open-weight en production et ne vendons rien au token — notre lecture API vs auto-hébergé est donc sans marge cachée. Un debrief de 30 minutes vous en donne une honnête pour votre charge.

Mohamed Ben Haddou
Fondateur & CEO · Expert indépendant en IA auprès de la Commission européenne
Vous parlez à Mohamed, pas à une équipe commerciale — et la personne qui cadre votre mission est celle qui la réalise.
