Calculateur de coût API LLM vs auto-hébergement
activeEntrez votre ratio de tokens, votre coût serveur, votre taux de change : comparez Claude, GPT-5 et Gemini face à un serveur GPU auto-hébergé, en direct.
calculateur · mise à jour 24 août 2026
Les trois chiffres publiés sur le seuil de rentabilité de l'auto-hébergement face à l'API Claude reposent sur les tarifs Claude, un serveur Hetzner GEX44 et l'un de trois ratios entrée/sortie fixes. Les workloads réels tombent rarement exactement sur l'une de ces neuf cases, et Claude n'est pas le seul modèle à comparer face à votre propre serveur. Ce calculateur applique la même formule à vos propres chiffres, sur cinq paliers Claude plus GPT-5 et Gemini.
Ce que calcule cet outil
La même arithmétique de prix mixte que la fiche source : choisissez un modèle, renseignez votre ratio entrée/sortie réel (votre tableau de bord de consommation API le rapporte séparément pour les deux), et entrez le coût mensuel du serveur auto-hébergé que vous comparez réellement, en EUR. Le résultat est le volume mensuel de tokens, en millions, auquel ce coût fixe atteint le seuil de rentabilité face au paiement au token.
Le champ EUR/USD est pré-rempli avec le taux utilisé dans la fiche source, mais modifiable : les taux de change bougent, et le chiffre que vous obtenez ne devrait pas reposer sur un instantané qui appartient à quelqu'un d'autre.
Ce que cet outil ne fait pas
Il ne tient pas compte de la charge de travail liée à l'administration et à la maintenance d'un serveur, de l'écart de qualité entre un modèle frontier et le modèle open source que votre serveur fait réellement tourner, ni d'un tarif entreprise négocié qui s'écarterait des tarifs publics d'un éditeur. Il ne couvre pas non plus les modèles open weight (Llama, Qwen, DeepSeek, Mistral...) : ceux-ci sont généralement le côté auto-hébergé de cette comparaison, pas une API facturée au token. La fiche source détaille les mises en garde propres à Claude ; lisez-la avant de traiter le chiffre ci-dessous comme une décision d'achat plutôt qu'une première estimation.
Sources
Tarification de l'API Claude : documentation de tarification de la plateforme Claude d'Anthropic. Tarification GPT-5 : page de tarification API d'OpenAI. Tarification Gemini : page de tarification de l'API Gemini de Google (palier standard, prompts inférieurs à 200 K tokens). Spécification du serveur utilisé par défaut : matrice des serveurs GPU dédiés Hetzner. Taux de change par défaut : taux de référence euro de la BCE.
Testez vos propres chiffres
Les trois champs ci-dessous appliquent la même formule que le script de reproduction de la fiche source : le modèle, votre ratio entrée:sortie et le coût mensuel fixe de votre alternative auto-hébergée. Le résultat se recalcule à chaque saisie.
Seuil de rentabilité