Calculateur de coûts Gemini
Estimez gratuitement les dépenses de l'API Gemini selon votre usage de tokens. Prise en charge des comparaisons de modèles (Gemini 1.5, 2.5, 3.x), des remises de cache de contexte et des prévisions mensuelles. Rapide, sécurisé et totalement privé.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0165
Input Token Cost
$0.007500
Output Token Cost
$0.009000
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Gemini 1.5 Flash-8B (Legacy) In: $0.04/M • Out: $0.15/M • Cache: $0.01/M | $0.000338 | $10.13 | Caching Supported |
Gemini 1.5 Flash (Legacy) In: $0.07/M • Out: $0.30/M • Cache: $0.02/M | $0.000675 | $20.25 | Caching Supported |
Gemini 3.1 Flash-Lite In: $0.25/M • Out: $1.50/M • Cache: $0.06/M | $0.002750 | $82.50 | Std. Caching |
Gemini 2.5 Flash In: $0.30/M • Out: $2.50/M • Cache: $0.07/M | $0.004000 | $120.00 | Std. Caching |
Gemini 1.0 Pro (Legacy) In: $0.50/M • Out: $1.50/M • Cache: $0.13/M | $0.004000 | $120.00 | Std. Caching |
Gemini 3 Flash (Preview) In: $0.50/M • Out: $3.00/M • Cache: $0.13/M | $0.005500 | $165.00 | Std. Caching |
Gemini 1.5 Pro (Legacy) In: $1.25/M • Out: $5.00/M • Cache: $0.31/M | $0.0112 | $337.50 | Caching Supported |
Gemini 2.5 Pro In: $1.25/M • Out: $10.00/M • Cache: $0.31/M | $0.0163 | $487.50 | Std. Caching |
Gemini 3.5 FlashCost-Effective Selected In: $1.50/M • Out: $9.00/M • Cache: $0.38/M | $0.0165 | $495.00 | Std. Caching |
Gemini 3.1 Pro (Preview)Capable In: $2.00/M • Out: $12.00/M • Cache: $0.50/M | $0.0220 | $660.00 | Std. Caching |
Ce qui compose une facture Gemini
Chez Gemini, le coût dépend du modèle, du ratio entre tokens d'entrée et de sortie et, en multimodal, du volume de médias convertis en tokens équivalents.
Saisissez tokens de texte, nombre d'images, secondes d'audio et de vidéo, ainsi que le volume de requêtes pour voir le coût par requête et la prévision mensuelle.
- Les tokens de sortie coûtent 3 à 8 fois plus cher que ceux d'entrée.
- Les images sont facturées environ 258 tokens chacune.
- Chaque seconde de vidéo équivaut à environ 258 tokens : les longs clips coûtent vite cher.
Cache de contexte et Batch API
Les deux réduisent le prix, mais sous conditions différentes. Le cache exige du contenu répété ; le Batch exige de tolérer 24 heures de latence.
- Cache de contexte : jusqu'à 75 % moins cher sur les tokens d'entrée réutilisés.
- Batch API : 50 % de remise quand la réponse en temps réel n'est pas nécessaire.
- Combinez-les lorsque le même contexte long est réutilisé dans des traitements par lots.
Comparer les modèles de la famille Gemini
La famille couvre du haut volume à faible coût jusqu'au raisonnement à très long contexte. Le choix du modèle est le levier le plus puissant sur la facture.
- Mesurez les tokens réels d'une requête représentative, médias inclus.
- Calculez le coût par requête avec votre modèle actuel.
- Comparez avec d'autres variantes Gemini à charge de travail identique.
- Activez cache ou Batch si votre usage le permet et vérifiez la prévision finale.
Foire aux questions
C'est un outil qui estime la tarification de l'API Google Gemini selon vos tokens d'entrée et de sortie, vos volumes de requêtes et vos configurations de modèle. Il aide les développeurs à planifier leurs budgets et à choisir le modèle Gemini le plus économique pour leur charge. Il fonctionne entièrement dans votre navigateur, sans inscription.
Notre calculateur utilise les tarifs Pay-As-You-Go standards de la documentation officielle de Google AI Studio et Vertex AI. Les coûts réels peuvent varier selon les politiques fiscales régionales, les crédits promotionnels, les plans personnalisés ou les mises à jour tarifaires de Google. Consultez toujours la page de tarification officielle pour les tarifs définitifs.
Les tokens d'entrée représentent le texte ou le média envoyé dans votre prompt. Les tokens de sortie représentent la réponse générée par le modèle. Leur génération est plus coûteuse en calcul, ils sont donc facturés nettement plus cher (généralement 3 à 8 fois plus) que les tokens d'entrée sur tous les modèles Gemini.
Le cache de contexte permet de stocker de grands blocs répétitifs (base de code volumineuse, livre, longues instructions système) dans le cache de Google. Lors d'une requête, le modèle lit le cache au lieu de retraiter tout le prompt. Les tokens d'entrée en cache bénéficient d'une remise massive (souvent 75 % moins chers que les tokens d'entrée standard).
La Batch API de Google est conçue pour les charges non sensibles à la latence (traduction de masse, indexation hors ligne, résumé). Les requêtes par lots sont traitées en arrière-plan sous 24 heures plutôt qu'en temps réel. Son usage donne automatiquement 50 % de remise sur tous les coûts de tokens d'entrée et de sortie.
Gemini est un modèle multimodal natif : il facture les médias en les convertissant en nombres de tokens équivalents. Le texte est tokenisé normalement. Les images sont généralement facturées 258 tokens chacune. L'audio est facturé 32 tokens par seconde et la vidéo 258 tokens par seconde. Le calculateur permet de saisir nombres et durées pour estimer automatiquement ces coûts.
Non. Le calculateur fonctionne entièrement côté client dans votre navigateur. Vos saisies, tailles de tokens, coûts estimés et résultats de comparaison sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur. Vos données restent 100 % privées et sécurisées.