Aller au contenu
Aback Tools Logo

Calculateur de coûts Gemini

Estimez gratuitement les dépenses de l'API Gemini selon votre usage de tokens. Prise en charge des comparaisons de modèles (Gemini 1.5, 2.5, 3.x), des remises de cache de contexte et des prévisions mensuelles. Rapide, sécurisé et totalement privé.

Gemini Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.

Input/1M: $1.50Output/1M: $9.00Cache/1M: $0.38

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$495.00for 30,000 total requests

Cost per Single Call

$0.0165

Input Token Cost

$0.007500

Output Token Cost

$0.009000

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Gemini 1.5 Flash-8B (Legacy)
In: $0.04/M • Out: $0.15/M • Cache: $0.01/M
$0.000338$10.13Caching Supported
Gemini 1.5 Flash (Legacy)
In: $0.07/M • Out: $0.30/M • Cache: $0.02/M
$0.000675$20.25Caching Supported
Gemini 3.1 Flash-Lite
In: $0.25/M • Out: $1.50/M • Cache: $0.06/M
$0.002750$82.50Std. Caching
Gemini 2.5 Flash
In: $0.30/M • Out: $2.50/M • Cache: $0.07/M
$0.004000$120.00Std. Caching
Gemini 1.0 Pro (Legacy)
In: $0.50/M • Out: $1.50/M • Cache: $0.13/M
$0.004000$120.00Std. Caching
Gemini 3 Flash (Preview)
In: $0.50/M • Out: $3.00/M • Cache: $0.13/M
$0.005500$165.00Std. Caching
Gemini 1.5 Pro (Legacy)
In: $1.25/M • Out: $5.00/M • Cache: $0.31/M
$0.0112$337.50Caching Supported
Gemini 2.5 Pro
In: $1.25/M • Out: $10.00/M • Cache: $0.31/M
$0.0163$487.50Std. Caching
Gemini 3.5 FlashCost-Effective Selected
In: $1.50/M • Out: $9.00/M • Cache: $0.38/M
$0.0165$495.00Std. Caching
Gemini 3.1 Pro (Preview)Capable
In: $2.00/M • Out: $12.00/M • Cache: $0.50/M
$0.0220$660.00Std. Caching
Calculations Disclaimer: Estimations are computed based on standard per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), Google Cloud tax schedules, or custom SLA pricing. Context Caching rates apply standardly at a 75% input tokens discount.

Ce qui compose une facture Gemini

Chez Gemini, le coût dépend du modèle, du ratio entre tokens d'entrée et de sortie et, en multimodal, du volume de médias convertis en tokens équivalents.

Saisissez tokens de texte, nombre d'images, secondes d'audio et de vidéo, ainsi que le volume de requêtes pour voir le coût par requête et la prévision mensuelle.

  • Les tokens de sortie coûtent 3 à 8 fois plus cher que ceux d'entrée.
  • Les images sont facturées environ 258 tokens chacune.
  • Chaque seconde de vidéo équivaut à environ 258 tokens : les longs clips coûtent vite cher.

Cache de contexte et Batch API

Les deux réduisent le prix, mais sous conditions différentes. Le cache exige du contenu répété ; le Batch exige de tolérer 24 heures de latence.

  • Cache de contexte : jusqu'à 75 % moins cher sur les tokens d'entrée réutilisés.
  • Batch API : 50 % de remise quand la réponse en temps réel n'est pas nécessaire.
  • Combinez-les lorsque le même contexte long est réutilisé dans des traitements par lots.

Comparer les modèles de la famille Gemini

La famille couvre du haut volume à faible coût jusqu'au raisonnement à très long contexte. Le choix du modèle est le levier le plus puissant sur la facture.

  1. Mesurez les tokens réels d'une requête représentative, médias inclus.
  2. Calculez le coût par requête avec votre modèle actuel.
  3. Comparez avec d'autres variantes Gemini à charge de travail identique.
  4. Activez cache ou Batch si votre usage le permet et vérifiez la prévision finale.

Foire aux questions

C'est un outil qui estime la tarification de l'API Google Gemini selon vos tokens d'entrée et de sortie, vos volumes de requêtes et vos configurations de modèle. Il aide les développeurs à planifier leurs budgets et à choisir le modèle Gemini le plus économique pour leur charge. Il fonctionne entièrement dans votre navigateur, sans inscription.

Notre calculateur utilise les tarifs Pay-As-You-Go standards de la documentation officielle de Google AI Studio et Vertex AI. Les coûts réels peuvent varier selon les politiques fiscales régionales, les crédits promotionnels, les plans personnalisés ou les mises à jour tarifaires de Google. Consultez toujours la page de tarification officielle pour les tarifs définitifs.

Les tokens d'entrée représentent le texte ou le média envoyé dans votre prompt. Les tokens de sortie représentent la réponse générée par le modèle. Leur génération est plus coûteuse en calcul, ils sont donc facturés nettement plus cher (généralement 3 à 8 fois plus) que les tokens d'entrée sur tous les modèles Gemini.

Le cache de contexte permet de stocker de grands blocs répétitifs (base de code volumineuse, livre, longues instructions système) dans le cache de Google. Lors d'une requête, le modèle lit le cache au lieu de retraiter tout le prompt. Les tokens d'entrée en cache bénéficient d'une remise massive (souvent 75 % moins chers que les tokens d'entrée standard).

La Batch API de Google est conçue pour les charges non sensibles à la latence (traduction de masse, indexation hors ligne, résumé). Les requêtes par lots sont traitées en arrière-plan sous 24 heures plutôt qu'en temps réel. Son usage donne automatiquement 50 % de remise sur tous les coûts de tokens d'entrée et de sortie.

Gemini est un modèle multimodal natif : il facture les médias en les convertissant en nombres de tokens équivalents. Le texte est tokenisé normalement. Les images sont généralement facturées 258 tokens chacune. L'audio est facturé 32 tokens par seconde et la vidéo 258 tokens par seconde. Le calculateur permet de saisir nombres et durées pour estimer automatiquement ces coûts.

Non. Le calculateur fonctionne entièrement côté client dans votre navigateur. Vos saisies, tailles de tokens, coûts estimés et résultats de comparaison sont traités localement sur votre appareil et ne sont jamais envoyés à un serveur. Vos données restent 100 % privées et sécurisées.