Saltar al contenido
Aback Tools Logo

Calculadora de costes de Gemini

Estima gratis los gastos de la API de Gemini según tu uso de tokens. Admite comparación de modelos (Gemini 1.5, 2.5, 3.x), descuentos por caché de contexto y previsiones mensuales. Rápido, seguro y totalmente privado.

Gemini Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.

Input/1M: $1.50Output/1M: $9.00Cache/1M: $0.38

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$495.00for 30,000 total requests

Cost per Single Call

$0.0165

Input Token Cost

$0.007500

Output Token Cost

$0.009000

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Gemini 1.5 Flash-8B (Legacy)
In: $0.04/M • Out: $0.15/M • Cache: $0.01/M
$0.000338$10.13Caching Supported
Gemini 1.5 Flash (Legacy)
In: $0.07/M • Out: $0.30/M • Cache: $0.02/M
$0.000675$20.25Caching Supported
Gemini 3.1 Flash-Lite
In: $0.25/M • Out: $1.50/M • Cache: $0.06/M
$0.002750$82.50Std. Caching
Gemini 2.5 Flash
In: $0.30/M • Out: $2.50/M • Cache: $0.07/M
$0.004000$120.00Std. Caching
Gemini 1.0 Pro (Legacy)
In: $0.50/M • Out: $1.50/M • Cache: $0.13/M
$0.004000$120.00Std. Caching
Gemini 3 Flash (Preview)
In: $0.50/M • Out: $3.00/M • Cache: $0.13/M
$0.005500$165.00Std. Caching
Gemini 1.5 Pro (Legacy)
In: $1.25/M • Out: $5.00/M • Cache: $0.31/M
$0.0112$337.50Caching Supported
Gemini 2.5 Pro
In: $1.25/M • Out: $10.00/M • Cache: $0.31/M
$0.0163$487.50Std. Caching
Gemini 3.5 FlashCost-Effective Selected
In: $1.50/M • Out: $9.00/M • Cache: $0.38/M
$0.0165$495.00Std. Caching
Gemini 3.1 Pro (Preview)Capable
In: $2.00/M • Out: $12.00/M • Cache: $0.50/M
$0.0220$660.00Std. Caching
Calculations Disclaimer: Estimations are computed based on standard per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), Google Cloud tax schedules, or custom SLA pricing. Context Caching rates apply standardly at a 75% input tokens discount.

Qué compone la factura de Gemini

En Gemini el coste depende del modelo, de la proporción entre tokens de entrada y salida y, en el caso multimodal, de cuántos medios envías convertidos a tokens equivalentes.

Introduce tokens de texto, número de imágenes, segundos de audio y vídeo, y el volumen de consultas para ver el coste por consulta y la previsión mensual.

  • Los tokens de salida cuestan entre 3 y 8 veces más que los de entrada.
  • Las imágenes se facturan en torno a 258 tokens cada una.
  • Cada segundo de vídeo equivale a unos 258 tokens, así que los clips largos encarecen rápido.

Caché de contexto y Batch API

Ambas reducen el precio, pero exigen condiciones distintas. La caché requiere contenido repetido; el Batch exige tolerar 24 horas de latencia.

  • Caché de contexto: hasta un 75 % más barata en los tokens de entrada reutilizados.
  • Batch API: 50 % de descuento cuando no necesitas respuesta en tiempo real.
  • Combínalas cuando el mismo contexto largo se reutiliza en procesos por lotes.

Comparar modelos de la familia Gemini

La familia cubre desde tareas de alto volumen y bajo coste hasta razonamiento con contextos muy largos. La elección del modelo es la palanca que más mueve la factura.

  1. Mide los tokens reales de una consulta representativa, incluidos los medios.
  2. Calcula el coste por consulta con el modelo que usas hoy.
  3. Compara con otras variantes de Gemini manteniendo la misma carga.
  4. Aplica caché o Batch si encaja con tu patrón de uso y revisa la previsión final.

Preguntas frecuentes

Es una herramienta que estima el precio de la API de Google Gemini a partir de tus tokens de entrada y salida, los volúmenes de consultas y la configuración de modelo. Ayuda a los desarrolladores a planificar presupuestos y elegir el modelo Gemini más rentable para su carga de trabajo. Funciona íntegramente en tu navegador y no requiere registro.

Usa las tarifas estándar de pago por uso de la documentación oficial de Google AI Studio y Vertex AI. Aun así, los costes reales pueden variar según políticas fiscales regionales, créditos promocionales, planes de precios personalizados o actualizaciones de Google en los precios de la API. Consulta siempre la página oficial de precios para las tarifas definitivas.

Los tokens de entrada representan el texto o contenido multimedia que envías en tu prompt al modelo. Los tokens de salida representan el texto de respuesta generado por el modelo. Generarlos es computacionalmente más costoso, por lo que se facturan bastante más caros (normalmente entre 3 y 8 veces) que los tokens de entrada en todos los modelos Gemini.

La caché de contexto permite almacenar grandes bloques repetitivos de contenido (como un repositorio de código extenso, un libro o instrucciones de sistema largas) en la caché de Google. Cuando consultas el modelo, este lee de la caché en lugar de reprocesar todo el prompt. Los tokens de entrada cacheados se cobran con un descuento enorme (habitualmente un 75 % más baratos que los de entrada estándar).

La Batch API de Google está pensada para cargas que no son sensibles a la latencia (como traducción masiva, indexación offline o resumen). En lugar de ejecutarse en tiempo real, las peticiones por lotes se procesan en segundo plano en un plazo de 24 horas. Usarla da un 50 % de descuento automático en todos los costes de tokens de entrada y salida.

Gemini es un modelo multimodal nativo y factura los medios convirtiéndolos a un número equivalente de tokens. El texto se tokeniza de forma estándar. Las imágenes suelen facturarse a 258 tokens cada una. El audio se factura a 32 tokens por segundo y el vídeo a 258 tokens por segundo. Nuestra calculadora permite introducir cantidades y duraciones de medios para estimar estos costes automáticamente.

No. La calculadora funciona íntegramente en el lado del cliente, en tu navegador. Tus datos de entrada, tamaños de tokens, costes estimados y resultados de comparación se procesan localmente en tu dispositivo y nunca se envían a un servidor. Tus datos permanecen 100 % privados y seguros.