Cómo funcionan las nuevas tarifas de Gemini de Google y cómo rastrear tu uso

Google reformó por completo la facturación de su plataforma de inteligencia artificial Gemini este verano, introduciendo una estructura de precios más detallada que varía según el modelo, la tarea y el volumen de datos, cambios que significan que los usuarios podrían recibir menos respuestas por el mismo nivel de gasto a menos que rastreen activamente su consumo.

La nueva estructura de precios divide los costos en varios componentes. Los tokens de entrada representan el texto, las imágenes o los archivos enviados al modelo; los tokens de salida representan la respuesta del modelo. Cada modelo Gemini tiene una tarifa distinta, y las funciones opcionales, como ventanas de contexto más grandes, añaden costos adicionales. El anclaje con Google Search, por ejemplo, añade un recargo por consulta de 35 dólares por cada 1,000 instrucciones para los modelos Gemini 2.5 y 2.0 más allá de los límites gratuitos diarios, y de 14 dólares por cada 1,000 para los modelos Gemini 3.

Google también reestructuró sus niveles de suscripción para consumidores. El nuevo nivel de entrada Google AI Plus, introducido en julio de 2026, ofrece 400 gigabytes de almacenamiento y el doble de los límites de uso del nivel gratuito por 7.99 dólares al mes. Por encima, Google AI Pro cuesta 19.99 dólares al mes (antes Google One AI Premium, ahora con 5 terabytes de almacenamiento) y Google AI Ultra comienza en 99.99 dólares al mes con 20 terabytes de almacenamiento y acceso a las capacidades de Deep Think. Un nivel premium de 200 dólares al mes dentro de Ultra añade capacidad adicional.

Para los desarrolladores, la API de Gemini sigue siendo de pago por uso. Gemini 3.5 Flash cuesta 1.50 dólares por millón de tokens de entrada y 9 dólares por millón de tokens de salida. Gemini 2.5 Pro cuesta 1.25 y 10 dólares respectivamente. Un SKU de precios para agentes llamado AlphaEvolve, añadido en julio de 2026, aplica un recargo transparente de 2x sobre la tarifa base del modelo, lo que hace que el costo total sea exactamente tres veces el precio del modelo subyacente.

El impacto en la facturación es fácil de subestimar. Diez mil solicitudes con 2,000 tokens de entrada y 1,000 tokens de salida cada una consumen 30 millones de tokens. Incluso con tarifas bajas por token, el total se acumula rápidamente. Usar un modelo premium innecesariamente, lo que un analista describió como “tomar un taxi en lugar de un autobús”, amplifica el efecto.

Google proporciona varias herramientas para rastrear el uso. La consola de facturación muestra el gasto por proyecto y por modelo. Las páginas de uso desglosan los recuentos de tokens de entrada y salida. Los registros de la API ofrecen granularidad por solicitud. Se recomienda establecer alertas de presupuesto al 50, 80 y 100 por ciento de los límites mensuales, así como etiquetar los proyectos por caso de uso, soporte de chatbot, asistencia de codificación, búsqueda de documentos, para identificar qué función genera el mayor consumo.

Los pequeños cambios en la estructura de las instrucciones pueden generar ahorros significativos. Reducir cada instrucción en un 25 por ciento en un sistema que procesa 25,000 conversaciones diarias con un promedio de 800 tokens de entrada y 500 tokens de salida ahorra millones de tokens al mes sin reducir el volumen de chat. Igualar la fortaleza del modelo con la complejidad de la tarea, usando modelos más baratos para clasificación y etiquetado mientras se reservan los modelos premium para razonamiento complejo, es otra palanca.

“Los precios de la IA de Google son manejables si los mides de cerca, eliges el modelo correcto y estableces alertas de gasto estrictas”, aconseja la empresa.

Fuentes: How Google’s New Gemini Rates Work and How to Track Your Usage (Wired, julio de 2026); Google Gemini Pricing (UsagePricing, julio de 2026)

Traducido por Alessandra

Scroll to Top