Google reduce Gemini gratis a Flash-Lite el 9 de octubre. El nivel gratuito de tu app tampoco fue nunca un contrato

El 6 de octubre, The Verge informó de que Google está a punto de quitar Flash y Pro a quienes usan Gemini gratis. El centro de ayuda de Google lo confirma, en una página titulada «Changes to Gemini model access and limits»: a partir del 9 de octubre, las personas que usan la aplicación Gemini con una cuenta personal y sin suscripción de IA solo tendrán Flash-Lite.
El resto de la escalera también se mueve. Google AI Plus, a 4,99 $ al mes en EE. UU., conserva Flash-Lite y Flash pero pierde Pro, en una fecha que Google dice que cada suscriptor recibirá por correo electrónico. Pro se queda con AI Pro, a 19,99 $ al mes, y AI Ultra, desde 99,99 $. El día que escribo esto, la página de suscripciones de Google para EE. UU. todavía describe el plan gratuito como «Access to 3.6 Flash» y «Varying access to 3.1 Pro». A partir del 9 de octubre, el más pequeño de los tres modelos pasa a ser toda la oferta gratuita.
Construyo productos sobre Claude, no sobre Gemini. Aun así lo leí dos veces, porque la primera pregunta de un desarrollador es obvia: ¿afecta esto a la API?
Qué cambia y qué no
La respuesta es no, al menos no esta semana. Google limita el cambio a «Gemini Apps when you use a personal account» («aplicaciones Gemini cuando usas una cuenta personal»). Revisé las páginas para desarrolladores. La página de precios de la API de Gemini, actualizada el 6 de octubre, sigue listando Gemini 3.8 Flash como «Free of charge» («gratis») en el nivel gratuito, en entrada y salida, y lo mismo para Gemini 3.5 Flash-Lite. Las notas de versión de la API, actualizadas el mismo día, no anuncian ningún cambio en el nivel gratuito.
Así que si tu side project llama a la API de Gemini con una clave gratuita, el 9 de octubre es un día normal. Si tus usuarios hablan con Gemini a través de la aplicación de Google, pierden Flash.
En cuanto a los límites, las páginas públicas de Google no dan cifras en ninguno de los dos lados. En la aplicación, el uso de los mayores de 18 años es «compute-based» («basado en capacidad de cómputo») desde el 17 de mayo: los límites se renuevan cada cinco horas hasta llegar a un tope semanal, AI Plus recibe el doble del límite estándar y AI Pro cuatro veces. Para la API, la página de límites de tasa no imprime ninguna cifra del nivel gratuito. Te envía a AI Studio para ver los límites de cada proyecto, y añade: «Specified rate limits are not guaranteed and actual capacity may vary.» («Los límites de tasa indicados no están garantizados y la capacidad real puede variar.»)
El nivel gratuito de la API también se mueve, pero con más discreción
El cambio de la aplicación tuvo titular. Los de la API casi solo tuvieron una línea.
El modelo Pro actual, Gemini 3.1 Pro Preview, ya figura como «Not available» («no disponible») en el nivel gratuito de la API. El 18 de septiembre, las notas de versión anunciaron que el acceso a los modelos 2.5 queda limitado «to users who have actively used them in the past» («a los usuarios que los han usado activamente en el pasado»), y dijeron a los proyectos nuevos que usen 3.5 Flash-Lite o 3.8 Flash. En enero, en el foro de desarrolladores de Google, Logan Kilpatrick respondió en nombre de Google a personas cuya cuota diaria había bajado en el playground de AI Studio: «We did reduce the limits for free in the UI.» («Sí redujimos los límites gratuitos en la interfaz.») Añadió: «I expect the limits to continue to go down over time.» («Espero que los límites sigan bajando con el tiempo.») Era el playground, no la API, pero la dirección se dijo con claridad.
Incluso el precio de pago lleva fecha. Gemini 3.8 Flash cuesta 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de tokens de salida «through December 31, 2026» («hasta el 31 de diciembre de 2026»). Desde el 1 de enero de 2027, la misma página lista 1,50 $ y 7,50 $. La duplicación ya está publicada, a menos de tres meses.
Nada de esto es un escándalo. Un nivel gratuito es la capacidad sobrante de un proveedor, empaquetada como producto, y se encoge cuando se encoge la capacidad sobrante. La página de precios lo dice en su última línea: «Rate limits are subject to change.» («Los límites de tasa están sujetos a cambios.»)
Una dependencia que no firmaste
Si pagas una API, obtienes condiciones, una lista de precios y, a veces, un aviso. Si construyes sobre un nivel gratuito no obtienes nada de eso, y rara vez dejas por escrito que dependes de él. Nunca aparece en una factura, así que nunca aparece en una reunión de planificación.
Yo también empiezo la mayoría de mis side projects en niveles gratuitos o baratos. Lo que le reprocho a mi código antiguo no es el nivel gratuito en sí. Es que el ID del modelo está como cadena literal en varios archivos, que el error de límite de tasa cae en un bloque catch genérico y que nadie sabe cuántos tokens quema cada funcionalidad. Cuando cambia el nivel, una decisión de precios se convierte en una sesión de depuración.
Hay también una línea más discreta. La página de precios de Google dice que el contenido enviado en el nivel gratuito se «used to improve our products» («usa para mejorar nuestros productos»). En el nivel de pago, no. Para la LegalTech que construyo, donde los documentos de los clientes describen invenciones que nadie ha registrado todavía, esa línea por sí sola descarta un nivel gratuito.
Lo que construyo para que un nivel que desaparece sea un cambio de configuración
Cuatro cosas, todas baratas de añadir pronto.
Una sola puerta para cada llamada a un modelo. Toda llamada pasa por una única función que recibe el nombre de una funcionalidad, no el de un modelo. Un archivo de configuración asigna cada funcionalidad a un proveedor y a un modelo. Cuando un modelo sale de un nivel gratuito, cambio una línea de configuración. Si al buscar un ID de modelo aparece en más de un archivo, eso es lo primero que hay que arreglar.
Un plan B que se haya ejecutado de verdad. Cada funcionalidad recibe un segundo modelo, idealmente de otro proveedor, y una regla escrita sobre qué pasa cuando el primero dice que no: un 429 RESOURCE_EXHAUSTED (el error que Google documenta para sus límites de gasto), un timeout, un modelo que ya no responde. Decide por funcionalidad si falla abierto o cerrado. El pequeño modelo juez que ejecuto en un side project falla abierto durante un tiempo y luego empieza a rechazar tras ocho fallos consecutivos, porque lo que deja pasar no se puede recuperar. Después, pasa algo de tráfico real por el plan B cada semana. Un plan B que nunca ha servido una petición es una suposición.
Los tokens por funcionalidad, registrados en cada llamada. Guarda los tokens de entrada y de salida junto al nombre de la funcionalidad. Esa tabla convierte «el nivel gratuito ha desaparecido» en una cifra en cinco minutos. Digamos que una funcionalidad lee 20 millones de tokens de entrada y escribe 2 millones de salida al mes en Gemini 3.8 Flash. Al precio de pago hasta el 31 de diciembre, son 20 × 0,75 $ + 2 × 3,75 $ = 22,50 $ al mes. Desde el 1 de enero, son 20 × 1,50 $ + 2 × 7,50 $ = 45 $. Sin la tabla, estás adivinando tu propia factura.
Un tope y una alerta antes de la primera petición de pago. Desde marzo, AI Studio permite fijar un tope de gasto mensual por proyecto. Google lo etiqueta como experimental y avisa de que los datos de facturación pueden retrasarse unos diez minutos, así que los excesos siguen siendo posibles. Por encima, cada nivel de facturación tiene su propio techo mensual, 250 $ en el Tier 1. Y pasar a pago implica ahora prepagar al menos 5 $ de crédito: la documentación de facturación dice que la API «will only serve requests if you have a positive Prepay credit balance» («solo atenderá peticiones si tienes un saldo de crédito prepago positivo»). Un saldo vacío también es una caída, así que alerta sobre el saldo, no solo sobre el gasto.
Google acaba de mostrar el patrón
Lo curioso es que el cambio de Google es exactamente esta arquitectura, aplicada a sus propios usuarios. Cuando el cómputo es caro, manda el tráfico que menos paga al modelo más barato, guarda los mejores modelos para el tráfico que paga y cambia la asignación con una tabla, no con una reescritura. Flash-Lite pasa a ser el suelo.
Tu aplicación merece la misma palanca. Decide ahora qué funcionalidades podrían correr en un modelo de clase Lite si hiciera falta, y pruébalas en uno, una vez. Si la respuesta es «todas, algo peor», que desaparezca un nivel gratuito es un martes cualquiera. Si la respuesta es «ninguna», has encontrado una dependencia por la que vale la pena pagar, antes de que otro decida la fecha.
El lunes, busca IDs de modelo en tu código. El número de resultados es el número de sitios donde un solo correo de precios puede romper algo.
Fuentes
- The Verge, "Google is about to remove free access to Gemini Flash and Pro" (6 de octubre de 2026)
- Gemini Apps Help, "Changes to Gemini model access and limits" (consultado el 7 de octubre de 2026)
- Google, "Get more out of Gemini" (consultado el 7 de octubre de 2026)
- Google AI for Developers, "Gemini Developer API pricing" (actualizado el 6 de octubre de 2026)
- Google AI for Developers, "Release notes" (actualizado el 6 de octubre de 2026)
- Google AI for Developers, "Rate limits" (actualizado el 2 de septiembre de 2026)
- Google AI for Developers, "Billing" (actualizado el 28 de septiembre de 2026)
- Google AI Developers Forum, "Reduced Rate Limits" (25 de enero de 2026)
