El sistema ahora tendrá en cuenta la complejidad computacional real de las consultas: el volumen de los modelos utilizados, la longitud del contexto y la complejidad de las funciones ejecutadas. Los límites se restablecerán cada cinco horas. Se trata de una maniobra macroeconómica pragmática. El coste de mantener clústeres de GPU está obligando a las grandes tecnológicas a apretar las tuercas: la era de los asistentes de IA "ilimitados" ha terminado. Las corporaciones obligarán a los usuarios (tanto B2C como B2B) a pagar por cada ciclo de procesador "quemado". Esta tendencia hacia la fijación de precios dinámicos pronto se convertirá en un estándar de la industria, obligando a los desarrolladores a optimizar cuidadosamente sus prompts.
Fuente: Soporte de Google
PreciosGoogleGeminiEconomía UnitariaMacroeconomía