Теперь система будет учитывать реальную вычислительную сложность запросов: объем используемых моделей, длину контекста и сложность выполняемых функций. Лимиты будут сбрасываться каждые пять часов. Это прагматичный макроэкономический маневр. Стоимость содержания GPU-кластеров заставляет бигтех закручивать гайки: эпоха "безлимитных" ИИ-ассистентов завершена. Корпорации будут заставлять пользователей (как B2C, так и B2B) платить за каждый "сожженный" такт процессора. Этот тренд на динамическое ценообразование вскоре станет индустриальным стандартом, заставляя разработчиков тщательно оптимизировать свои промпты.
Источник: Google Support
PricingGoogleGeminiUnit EconomicsMacroeconomics