Содержание
Google перевела Gemini с фиксированных дневных лимитов запросов на «compute-based» систему. Теперь расход зависит не от количества промптов, а от того, сколько вычислений съедает диалог.
Компания описывает новую схему в документе поддержки Google. Формулировки там общие, но логика понятна: «тяжёлые» функции и длинные чаты теперь быстрее приближают к недельному потолку.
Лимит теперь зависит от сложности запроса и включённых функций
В новой модели Google считает «вычисления» по нескольким параметрам. В документе компании прямо перечислены факторы, которые влияют на расход лимита.
- Сложность промпта: чем он тяжелее для модели, тем дороже по лимиту.
- Используемые функции: генерация изображений и видео, deep research, а также работа с Pro и extended-thinking или Deep Think-моделями.
- Длина чата: чем дольше переписка, тем выше итоговая стоимость по вычислениям.
Точные числа Google не раскрывает. Компания ограничивается тем, что платные пользователи получают больше «запаса» вычислений, чем бесплатные.
Обновление лимитов каждые 5 часов, но с недельным потолком
Ещё одно изменение — теперь лимит обновляется не раз в сутки. По правилам Google, compute-based лимиты обновляются каждые 5 часов, пока вы не упрётесь в недельный лимит.
Для пользователей это означает простую вещь. Можно «выжечь» недельный бюджет за пару длинных сессий с агентными функциями, даже если запросов было немного.
Сколько дают платные тарифы: x2, x4 и x20 к «стандарту»
В документе Google есть конкретика по множителям для подписок. Компания привязывает их к «standard limits» — базовым лимитам для пользователей без плана.
- Google AI Plus за $8 (около 1 000 рублей): лимиты в 2 раза выше стандартных.
- AI Pro за $20 (около 2 000 рублей): лимиты в 4 раза выше стандартных.
- AI Ultra
за $250 (около 25 000 рублей): лимиты в 20 раз выше стандартных.
Раньше логика была проще: лимит считали по запросам в день, без поправки на «тяжесть» промпта. Пример из прежней схемы: пользователи Google AI Pro получали до 100 промптов в день для Gemini Pro 3.1, даже если запросы отличались по сложности.
Почему провайдеры уходят от «плоских» лимитов
Сдвиг в сторону compute-based лимитов совпадает с тем, как меняются потребительские ИИ-сервисы. Провайдеры упираются в то, что агентные функции запускают подзадачи и могут съедать десятки тысяч токенов за один «запрос» в несколько ходов.
Похожий разворот недавно сделал GitHub: компания переработала планы Copilot и перешла от модели «premium request units» к «AI Credits», которые считают фактические токены в обменах с ИИ.
На этом фоне выделяется Anthropic. Компания недавно удвоила лимиты Claude Code для планов Claude Pro и Max, но сделала это после сделки со SpaceX, чтобы нарастить вычислительные мощности. И в прошлом месяце топ-менеджер Anthropic публично признал, что текущие планы Pro и Max «не строили» под функции уровня Claude Code и Cowork.
Gemini по новой схеме обновляет лимит каждые 5 часов, но останавливается на недельном потолке, а максимальный множитель для подписки AI Ultra — x20 к стандартным лимитам.