Google перевела Gemini с фиксированных дневных лимитов запросов на «compute-based» систему. Теперь расход зависит не от количества промптов, а от того, сколько вычислений съедает диалог.

Компания описывает новую схему в документе поддержки Google. Формулировки там общие, но логика понятна: «тяжёлые» функции и длинные чаты теперь быстрее приближают к недельному потолку.

Лимит теперь зависит от сложности запроса и включённых функций

В новой модели Google считает «вычисления» по нескольким параметрам. В документе компании прямо перечислены факторы, которые влияют на расход лимита.

Продолжение после рекламы
  • Сложность промпта: чем он тяжелее для модели, тем дороже по лимиту.
  • Используемые функции: генерация изображений и видео, deep research, а также работа с Pro и extended-thinking или Deep Think-моделями.
  • Длина чата: чем дольше переписка, тем выше итоговая стоимость по вычислениям.

Точные числа Google не раскрывает. Компания ограничивается тем, что платные пользователи получают больше «запаса» вычислений, чем бесплатные.

Обновление лимитов каждые 5 часов, но с недельным потолком

Ещё одно изменение — теперь лимит обновляется не раз в сутки. По правилам Google, compute-based лимиты обновляются каждые 5 часов, пока вы не упрётесь в недельный лимит.

Для пользователей это означает простую вещь. Можно «выжечь» недельный бюджет за пару длинных сессий с агентными функциями, даже если запросов было немного.

Изображение к статье: Google меняет лимиты Gemini: вместо запросов считают «вычисления»

Сколько дают платные тарифы: x2, x4 и x20 к «стандарту»

В документе Google есть конкретика по множителям для подписок. Компания привязывает их к «standard limits» — базовым лимитам для пользователей без плана.

  • Google AI Plus за $8 (около 1 000 рублей): лимиты в 2 раза выше стандартных.
  • AI Pro за $20 (около 2 000 рублей): лимиты в 4 раза выше стандартных.
  • AI Ultra
  • за $250 (около 25 000 рублей): лимиты в 20 раз выше стандартных.

Раньше логика была проще: лимит считали по запросам в день, без поправки на «тяжесть» промпта. Пример из прежней схемы: пользователи Google AI Pro получали до 100 промптов в день для Gemini Pro 3.1, даже если запросы отличались по сложности.

Почему провайдеры уходят от «плоских» лимитов

Сдвиг в сторону compute-based лимитов совпадает с тем, как меняются потребительские ИИ-сервисы. Провайдеры упираются в то, что агентные функции запускают подзадачи и могут съедать десятки тысяч токенов за один «запрос» в несколько ходов.

Похожий разворот недавно сделал GitHub: компания переработала планы Copilot и перешла от модели «premium request units» к «AI Credits», которые считают фактические токены в обменах с ИИ.

На этом фоне выделяется Anthropic. Компания недавно удвоила лимиты Claude Code для планов Claude Pro и Max, но сделала это после сделки со SpaceX, чтобы нарастить вычислительные мощности. И в прошлом месяце топ-менеджер Anthropic публично признал, что текущие планы Pro и Max «не строили» под функции уровня Claude Code и Cowork.

Gemini по новой схеме обновляет лимит каждые 5 часов, но останавливается на недельном потолке, а максимальный множитель для подписки AI Ultra — x20 к стандартным лимитам.

Продолжение после рекламы

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.