🔄
Актуальность: проверено 10 сентября 2026 года по официальным страницам моделей, вывода версий из эксплуатации, тарифов и лимитов. Линейка и цены меняются быстро, поэтому перед запуском в продакшене сверяйте идентификатор, статус и тариф модели.

Google Gemini — семейство мультимодальных моделей Google. Разработчики могут обращаться к ним через Gemini Developer API и Google AI Studio, а для потоковых голосовых и мультимодальных приложений предусмотрен Live API.

Главное изменение к сентябрю 2026 года: основной стабильной Flash-моделью стала Gemini 3.8 Flash, выпущенная 2 сентября. Gemini 3.7 Flash теперь обозначена как модель предыдущего поколения.

Содержание

  1. Какую модель выбрать
  2. Специализированные и аудиомодели
  3. Подключение к Gemini API
  4. Тарифы и лимиты API
  5. Полезные сценарии
  6. Проверка результата
  7. Ограничения и официальные ссылки

Какую модель выбрать

МодельСтатусДля каких задач подходит
gemini-3.8-flashСтабильная, сентябрь 2026Длительная работа с кодом, автономные агенты и сложные корпоративные процессы. Основной выбор среди Flash-моделей для новых проектов
gemini-3.7-flashСтабильная, предыдущее поколениеКод, агентные процессы и многошаговые задачи в существующих интеграциях
gemini-3.6-flashСтабильная, предыдущее поколениеУниверсальные и мультимодальные задачи, если проект уже привязан к этой версии
gemini-3.5-flashСтабильная, устаревающая (legacy)Рутинные запросы и действующие интеграции
gemini-3.5-flash-liteСтабильнаяМассовые простые запросы, перевод и обработка данных с приоритетом стоимости
gemini-3.1-pro-previewПредварительнаяСложное решение задач, мультимодальный анализ и агентный кодинг, когда возможностей Flash недостаточно
gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-liteДоступныСовместимость с существующими системами; даты отключения основных текстовых версий пока не объявлены

Для gemini-3.8-flash, gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash и gemini-3.5-flash-lite даты отключения на 10 сентября 2026 года не объявлены.

Утверждение об отключении всех Gemini 2.5 в октябре 2026 года неверно. Дата 2 октября 2026 года относится только к модели изображений gemini-2.5-flash-image. В таблице Google для неё всё ещё указана замена gemini-3.1-flash-image-preview, хотя этот preview-эндпоинт уже отключён. В текущем каталоге доступна стабильная gemini-3.1-flash-image.

Для стабильной gemini-3.1-flash-lite самая ранняя дата возможного отключения — 7 мая 2027 года. Рекомендованная замена — gemini-3.5-flash-lite.

⚖️
Выбор для продакшена: используйте точный идентификатор стабильной модели. Предварительные версии могут иметь более строгие лимиты и выводятся из эксплуатации с уведомлением минимум за две недели.

Специализированные и аудиомодели

В каталоге есть отдельные модели для изображений, видео, речи, эмбеддингов, исследований и компьютерного управления:

  • gemini-3.1-flash-image — стабильная Nano Banana 2 для генерации и редактирования изображений;
  • gemini-3.1-flash-lite-image — экономичная версия для изображений;
  • gemini-3-pro-image — Nano Banana Pro для сложной компоновки и точной отрисовки текста;
  • gemini-omni-1.1-flash — стабильная модель генерации и редактирования видео с нативным аудио;
  • veo-3.1-generate-preview — генерация видео с расширенным творческим контролем;
  • gemini-embedding-2 — стабильная мультимодальная модель для текста, изображений, видео, аудио и PDF. В каталоге также указана строка gemini-embedding-2-preview, но в графике вывода из эксплуатации для preview-варианта embedding-2-preview указана дата отключения 10 августа 2026 года. Для новых интеграций используйте стабильный gemini-embedding-2.

Старая gemini-omni-flash-preview может быть отключена не раньше 30 сентября 2026 года. Её замена — gemini-omni-1.1-flash.

Gemini Live, перевод и работа с речью

  • gemini-3.1-flash-live-preview — актуальная модель Live API для голосовых диалогов с низкой задержкой;
  • gemini-3.5-live-translate-preview — потоковый перевод речи в речь с поддержкой более 70 языков;
  • gemini-3.5-transcribe — стабильная расшифровка с определением языка, разделением говорящих, временными метками слов и пользовательским словарём;
  • gemini-3.5-transcribe-live — потоковая расшифровка через WebSocket;
  • gemini-3.1-flash-tts-preview — управляемый синтез речи.

gemini-2.5-flash-native-audio-preview-12-2025 пока доступна, но Google рекомендует переходить на gemini-3.1-flash-live-preview. Для gemini-2.5-flash-preview-tts и gemini-2.5-pro-preview-tts рекомендуемой заменой указана gemini-3.1-flash-tts-preview.

Пользовательский режим Gemini Live в приложении позволяет разговаривать с моделью, перебивать её голосом, показывать изображение с камеры и делиться экраном. Возможности выпускаются постепенно и зависят от устройства, языка и аккаунта. В справке для Android указано, что Gemini Live пока недоступен в веб-приложении Gemini.


Подключение к Gemini API

Экспериментировать с моделями и получить API-ключ можно в Google AI Studio. Передавайте ключ через переменную окружения, не вставляя его в исходный код или публичный репозиторий.

Минимальный REST-запрос

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {"text": "Объясни принцип работы трансформера простыми словами"}
        ]
      }
    ]
  }'

Для Python используется пакет Google Gen AI SDK:

pip install google-genai

Перед переносом интеграции в продакшен зафиксируйте точный идентификатор модели. Алиас latest автоматически переключается между выпусками соответствующего варианта модели. При несовместимом изменении Google обещает уведомление за две недели.


Тарифы и лимиты API

Цены проверены 10 сентября 2026 года. Они относятся к стандартному платному режиму Gemini Developer API и указаны за 1 млн токенов. Цена выхода включает токены рассуждений.

МодельВходВыходБесплатный уровень
Gemini 3.8 Flash$0.75 до 31 декабря 2026, затем $1.50$3.75 до 31 декабря 2026, затем $7.50Есть
Gemini 3.7 Flash$0.75 до 31 декабря 2026, затем $1.50$3.75 до 31 декабря 2026, затем $7.50Есть
Gemini 3.6 Flash$0.75 до 31 декабря 2026, затем $1.50$3.75 до 31 декабря 2026, затем $7.50Есть
Gemini 3.5 Flash$1.50$9.00Есть
Gemini 3.5 Flash-Lite$0.30$2.50Есть
Gemini 3.1 Pro Preview$2.00 для запросов до 200 тыс. токенов, $4.00 для запросов выше$12.00 до 200 тыс., $18.00 вышеНет

Batch API снижает стоимость обработки на 50% для поддерживаемых моделей. Доступность конкретной модели и функции на бесплатном уровне проверяйте в актуальной таблице цен.

Как применяются лимиты

Gemini API учитывает несколько независимых ограничений:

  • запросы в минуту (RPM);
  • входные токены в минуту (TPM);
  • запросы в сутки (RPD);
  • для отдельных моделей — изображения или токены за период;
  • для некоторых платных проектов — расходы за скользящее десятиминутное окно.

Квоты применяются к проекту целиком, а не к отдельному API-ключу. Суточный лимит сбрасывается в полночь по тихоокеанскому времени. Фактические значения зависят от модели, уровня использования и состояния аккаунта; активные лимиты проекта отображаются в AI Studio.

Лимиты расходов составляют $10 за скользящее 10-минутное окно для уровня Tier 1, $50 для Tier 2 и $200 для Tier 3, если такое ограничение применяется к аккаунту. При превышении лимита расходов API возвращает 429 RESOURCE_EXHAUSTED.

Для Batch API отдельно установлены максимум 100 одновременных запросов, входной файл до 2 ГБ и хранилище файлов до 20 ГБ. Лимит поставленных в очередь токенов зависит от модели и уровня проекта.


Полезные сценарии

Универсальный помощник для документов и кода

Задача: анализировать документы, извлекать данные или выполнять многошаговую работу с кодом.

Что делать: начать с gemini-3.8-flash, передать текст или поддерживаемые мультимодальные данные и проверить результат на реальном наборе примеров.

Наблюдаемый результат: API возвращает содержательный ответ, а тестовый набор проходит заданные проверки качества и формата.

Ограничение: длинный контекст увеличивает расход токенов. Описание модели не гарантирует качество на конкретных данных, поэтому для критичных решений нужны собственные тесты.

Массовая обработка простых запросов

Задача: классифицировать, переводить или преобразовывать большое число коротких записей.

Что делать: сравнить gemini-3.5-flash-lite с gemini-3.8-flash на репрезентативной выборке, затем использовать Batch API для задач без требования мгновенного ответа.

Наблюдаемый результат: записи обработаны в требуемом формате, а стоимость и доля ошибок укладываются в установленный порог.

Ограничение: экономичная модель может хуже справляться со сложными рассуждениями.

Голосовой агент или потоковая расшифровка

Задача: создать двусторонний голосовой интерфейс либо получать текст во время разговора.

Что делать: выбрать gemini-3.1-flash-live-preview для диалога или gemini-3.5-transcribe-live для расшифровки.

Наблюдаемый результат: потоковая сессия принимает аудио и возвращает голосовой ответ либо текст без ожидания окончания всей записи.

Ограничение: Live-модель имеет статус preview, а качество и задержка зависят от языка, сигнала и сетевого соединения.


Проверка результата

После первого запроса проверьте:

  1. HTTP-ответ успешен и содержит сгенерированный результат.
  2. В журнале нет 429 RESOURCE_EXHAUSTED, ошибок авторизации и неизвестного идентификатора модели.
  3. Ответ соответствует ожидаемому формату на типичных и пограничных примерах.
  4. В AI Studio видны выбранный проект, его уровень и активные лимиты.
  5. Приложение обрабатывает тайм-ауты, временные ошибки и повторные запросы.
  6. Цена тестового прогона соответствует числу входных и выходных токенов.
📌
Материал основан на официальной документации и не подтверждает результаты самостоятельным запуском. Перед производственным использованием проведите проверку на собственных данных и активных квотах проекта.

Ограничения и официальные ссылки

Доступность Gemini API, моделей и пользовательских функций зависит от региона, аккаунта и платёжного уровня. Перед регистрацией и развёртыванием проверьте официальный список поддерживаемых регионов.

Основные ссылки:


Следующий шаг

Gemini Enterprise — агентная платформа Google AI для бизнеса

Если вы выбираете модель для проекта или проектируете интеграцию с Gemini API, заранее сопоставьте качество, задержку, квоты и стоимость на реальных данных.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov