Google Gemini — семейство мультимодальных моделей Google. Разработчики могут обращаться к ним через Gemini Developer API и Google AI Studio, а для потоковых голосовых и мультимодальных приложений предусмотрен Live API.
Главное изменение к сентябрю 2026 года: основной стабильной Flash-моделью стала Gemini 3.8 Flash, выпущенная 2 сентября. Gemini 3.7 Flash теперь обозначена как модель предыдущего поколения.
Содержание
- Какую модель выбрать
- Специализированные и аудиомодели
- Подключение к Gemini API
- Тарифы и лимиты API
- Полезные сценарии
- Проверка результата
- Ограничения и официальные ссылки
Какую модель выбрать
| Модель | Статус | Для каких задач подходит |
gemini-3.8-flash | Стабильная, сентябрь 2026 | Длительная работа с кодом, автономные агенты и сложные корпоративные процессы. Основной выбор среди Flash-моделей для новых проектов |
gemini-3.7-flash | Стабильная, предыдущее поколение | Код, агентные процессы и многошаговые задачи в существующих интеграциях |
gemini-3.6-flash | Стабильная, предыдущее поколение | Универсальные и мультимодальные задачи, если проект уже привязан к этой версии |
gemini-3.5-flash | Стабильная, устаревающая (legacy) | Рутинные запросы и действующие интеграции |
gemini-3.5-flash-lite | Стабильная | Массовые простые запросы, перевод и обработка данных с приоритетом стоимости |
gemini-3.1-pro-preview | Предварительная | Сложное решение задач, мультимодальный анализ и агентный кодинг, когда возможностей Flash недостаточно |
gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite | Доступны | Совместимость с существующими системами; даты отключения основных текстовых версий пока не объявлены |
Для gemini-3.8-flash, gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash и gemini-3.5-flash-lite даты отключения на 10 сентября 2026 года не объявлены.
Утверждение об отключении всех Gemini 2.5 в октябре 2026 года неверно. Дата 2 октября 2026 года относится только к модели изображений gemini-2.5-flash-image. В таблице Google для неё всё ещё указана замена gemini-3.1-flash-image-preview, хотя этот preview-эндпоинт уже отключён. В текущем каталоге доступна стабильная gemini-3.1-flash-image.
Для стабильной gemini-3.1-flash-lite самая ранняя дата возможного отключения — 7 мая 2027 года. Рекомендованная замена — gemini-3.5-flash-lite.
Специализированные и аудиомодели
В каталоге есть отдельные модели для изображений, видео, речи, эмбеддингов, исследований и компьютерного управления:
gemini-3.1-flash-image— стабильная Nano Banana 2 для генерации и редактирования изображений;gemini-3.1-flash-lite-image— экономичная версия для изображений;gemini-3-pro-image— Nano Banana Pro для сложной компоновки и точной отрисовки текста;gemini-omni-1.1-flash— стабильная модель генерации и редактирования видео с нативным аудио;veo-3.1-generate-preview— генерация видео с расширенным творческим контролем;gemini-embedding-2— стабильная мультимодальная модель для текста, изображений, видео, аудио и PDF. В каталоге также указана строкаgemini-embedding-2-preview, но в графике вывода из эксплуатации для preview-вариантаembedding-2-previewуказана дата отключения 10 августа 2026 года. Для новых интеграций используйте стабильныйgemini-embedding-2.
Старая gemini-omni-flash-preview может быть отключена не раньше 30 сентября 2026 года. Её замена — gemini-omni-1.1-flash.
Gemini Live, перевод и работа с речью
gemini-3.1-flash-live-preview— актуальная модель Live API для голосовых диалогов с низкой задержкой;gemini-3.5-live-translate-preview— потоковый перевод речи в речь с поддержкой более 70 языков;gemini-3.5-transcribe— стабильная расшифровка с определением языка, разделением говорящих, временными метками слов и пользовательским словарём;gemini-3.5-transcribe-live— потоковая расшифровка через WebSocket;gemini-3.1-flash-tts-preview— управляемый синтез речи.
gemini-2.5-flash-native-audio-preview-12-2025 пока доступна, но Google рекомендует переходить на gemini-3.1-flash-live-preview. Для gemini-2.5-flash-preview-tts и gemini-2.5-pro-preview-tts рекомендуемой заменой указана gemini-3.1-flash-tts-preview.
Пользовательский режим Gemini Live в приложении позволяет разговаривать с моделью, перебивать её голосом, показывать изображение с камеры и делиться экраном. Возможности выпускаются постепенно и зависят от устройства, языка и аккаунта. В справке для Android указано, что Gemini Live пока недоступен в веб-приложении Gemini.
Подключение к Gemini API
Экспериментировать с моделями и получить API-ключ можно в Google AI Studio. Передавайте ключ через переменную окружения, не вставляя его в исходный код или публичный репозиторий.
Минимальный REST-запрос
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"contents": [
{
"parts": [
{"text": "Объясни принцип работы трансформера простыми словами"}
]
}
]
}'Для Python используется пакет Google Gen AI SDK:
pip install google-genaiПеред переносом интеграции в продакшен зафиксируйте точный идентификатор модели. Алиас latest автоматически переключается между выпусками соответствующего варианта модели. При несовместимом изменении Google обещает уведомление за две недели.
Тарифы и лимиты API
Цены проверены 10 сентября 2026 года. Они относятся к стандартному платному режиму Gemini Developer API и указаны за 1 млн токенов. Цена выхода включает токены рассуждений.
| Модель | Вход | Выход | Бесплатный уровень |
| Gemini 3.8 Flash | $0.75 до 31 декабря 2026, затем $1.50 | $3.75 до 31 декабря 2026, затем $7.50 | Есть |
| Gemini 3.7 Flash | $0.75 до 31 декабря 2026, затем $1.50 | $3.75 до 31 декабря 2026, затем $7.50 | Есть |
| Gemini 3.6 Flash | $0.75 до 31 декабря 2026, затем $1.50 | $3.75 до 31 декабря 2026, затем $7.50 | Есть |
| Gemini 3.5 Flash | $1.50 | $9.00 | Есть |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Есть |
| Gemini 3.1 Pro Preview | $2.00 для запросов до 200 тыс. токенов, $4.00 для запросов выше | $12.00 до 200 тыс., $18.00 выше | Нет |
Batch API снижает стоимость обработки на 50% для поддерживаемых моделей. Доступность конкретной модели и функции на бесплатном уровне проверяйте в актуальной таблице цен.
Как применяются лимиты
Gemini API учитывает несколько независимых ограничений:
- запросы в минуту (
RPM); - входные токены в минуту (
TPM); - запросы в сутки (
RPD); - для отдельных моделей — изображения или токены за период;
- для некоторых платных проектов — расходы за скользящее десятиминутное окно.
Квоты применяются к проекту целиком, а не к отдельному API-ключу. Суточный лимит сбрасывается в полночь по тихоокеанскому времени. Фактические значения зависят от модели, уровня использования и состояния аккаунта; активные лимиты проекта отображаются в AI Studio.
Лимиты расходов составляют $10 за скользящее 10-минутное окно для уровня Tier 1, $50 для Tier 2 и $200 для Tier 3, если такое ограничение применяется к аккаунту. При превышении лимита расходов API возвращает 429 RESOURCE_EXHAUSTED.
Для Batch API отдельно установлены максимум 100 одновременных запросов, входной файл до 2 ГБ и хранилище файлов до 20 ГБ. Лимит поставленных в очередь токенов зависит от модели и уровня проекта.
Полезные сценарии
Универсальный помощник для документов и кода
Задача: анализировать документы, извлекать данные или выполнять многошаговую работу с кодом.
Что делать: начать с gemini-3.8-flash, передать текст или поддерживаемые мультимодальные данные и проверить результат на реальном наборе примеров.
Наблюдаемый результат: API возвращает содержательный ответ, а тестовый набор проходит заданные проверки качества и формата.
Ограничение: длинный контекст увеличивает расход токенов. Описание модели не гарантирует качество на конкретных данных, поэтому для критичных решений нужны собственные тесты.
Массовая обработка простых запросов
Задача: классифицировать, переводить или преобразовывать большое число коротких записей.
Что делать: сравнить gemini-3.5-flash-lite с gemini-3.8-flash на репрезентативной выборке, затем использовать Batch API для задач без требования мгновенного ответа.
Наблюдаемый результат: записи обработаны в требуемом формате, а стоимость и доля ошибок укладываются в установленный порог.
Ограничение: экономичная модель может хуже справляться со сложными рассуждениями.
Голосовой агент или потоковая расшифровка
Задача: создать двусторонний голосовой интерфейс либо получать текст во время разговора.
Что делать: выбрать gemini-3.1-flash-live-preview для диалога или gemini-3.5-transcribe-live для расшифровки.
Наблюдаемый результат: потоковая сессия принимает аудио и возвращает голосовой ответ либо текст без ожидания окончания всей записи.
Ограничение: Live-модель имеет статус preview, а качество и задержка зависят от языка, сигнала и сетевого соединения.
Проверка результата
После первого запроса проверьте:
- HTTP-ответ успешен и содержит сгенерированный результат.
- В журнале нет
429 RESOURCE_EXHAUSTED, ошибок авторизации и неизвестного идентификатора модели. - Ответ соответствует ожидаемому формату на типичных и пограничных примерах.
- В AI Studio видны выбранный проект, его уровень и активные лимиты.
- Приложение обрабатывает тайм-ауты, временные ошибки и повторные запросы.
- Цена тестового прогона соответствует числу входных и выходных токенов.
Ограничения и официальные ссылки
Доступность Gemini API, моделей и пользовательских функций зависит от региона, аккаунта и платёжного уровня. Перед регистрацией и развёртыванием проверьте официальный список поддерживаемых регионов.
Основные ссылки:
- Каталог моделей Gemini API
- График вывода моделей из эксплуатации
- Тарифы Gemini Developer API
- Лимиты Gemini API
- Документация Gemini API
- Google AI Studio
- Live API
- Справка по Gemini Live
Следующий шаг
Gemini Enterprise — агентная платформа Google AI для бизнеса
Если вы выбираете модель для проекта или проектируете интеграцию с Gemini API, заранее сопоставьте качество, задержку, квоты и стоимость на реальных данных.
Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov



