pimenov.ai

База знаний

Gemini (Google) — линейка моделей и API

Справочник по экосистеме Google Gemini: актуальные модели, API и SDK, Gemini Live, мультимодальные возможности, региональные ограничения и сравнение с GPT и Claude.

Опубликовано Обновлено
🔄
Актуальность: проверено 6 июля 2026 по официальным источникам (Gemini API docs, pricing, release notes, блог Google). Линейка ИИ-моделей и тарифы меняются очень быстро, поэтому перед важными решениями сверяйтесь со свежими docs и pricing. Что изменилось с прошлой версии: главной рабочей моделью стала Gemini 3.5 Flash, флагманская Gemini 3.5 Pro выкатывается летом 2026, снижены цены на подписки и обновлены тарифы API.

Google Gemini — это семейство мультимодальных моделей от Google DeepMind, которое лежит в основе большинства AI-продуктов Google: от приложения Gemini и Google AI Studio до Vertex AI и встроенных функций Android.

В этом справочнике — актуальная линейка моделей, способы доступа через API, возможности Gemini Live и ключевые отличия от конкурентов.


Актуальная линейка моделей

На июль 2026 года Google предлагает несколько поколений моделей одновременно. Вот ключевые.

Gemini 3.5 Flash

Самая свежая и универсальная модель Google: вышла 19 мая 2026 и сразу стала той, к которой стоит тянуться первой. Даёт интеллект, близкий к Pro-уровню, но работает быстрее и дешевле. Заточена под агентные сценарии и автономный кодинг, контекстное окно на 1 млн токенов. Доступна бесплатно в приложении Gemini и в AI Mode Google Поиска, а для разработчиков — через Gemini API. Пришла на смену Gemini 3 Flash и считается её рекомендованной заменой.

Когда использовать: большинство повседневных и рабочих задач, от кода до анализа документов. Стартовая модель по умолчанию.

Gemini 3.1 Pro Preview

Топовая модель для рассуждений среди уже вышедших. Контекстное окно на 1 млн токенов. Сильная работа с агентными сценариями и автономным кодингом, мультимодальный ввод: текст, изображения, аудио, видео. Остаётся доступной; на смену готовится Gemini 3.5 Pro.

Когда использовать: сложный анализ, многошаговые рассуждения, работа с большими документами, агентные задачи.

Gemini 3.5 Pro

Новый флагман для рассуждений, о котором Google объявил на I/O в мае 2026. Запуск сдвинулся на лето 2026: модель дорабатывают по обратной связи от ранних тестеров. Официальных бенчмарков, цен и параметров контекста Google пока не раскрыл, поэтому здесь опираемся только на анонсы.

Когда использовать: появится как более мощная альтернатива 3.1 Pro для самых тяжёлых задач. Следите за официальным релизом.

Gemini 3.1 Flash-Lite

Самая экономичная модель в линейке. С 7 мая 2026 доступна как стабильная версия (не preview). Оптимизирована под высокую нагрузку и низкую задержку, с улучшенным распознаванием речи (ASR).

Когда использовать: массовые запросы, чат-боты, задачи, где на первом месте стоимость и скорость, а глубина рассуждений вторична.

Gemini 2.5 Pro / Flash

Модели предыдущего поколения. Всё ещё доступны, но Google объявил об их отключении: снятие с обслуживания намечено на 16 октября 2026. Раньше Gemini 2.5 Flash была моделью по умолчанию в приложении, сейчас эту роль заняла 3.5 Flash.

Когда использовать: только если вы привязаны к конкретной версии или нужна совместимость со старым кодом. Для новых проектов берите модели поколения 3.x и закладывайте переход до октября 2026.


Аудиомодели и Gemini Live

Gemini 2.5 Flash Live (native audio)

Флагманская модель Live API для диалога в реальном времени: двусторонняя передача голоса и видео, нативное аудио, речь на 24 языках, модель можно перебивать голосом в любой момент. Стабильная native-audio-версия (gemini-live-2.5-flash-native-audio) доступна с декабря 2025.

Gemini 3.1 Flash TTS Preview

Синтез речи (text-to-speech) нового поколения: быстрая и управляемая генерация голоса с выразительными аудио-тегами для точной интонации.

Gemini 2.5 Flash TTS Preview

Модель для синтеза речи (text-to-speech). Быстрая и управляемая генерация голоса для приложений с низкой задержкой.

Что такое Gemini Live

Gemini Live — это режим голосового общения с Gemini в реальном времени в мобильном приложении. В июне 2026 Google добавил в него синхронный голосовой перевод прямо в разговоре (Gemini 3.5 Live Translate).

Возможности:

  • Голосовой диалог с естественной интонацией
  • Обсуждение того, что видит камера телефона (Live с видео)
  • Демонстрация экрана с комментариями в реальном времени
  • Прерывание модели голосом в любой момент

API и SDK

Gemini API (Google AI Studio)

Google AI Studio — бесплатный веб-интерфейс для экспериментов с моделями Gemini. Здесь же можно получить API-ключ и сразу начать работу.

Базовый вызов через REST:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.5-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{"contents": [{"parts": [{"text": "Explain how AI works"}]}]}'

SDK: официальные библиотеки для Python, JavaScript/TypeScript, Go, Swift, Dart. Установка для Python:

pip install google-genai

Vertex AI

Vertex AI — enterprise-платформа Google Cloud для работы с Gemini. Отличия от Google AI Studio:

  • Корпоративный SLA и безопасность
  • Provisioned Throughput (гарантированная пропускная способность)
  • Batch prediction
  • Интеграция с остальными сервисами Google Cloud

Live API

Live API — отдельный API для потокового взаимодействия с моделями в реальном времени. Поддерживает непрерывные потоки аудио, изображений и текста с мгновенными ответами.


Мультимодальность

Все модели Gemini 3.x нативно мультимодальны:

  • Текст — генерация, анализ, перевод, суммаризация
  • Изображения — понимание, описание, генерация (Nano Banana 2 / Gemini 3.1 Flash Image)
  • Аудио — распознавание речи, анализ звука, генерация голоса
  • Видео — анализ видеопотока, описание сцен, ответы на вопросы по видео
  • Код — генерация, ревью, дебаг, автономный кодинг

Контекстное окно до 1 млн токенов позволяет загружать большие документы, длинные видео и аудиозаписи целиком.


Региональные ограничения

Веб-приложение Gemini доступно в 230+ странах на 70+ языках. Мобильное приложение и Gemini Live — в 150+ странах.

Однако есть нюансы:

  • Google AI Studio и Gemini APIдоступны не во всех регионах. Россия не входит в список поддерживаемых стран для API
  • Vertex AI — привязан к регионам Google Cloud
  • Gemini Live на десктопе — пока ограничен по географии (преимущественно США)
  • При использовании VPN возможны блокировки аккаунта при резкой смене геолокации

Тарифы и лимиты

  • Бесплатный доступ: в приложении Gemini и AI Mode Поиска бесплатно доступна Gemini 3.5 Flash (с дневными лимитами на число запросов).
  • Google AI Plus ($7.99/мес): удвоенные лимиты в Gemini, доступ к Pro-модели, 400 ГБ хранилища.
  • Google AI Pro ($19.99/мес): расширенные лимиты, приоритетный доступ к новым функциям, больше генераций изображений и видео.
  • Google AI Ultra (от $99.99/мес, старший тариф — $199.99/мес): максимальные лимиты, Veo 3.1, Deep Research, от 20 ТБ хранилища. Цену снизили на I/O 2026 (раньше топовый тариф стоил $250).
  • Gemini API (бесплатный tier): бесплатный уровень остался, но с апреля 2026 Pro-модели из него убрали, а квоты Flash-моделей урезали. Рекомендованная бесплатная модель — Gemini 3 Flash / 3.5 Flash.
  • Gemini API (платный): pay-as-you-go, цены зависят от модели. Для Gemini 3.5 Flash — $1.50 за 1M входных токенов и $9.00 за 1M выходных (с учётом токенов рассуждений).

Сравнение с GPT и Claude

ПараметрGemini 3.1 Pro / 3.5 FlashGPT-5.5 (OpenAI)Claude Opus 4.8 (Anthropic)
Контекст1 млн токенов≈400K+ токенов (уточняйте в docs)1 млн токенов
МультимодальностьТекст, изображения, аудио, видеоТекст, изображения, аудиоТекст, изображения
Голосовой режимGemini Live (A2A)Voice ModeНет нативного
Сильные стороныСкорость, мультимодальность, контекстУниверсальность, экосистемаКачество текста, рассуждения, код
Слабые стороныРегиональные ограничения APIМеньше контекстНет нативного голоса и видео

В бенчмарках ситуация примерно такая: Gemini лидирует по скорости и мультимодальности, Claude — по качеству текста и кода, GPT — по ширине экосистемы и универсальности. «Лучшей модели» не существует — выбор зависит от задачи. Версии и бенчмарки обновляются почти каждый месяц, поэтому перед выбором сверяйтесь со свежими данными вендоров.


Полезные ссылки


По теме

Если вы выбираете модель для своего проекта или хотите разобраться, как встроить Gemini API в рабочий процесс — давайте обсудим.