База знаний
Gemini (Google) — линейка моделей и API
Справочник по экосистеме Google Gemini: актуальные модели, API и SDK, Gemini Live, мультимодальные возможности, региональные ограничения и сравнение с GPT и Claude.
СейчасАктуальная линейка моделей
- Актуальная линейка моделей
- Gemini 3.5 Flash
- Gemini 3.1 Pro Preview
- Gemini 3.5 Pro
- Gemini 3.1 Flash-Lite
- Gemini 2.5 Pro / Flash
- Аудиомодели и Gemini Live
- Gemini 2.5 Flash Live (native audio)
- Gemini 3.1 Flash TTS Preview
- Gemini 2.5 Flash TTS Preview
- Что такое Gemini Live
- API и SDK
- Gemini API (Google AI Studio)
- Vertex AI
- Live API
- Мультимодальность
- Региональные ограничения
- Тарифы и лимиты
- Сравнение с GPT и Claude
- Полезные ссылки
Google Gemini — это семейство мультимодальных моделей от Google DeepMind, которое лежит в основе большинства AI-продуктов Google: от приложения Gemini и Google AI Studio до Vertex AI и встроенных функций Android.
В этом справочнике — актуальная линейка моделей, способы доступа через API, возможности Gemini Live и ключевые отличия от конкурентов.
Актуальная линейка моделей
На июль 2026 года Google предлагает несколько поколений моделей одновременно. Вот ключевые.
Gemini 3.5 Flash
Самая свежая и универсальная модель Google: вышла 19 мая 2026 и сразу стала той, к которой стоит тянуться первой. Даёт интеллект, близкий к Pro-уровню, но работает быстрее и дешевле. Заточена под агентные сценарии и автономный кодинг, контекстное окно на 1 млн токенов. Доступна бесплатно в приложении Gemini и в AI Mode Google Поиска, а для разработчиков — через Gemini API. Пришла на смену Gemini 3 Flash и считается её рекомендованной заменой.
Когда использовать: большинство повседневных и рабочих задач, от кода до анализа документов. Стартовая модель по умолчанию.
Gemini 3.1 Pro Preview
Топовая модель для рассуждений среди уже вышедших. Контекстное окно на 1 млн токенов. Сильная работа с агентными сценариями и автономным кодингом, мультимодальный ввод: текст, изображения, аудио, видео. Остаётся доступной; на смену готовится Gemini 3.5 Pro.
Когда использовать: сложный анализ, многошаговые рассуждения, работа с большими документами, агентные задачи.
Gemini 3.5 Pro
Новый флагман для рассуждений, о котором Google объявил на I/O в мае 2026. Запуск сдвинулся на лето 2026: модель дорабатывают по обратной связи от ранних тестеров. Официальных бенчмарков, цен и параметров контекста Google пока не раскрыл, поэтому здесь опираемся только на анонсы.
Когда использовать: появится как более мощная альтернатива 3.1 Pro для самых тяжёлых задач. Следите за официальным релизом.
Gemini 3.1 Flash-Lite
Самая экономичная модель в линейке. С 7 мая 2026 доступна как стабильная версия (не preview). Оптимизирована под высокую нагрузку и низкую задержку, с улучшенным распознаванием речи (ASR).
Когда использовать: массовые запросы, чат-боты, задачи, где на первом месте стоимость и скорость, а глубина рассуждений вторична.
Gemini 2.5 Pro / Flash
Модели предыдущего поколения. Всё ещё доступны, но Google объявил об их отключении: снятие с обслуживания намечено на 16 октября 2026. Раньше Gemini 2.5 Flash была моделью по умолчанию в приложении, сейчас эту роль заняла 3.5 Flash.
Когда использовать: только если вы привязаны к конкретной версии или нужна совместимость со старым кодом. Для новых проектов берите модели поколения 3.x и закладывайте переход до октября 2026.
Аудиомодели и Gemini Live
Gemini 2.5 Flash Live (native audio)
Флагманская модель Live API для диалога в реальном времени: двусторонняя передача голоса и видео, нативное аудио, речь на 24 языках, модель можно перебивать голосом в любой момент. Стабильная native-audio-версия (gemini-live-2.5-flash-native-audio) доступна с декабря 2025.
Gemini 3.1 Flash TTS Preview
Синтез речи (text-to-speech) нового поколения: быстрая и управляемая генерация голоса с выразительными аудио-тегами для точной интонации.
Gemini 2.5 Flash TTS Preview
Модель для синтеза речи (text-to-speech). Быстрая и управляемая генерация голоса для приложений с низкой задержкой.
Что такое Gemini Live
Gemini Live — это режим голосового общения с Gemini в реальном времени в мобильном приложении. В июне 2026 Google добавил в него синхронный голосовой перевод прямо в разговоре (Gemini 3.5 Live Translate).
Возможности:
- Голосовой диалог с естественной интонацией
- Обсуждение того, что видит камера телефона (Live с видео)
- Демонстрация экрана с комментариями в реальном времени
- Прерывание модели голосом в любой момент
API и SDK
Gemini API (Google AI Studio)
Google AI Studio — бесплатный веб-интерфейс для экспериментов с моделями Gemini. Здесь же можно получить API-ключ и сразу начать работу.
Базовый вызов через REST:
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.5-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{"contents": [{"parts": [{"text": "Explain how AI works"}]}]}'SDK: официальные библиотеки для Python, JavaScript/TypeScript, Go, Swift, Dart. Установка для Python:
pip install google-genaiVertex AI
Vertex AI — enterprise-платформа Google Cloud для работы с Gemini. Отличия от Google AI Studio:
- Корпоративный SLA и безопасность
- Provisioned Throughput (гарантированная пропускная способность)
- Batch prediction
- Интеграция с остальными сервисами Google Cloud
Live API
Live API — отдельный API для потокового взаимодействия с моделями в реальном времени. Поддерживает непрерывные потоки аудио, изображений и текста с мгновенными ответами.
Мультимодальность
Все модели Gemini 3.x нативно мультимодальны:
- Текст — генерация, анализ, перевод, суммаризация
- Изображения — понимание, описание, генерация (Nano Banana 2 / Gemini 3.1 Flash Image)
- Аудио — распознавание речи, анализ звука, генерация голоса
- Видео — анализ видеопотока, описание сцен, ответы на вопросы по видео
- Код — генерация, ревью, дебаг, автономный кодинг
Контекстное окно до 1 млн токенов позволяет загружать большие документы, длинные видео и аудиозаписи целиком.
Региональные ограничения
Веб-приложение Gemini доступно в 230+ странах на 70+ языках. Мобильное приложение и Gemini Live — в 150+ странах.
Однако есть нюансы:
- Google AI Studio и Gemini API — доступны не во всех регионах. Россия не входит в список поддерживаемых стран для API
- Vertex AI — привязан к регионам Google Cloud
- Gemini Live на десктопе — пока ограничен по географии (преимущественно США)
- При использовании VPN возможны блокировки аккаунта при резкой смене геолокации
Тарифы и лимиты
- Бесплатный доступ: в приложении Gemini и AI Mode Поиска бесплатно доступна Gemini 3.5 Flash (с дневными лимитами на число запросов).
- Google AI Plus ($7.99/мес): удвоенные лимиты в Gemini, доступ к Pro-модели, 400 ГБ хранилища.
- Google AI Pro ($19.99/мес): расширенные лимиты, приоритетный доступ к новым функциям, больше генераций изображений и видео.
- Google AI Ultra (от $99.99/мес, старший тариф — $199.99/мес): максимальные лимиты, Veo 3.1, Deep Research, от 20 ТБ хранилища. Цену снизили на I/O 2026 (раньше топовый тариф стоил $250).
- Gemini API (бесплатный tier): бесплатный уровень остался, но с апреля 2026 Pro-модели из него убрали, а квоты Flash-моделей урезали. Рекомендованная бесплатная модель — Gemini 3 Flash / 3.5 Flash.
- Gemini API (платный): pay-as-you-go, цены зависят от модели. Для Gemini 3.5 Flash — $1.50 за 1M входных токенов и $9.00 за 1M выходных (с учётом токенов рассуждений).
Сравнение с GPT и Claude
| Параметр | Gemini 3.1 Pro / 3.5 Flash | GPT-5.5 (OpenAI) | Claude Opus 4.8 (Anthropic) |
| Контекст | 1 млн токенов | ≈400K+ токенов (уточняйте в docs) | 1 млн токенов |
| Мультимодальность | Текст, изображения, аудио, видео | Текст, изображения, аудио | Текст, изображения |
| Голосовой режим | Gemini Live (A2A) | Voice Mode | Нет нативного |
| Сильные стороны | Скорость, мультимодальность, контекст | Универсальность, экосистема | Качество текста, рассуждения, код |
| Слабые стороны | Региональные ограничения API | Меньше контекст | Нет нативного голоса и видео |
В бенчмарках ситуация примерно такая: Gemini лидирует по скорости и мультимодальности, Claude — по качеству текста и кода, GPT — по ширине экосистемы и универсальности. «Лучшей модели» не существует — выбор зависит от задачи. Версии и бенчмарки обновляются почти каждый месяц, поэтому перед выбором сверяйтесь со свежими данными вендоров.
Полезные ссылки
- Gemini API — документация
- Google AI Studio
- Vertex AI — модели Gemini
- Gemini Live API
- Доступные регионы
- Gemini Live — обзор
По теме
Если вы выбираете модель для своего проекта или хотите разобраться, как встроить Gemini API в рабочий процесс — давайте обсудим.
Если хотите разобрать свою задачу — напишите мне Если хотите разобрать свою задачу — напишите мне.
Можно прийти с идеей, черновым контекстом или уже живой задачей. Помогу быстро понять, где реальный следующий шаг, а где лишний шум.
Обычно хватает 2–3 сообщений, чтобы понять, могу ли я здесь реально помочь и в каком формате лучше двигаться дальше.