pimenov.ai

База знаний

Anthropic Claude — линейка моделей и API

Линейка Claude от Anthropic: Fable, Opus, Sonnet, Haiku. Цены API, контекст, идентификаторы моделей, снятые версии и подключение через Messages API и SDK.

Опубликовано

Claude — семейство больших языковых моделей Anthropic. Этот справочник по актуальной линейке объясняет различия моделей, цены API, ограничения, подключение и выбор под конкретную задачу; данные проверены 28 августа 2026 года.


Четыре основные модели Claude

Anthropic делит актуальные модели по производительности, скорости и стоимости.

  • Claude Haiku 4.5 — самая быстрая и дешёвая модель. Подходит для простых операций и массовой обработки.
  • Claude Sonnet 5 — баланс скорости, качества и цены. Практичный вариант по умолчанию для большинства задач.
  • Claude Opus 5 — модель для сложного агентного программирования и корпоративных задач.
  • Claude Fable 5 — модель с самым высоким уровнем возможностей в текущей линейке, рассчитанная на длительную работу автономных агентов.
📌
Начните с Sonnet 5. Переключайтесь на Opus 5 или Fable 5, если задача требует более глубокого рассуждения, а на Haiku 4.5 — если приоритетом стали скорость и стоимость.

Основная линейка и цены API

Цены указаны за миллион входных и выходных токенов. Пакетные запросы через Message Batches API обходятся на 50% дешевле, а чтение из промпт-кэша составляет 10% базовой цены входных токенов. Контекстное окно показывает объём данных, который модель может учитывать в одном запросе, а максимальный вывод — верхнюю границу ответа в синхронном Messages API; в Message Batches API модели Opus 5, Sonnet 5, Opus 4.6–4.8 и Sonnet 4.6 поддерживают вывод до 300K токенов.

МодельОсновная рольКонтекстМаксимальный выводЦена: вход / выходClaude API ID
Claude Fable 5Самые сложные задачи и длительные агенты1M128K$10 / $50claude-fable-5
Claude Opus 5Сложный агентный код и корпоративные задачи1M128K$5 / $25claude-opus-5
Claude Sonnet 5Баланс скорости и интеллекта1M128K$2 / $10claude-sonnet-5
Claude Haiku 4.5Быстрые и массовые операции200K64K$1 / $5claude-haiku-4-5-20251001

В Messages API также принимается короткий псевдоним claude-haiku-4-5. Для интеграции, где важна воспроизводимость, используйте полный идентификатор снимка claude-haiku-4-5-20251001.

Отдельно существует Claude Mythos 5 (claude-mythos-5) — конфигурация той же модели, что и Fable 5, со снятыми ограничениями для задач кибербезопасности. Она не общедоступна: доступ предоставляется доверенным партнёрам Anthropic в рамках Project Glasswing, а для биологических исследований открывается отдельная программа доступа. Поэтому в таблице выше приведены только четыре основные модели общего назначения.

Цены, доступность и ограничения моделей меняются. Перед расчётом бюджета сверяйтесь с официальным обзором моделей.

Как выбрать модель под задачу

  • Классификация, извлечение данных, короткие ответы и массовые запросы → Haiku 4.5.
  • Тексты, анализ документов, программирование и большинство агентных сценариев → Sonnet 5.
  • Сложная отладка, большие рефакторинги и архитектурные решения → Opus 5.
  • Наиболее трудные задачи и длительная автономная работа агента → Fable 5.
⚖️
Более мощная модель расходует больше денег или квоты. Практичная схема — выполнять основную работу на Sonnet, а сложные случаи передавать Opus или Fable.

Как устроены идентификаторы моделей

Начиная с поколения Claude 4.6, Anthropic использует идентификаторы без даты:

claude-{name}-{major}
claude-{name}-{major}-{minor}

Например: claude-sonnet-5, claude-opus-4-8 и claude-opus-5.

Такой идентификатор обозначает фиксированную версию модели. Anthropic не меняет веса или конфигурацию существующего ID: обновлённая модель получает новый идентификатор. При этом обслуживающая инфраструктура, включая маршрутизацию и защитные классификаторы, может обновляться и немного влиять на наблюдаемое поведение.

Модели до поколения 4.6 используют дату снимка:

claude-{name}-{major}-{minor}-{YYYYMMDD}

Пример: claude-haiku-4-5-20251001. В Claude API короткие имена старых моделей, такие как claude-haiku-4-5, работают как псевдонимы и указывают на актуальный датированный снимок соответствующей версии.

Активные и снятые модели

Anthropic различает четыре состояния жизненного цикла:

  • Active — модель поддерживается и рекомендуется.
  • Legacy — модель больше не развивается и в будущем может быть объявлена устаревшей.
  • Deprecated — модель пока работает, но уже не рекомендуется; для неё назначают замену и дату отключения.
  • Retired — запросы к модели завершаются ошибкой.

На 28 августа 2026 года на платформах, которые обслуживает Anthropic, активны claude-fable-5, claude-opus-5, claude-opus-4-8, claude-opus-4-7, claude-opus-4-6, claude-opus-4-5-20251101, claude-sonnet-5, claude-sonnet-4-6, claude-sonnet-4-5-20250929 и claude-haiku-4-5-20251001.

Claude Mythos Preview (claude-mythos-preview) имеет статус Deprecated: модель ещё работает, но больше не рекомендуется. Рекомендованная замена — claude-mythos-5.

Недавно снятые модели:

МодельДата отключенияРекомендованная замена
claude-opus-4-1-202508055 августа 2026claude-opus-4-8
claude-opus-4-2025051415 июня 2026claude-opus-4-8
claude-sonnet-4-2025051415 июня 2026claude-sonnet-4-6
claude-3-haiku-2024030720 апреля 2026claude-haiku-4-5-20251001
claude-3-7-sonnet-2025021919 февраля 2026claude-sonnet-4-6
claude-3-5-haiku-2024102219 февраля 2026claude-haiku-4-5-20251001
claude-3-opus-202402295 января 2026claude-opus-4-8

Даты на официальной странице Anthropic относятся к Claude API, Claude Platform on AWS и Microsoft Foundry. Amazon Bedrock и Google Cloud могут использовать собственные графики отключения.

Подключение через Messages API

Основной эндпоинт для генерации ответа:

POST https://api.anthropic.com/v1/messages

Передайте API-ключ в x-api-key, версию API в anthropic-version; в теле укажите model, max_tokens и messages.

curl https://api.anthropic.com/v1/messages -H "x-api-key: $ANTHROPIC_API_KEY" -H "anthropic-version: 2023-06-01" -H "content-type: application/json" -d '{"model":"claude-sonnet-5","max_tokens":1024,"messages":[{"role":"user","content":"Объясни кэширование промпта в двух предложениях"}]}'

Пример с Python SDK anthropic:

from anthropic import Anthropic

client = Anthropic()  # читает ANTHROPIC_API_KEY из окружения

message = client.messages.create(
    model='claude-sonnet-5',
    max_tokens=1024,
    messages=[
        {
            'role': 'user',
            'content': 'Объясни кэширование промпта в двух предложениях',
        }
    ],
)

print(message.content[0].text)

Не вставляйте API-ключ непосредственно в код или репозиторий. Передавайте его через переменную окружения ANTHROPIC_API_KEY или защищённое хранилище секретов.

📌
Примеры основаны на официальной документации; фактический запуск API и Claude Code при подготовке этого материала не выполнялся.

Как проверить результат

Успешный запрос возвращает HTTP 200 и объект сообщения. В массиве content должен появиться блок с type: "text", а в usage — количество входных и выходных токенов. Если API сообщает, что модель неизвестна, проверьте написание ID и доступность модели на выбранной платформе.

Возможности Messages API

Актуальные модели поддерживают текстовый и графический ввод, многоязычную работу, анализ изображений и вызов инструментов.

  • Вызов инструментов (tool use). Вы описываете функции через JSON Schema. Модель возвращает блок tool_use, приложение выполняет функцию и передаёт результат обратно в блоке tool_result.
  • Структурированный вывод. В output_config.format можно передать JSON-схему и получить ответ в заданной структуре.
  • Управление усилием. Поле output_config.effort регулирует объём вычислений для поддерживаемых моделей: доступны уровни low, medium, high, xhigh и max. Для Fable 5, Opus 5 и Sonnet 5 значение по умолчанию — high; Haiku 4.5 параметр effort не поддерживает.
  • Кэширование промпта. Поле cache_control позволяет помечать повторно используемые блоки. Поддерживаются сроки жизни 5 минут и 1 час.
  • Потоковая выдача. Параметр stream включает передачу ответа частями через server-sent events.

Параметры temperature, top_p и top_k устарели. Для моделей, выпущенных после Claude Opus 4.6, при передаче temperature принимает только значение 1, top_k не принимается, а top_p принимает только значения >= 0.99; другие значения могут привести к HTTP 400. Для управления поведением новых моделей используйте промпт.

Полезные сценарии

Массовая обработка коротких документов

Задача: классифицировать обращения, карточки или фрагменты текста и извлечь поля. Исходные данные: набор коротких документов. Используйте Haiku 4.5 и задайте формат результата JSON-схемой; при больших объёмах отправляйте запросы через Message Batches API — пакетная обработка на 50% дешевле. Наблюдаемый результат: валидный JSON, прошедший проверку на контрольной выборке. Ограничение: сценарий не подходит для сложного многошагового рассуждения.

Работа программирующего агента

Задача: внести повседневное изменение в код, добавить тесты или исправить известную ошибку. Используйте Sonnet 5; при сложной отладке, крупном рефакторинге или изменении архитектуры передайте задачу Opus 5. Наблюдаемый результат: применимый патч и успешно пройденные тесты. Ответ модели сам по себе не подтверждает корректность программы.

Длительная автономная задача

Задача: поручить агенту длинную последовательность действий с большим контекстом. Используйте Fable 5, а результат проверяйте по журналу вызовов инструментов и итоговым артефактам. Из-за высокой цены Fable не стоит выбирать для коротких механических операций.

Модели, контекст и расходы в Claude Code

Команда /model показывает модели, доступные конкретному аккаунту, и позволяет переключаться между ними без потери текущего диалога. Sonnet подходит для большинства задач программирования, Opus — для сложной отладки и архитектуры, Haiku — для быстрых механических операций.

Способ учёта расходов зависит от авторизации:

  • при входе через место Enterprise (/login) используется включённый пул со сбросом по скользящему окну;
  • при работе через ключ Claude Console, Bedrock, Vertex AI или Microsoft Foundry расход оплачивается по токенам;
  • команда /cost показывает стоимость текущей API-сессии.

Длинная сессия увеличивает расход, поскольку каждый ход включает историю разговора, контекст проекта и новый запрос. /compact сжимает историю, /clear начинает новый диалог, а /context показывает, что занимает контекстное окно.

Чеклист быстрого выбора

Большинство повседневных задач → Sonnet 5
Сложная отладка или архитектура → Opus 5
Максимальная способность и длительный агент → Fable 5
Скорость, массовая обработка и минимальная цена → Haiku 4.5
Нужен предсказуемый JSON → задайте схему в output_config.format
Повторяется большой блок контекста → настройте cache_control
Интеграция использует старую модель → проверьте её статус и дату отключения
После вызова API → проверьте HTTP-статус, content и usage

Официальные источники

Следующий шаг

Разобраться с клиентскими библиотеками и созданием агентов: Anthropic SDK и Claude Agent SDK.

Связанные материалы

Если вы выбираете модель для продукта или хотите распределить задачи между Sonnet, Opus и Fable с учётом стоимости, можно отдельно разобрать архитектуру и ожидаемую нагрузку.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov