AIFreeAPI Logo

Claude Fable, Opus, Sonnet или Haiku: выбор под нагрузку

A
4 min readСравнение AI-моделей

Haiku экономит на массовых задачах, Sonnet закрывает широкую середину, Opus даёт сильную базовую линию, а Fable нужен только при доказанном дефиците возможностей.

Четыре маршрута Claude для разных цен ошибки и сложности работы

Названия Claude похожи на лестницу: Haiku, Sonnet, Opus, Fable. Но производственная система не обязана подниматься по ней на каждом запросе. Ошибка в массовой классификации может быть автоматически поймана и повторена; ошибка в многочасовой миграции может стоить дня работы и повреждённого состояния. Эти задачи должны начинаться с разных моделей.

Практическое правило на 15 августа 2026 года такое: Haiku 4.5 проверяйте для быстрых, массовых и хорошо контролируемых операций; Sonnet 5 — для широкой повседневной нагрузки; Opus 5 — как базовую линию для сложной агентской и инженерной работы; Fable 5 добавляйте, когда Opus уже не проходит вашу приёмку. Это не рейтинг качества, а порядок проверки гипотез.

Сначала разделите API, Claude Code и подписку

claude-fable-5, claude-opus-5, claude-sonnet-5 и claude-haiku-4-5-20251001 — идентификаторы моделей Claude API. В Claude Code или чате поверх модели работают выбор контекста, инструменты, права, лимиты плана, usage credits и правила интерфейса. У Bedrock и Google Cloud есть собственные точки доступа и тарификация.

Поэтому цена токена не отвечает на вопрос «сколько стоит сессия Claude Code», а наличие модели в API не гарантирует, что она видна в вашем тарифе. Дальше речь идёт о прямом API-контракте Anthropic; продуктовую доступность нужно проверять отдельно в оплачиваемом аккаунте.

Четыре профиля нагрузки вместо четырёх мест в рейтинге

Текущий обзор моделей Anthropic указывает такие базовые параметры:

МодельВход / выход за 1 млн токеновКонтекст / максимум выходаРазумный первый сценарий
Haiku 4.5$1 / $5200K / 64Kвысокая частота, низкая задержка, явная проверка
Sonnet 5$2 / $101 млн / 128Kкод, анализ, контент, vision и инструменты
Opus 5$5 / $251 млн / 128Kсложный код, системы, долгие агентские цепочки
Fable 5$10 / $501 млн / 128Kзадачи, упирающиеся в предел возможностей
Четыре профиля нагрузки ведут к общей приёмке, а не образуют рейтинг моделей
Четыре профиля нагрузки ведут к общей приёмке, а не образуют рейтинг моделей

Это ставки прямого Claude API. Старый раздел pricing всё ещё содержит прежний план повысить Sonnet 5 до $3/$15 с 1 сентября. Однако анонс Sonnet 5 обновлён 10 августа: цена $2/$10 стала постоянной. Новый английский overview подтверждает то же. Перед большим контрактом всё равно перепроверьте цифры.

Профиль «конвейер». Классификация, извлечение полей, короткие сводки, маршрутизация и узкие подзадачи с автоматическим контролем — естественная зона проверки Haiku. Если доля повторов мала, низкая ставка и скорость важнее лишнего запаса интеллекта.

Профиль «рабочая мастерская». Sonnet стоит тестировать там, где задачи уже требуют кода, анализа, визуального понимания или вызова инструментов, но выполняются регулярно и должны оставаться экономичными. Миллионный контекст не отменяет фильтрацию данных: лишние логи и дубли всё равно увеличивают цену и задержку.

Профиль «экспедиция». Большая миграция, глубокая отладка, многофайловый рефакторинг и многочасовой агент требуют устойчивого рассуждения и восстановления после ошибок. Opus 5 — разумная сильная базовая линия. Если он проходит при меньшем effort, это может оказаться выгоднее перехода на другую модель.

Профиль «предел». Fable 5 стоит вдвое дороже Opus по входу и выходу. Значит, команда должна назвать конкретный дефицит Opus: незавершённые длинные цепочки, слабое решение сложной исследовательской задачи, недостаточную работу с vision или слишком дорогой человеческий надзор. Anthropic описывает Fable 5 как самую сильную широко выпущенную модель, но это не делает её экономичным default для простых запросов.

При смене модели меняется не только имя

Thinking-контракт у моделей различается. В Fable 5 адаптивное мышление включено всегда. Opus 5 и Sonnet 5 используют adaptive thinking по умолчанию и регулируют глубину через effort. Haiku 4.5 поддерживает ручное extended thinking, но не adaptive.

Это способно сломать миграцию: конфигурация Haiku с thinking: {type: "enabled", budget_tokens: N} при прямом переносе на Sonnet 5 может вернуть HTTP 400. Sonnet 5 также не принимает нестандартные temperature, top_p и top_k. Его новый tokenizer может насчитать для того же текста больше токенов, чем Sonnet 4.6.

Режимы thinking у четырёх моделей и контрольный список перед canary-миграцией
Режимы thinking у четырёх моделей и контрольный список перед canary-миграцией

Перед canary-запуском проверьте:

  • точный model ID, thinking, effort, sampling и max_tokens;
  • фактические input, cache, thinking и output tokens на своих prompt;
  • tool calls, streaming, refusal и fallback;
  • P50/P95 задержки, timeout и долю повторов;
  • сохранение формата и бизнес-условия приёмки.

Руководство по миграции разбирает переходы по направлениям. А правила версий уточняют: бездатированные ID поколений 4.6+ — фиксированные снимки, а не автоматический latest.

Сравнивайте соседние модели на принятой работе

Полный турнир из четырёх моделей обычно не нужен. Для конвейера сравните Haiku и Sonnet; для рабочей нагрузки — Sonnet и Opus; для предельного набора — Opus и Fable. Возьмите 8–15 реальных задач с понятным критерием: schema, тесты, фактический rubric, браузерная проверка или бизнес-условие.

Обе модели должны получить одинаковые данные, инструменты, права, timebox и правило остановки. Если одна работает внутри зрелого Claude Code, а другая через минимальный API-скрипт, честно называйте это сравнением продуктовых конфигураций.

Для каждого запуска сохраните:

СигналЧто измерять
Приёмкапрошёл ли результат все реальные проверки
Токенывход, кэш, thinking, выход и инструменты отдельно
Времядо первого принятого результата; медиана и P95
Человекуточнения, подтверждения, ручные правки, перезапуски
Сбоиtimeout, отказ, неверный tool call, цикл, fallback
Переделкачто пришлось отменить или переписать после ревью

Финальная метрика:

стоимость принятой задачи = (цена модели + время человека + переделки) / число принятых задач

Дешёвый вызов, который часто не проходит, не производит дешёвую работу. Дорогой вызов оправдан лишь тогда, когда на нескольких образцах уменьшает вмешательство или переделки сильнее, чем растёт счёт.

Постройте правило маршрутизации, а не культ модели

Anthropic рекомендует проверять модели на собственных prompt и данных. Из результатов сделайте наблюдаемое правило: Haiku обслуживает типовые задачи до первого нарушения schema; Sonnet — повседневную сложность; Opus получает высокий риск и длинные цепочки; Fable — только задачи, где Opus исчерпал заданный effort или timebox.

Оставьте небольшой canary-поток и пересматривайте решение при смене model ID, цен, tokenizer, инструментов или состава задач. Если ваш реальный выбор касается интерфейса, разрешений, подписки и командной работы, а не API-класса, переходите к отдельному сравнению Claude Code и Codex.