Перейти к содержанию

Opus 5.5 или Fable 5.1: какую модель Claude выбрать для API

При одинаковом расходе токенов Opus 5.5 дешевле Fable 5.1 даже при частом чтении кэша. Начните с Opus и проверяйте Fable там, где она даёт больше принятых результатов.

A
•••5 мин чтения•Сравнение AI-моделей
Схема выбора между Claude Opus 5.5 и Fable 5.1 для задач в API

Если вы выбираете между Claude Opus 5.5 и Fable 5.1 для прямого API, начните с Opus 5.5. При одинаковом количестве токенов она дешевле Fable во всех категориях стандартного тарифа, включая чтение из кэша. Переход на Fable оправдан, когда на ваших сложных задачах она чаще достигает заданного результата или требует меньше повторов и доработки настолько, что окупает более высокую цену токенов. Это выбор по стоимости принятой задачи, а не по одному столбцу прайс-листа.

Для простых массовых операций сначала проверьте Haiku; для повседневной разработки и анализа — Sonnet. Руководство Anthropic по выбору модели также предлагает начинать сложную работу с Opus 5.5 и переходить к Fable 5.1, если повышенный effort у Opus не даёт нужного результата. Это рекомендация производителя, а не гарантия для вашей нагрузки.

Сколько стоят Opus 5.5 и Fable 5.1 в Claude API

По текущему прайс-листу Anthropic стандартные ставки прямого API в долларах за миллион токенов таковы:

Категория токеновOpus 5.5Fable 5.1
Новый ввод$4$10
Вывод$20$50
Запись в кэш на 5 минут$5$12,50
Запись в кэш на 1 час$8$20
Чтение из кэша$0,20$0,25

В отличие от старой пары Opus 5 и Fable 5.1, здесь нет порога, после которого одна только доля чтений из кэша делает Fable дешевле. Если обе модели получили одинаковые объёмы каждого типа токенов, Opus 5.5 стоит меньше при любой их комбинации. Это вывод из тарифов, а не измерение работы моделей: число ходов, длина ответа и доля попаданий в кэш у них могут различаться.

Например, 100 тыс. токенов нового ввода, 20 тыс. токенов вывода и 200 тыс. токенов чтения из кэша без новых записей и других начислений стоят $0,84 на Opus 5.5: 0,1 × 4 + 0,02 × 20 + 0,2 × 0,20. На Fable 5.1 — $2,05: 0,1 × 10 + 0,02 × 50 + 0,2 × 0,25. Это расчёт одного и того же набора токенов по официальным ставкам, а не прогноз счёта за реальное задание.

Сопоставление стандартных ставок Opus 5.5 и Fable 5.1 за ввод, вывод, запись и чтение кэша

Цены относятся к стандартному прямому API, а не к подписке Claude, оплате в рублях или тарифу облачного партнёра. Batch и Fast имеют отдельные ставки; налоги, инструменты и другие условия также меняют итоговый счёт. Перед расчётом проверьте именно тот способ доступа, которым будете пользоваться.

Когда более дорогая Fable может оказаться выгоднее

Цена вызова и стоимость готовой работы расходятся, когда модели по-разному решают задачу. Если Fable заканчивает сложное расследование за один проход, а Opus требует нескольких запусков и ручного исправления, более дорогие токены Fable могут обойтись дешевле в пересчёте на принятый результат. Обратное тоже возможно. Без сопоставимых запусков на ваших задачах ни одна модель не получает такого преимущества автоматически.

Соберите небольшой набор заданий с проверяемым результатом: тесты для кода, сверяемые ответы, корректные действия инструмента. Зафиксируйте одинаковые входные данные, доступные инструменты, критерий приёмки и правило остановки. Затем для каждой модели запишите расход токенов по категориям, число попыток, время до принятого результата и время человека на проверку и исправление. Сравнивайте не только общую сумму, но и стоимость на одну принятую задачу; проваленные и повторные попытки тоже входят в затраты.

Два пути решения одной задачи: проверка результата, повторы, исправления и общая стоимость принятой работы

Такой тест особенно нужен для длинных агентских сценариев. Кэш может снизить цену повторного чтения контекста, но тарифная таблица не говорит, сколько токенов каждая модель фактически прочитает и сколько работы завершит. Старое сравнение с Opus 5, где у Fable чтение кэша стоило дешевле, к Opus 5.5 переносить нельзя.

Что говорят опубликованные оценки — и чего они не доказывают

В анонсе Opus 5.5 Anthropic сообщает, что модель достигает уровня Fable 5.1 на большинстве видов работы. В приведённых компанией оценках Opus 5.5 набрала 66,4 против 55,8 у Fable 5.1 на Terminal-Bench 4.0 и 57,8 против 51,8 на CursorBench 4.0. Это результаты производителя на указанных наборах и настройках, а не наше тестирование и не обещание такого же разрыва в вашем продукте.

Для чтения этих чисел важны условия: лучшие опубликованные оценки Opus в основном получены при max effort, а Terminal-Bench — при xhigh; защитные механизмы рабочего окружения были включены. Между тем спецификации моделей задают для Opus 5.5 в API по умолчанию medium, а для Fable 5.1 — high. Сравнение верхних результатов теста нельзя выдавать за результат двух вызовов с настройками по умолчанию.

Anthropic также пишет о снижении типичной стоимости работы на 40% относительно Opus 5. Базой этого заявления служит предыдущая версия Opus, а не Fable 5.1. При выборе между двумя моделями выше используйте ставки текущего прайс-листа и результат собственной проверки.

Куда в этом выборе поставить Sonnet и Haiku

Sonnet остаётся разумной отправной точкой для повседневных задач, если она проходит вашу проверку качества. Haiku подходит для потока простых операций, где важны скорость и экономия, а результат легко проверить автоматически. Такой порядок следует общей схеме выбора Anthropic, но конкретный порог качества задаёт ваша задача.

Поднимайтесь до Opus 5.5, когда Sonnet не справляется с трудными изменениями в коде, многошаговым анализом или дорогими ошибками. Пробуйте Fable 5.1 на оставшихся сложных случаях после проверки Opus с повышенным effort. Не переносите весь поток на более дорогую модель из-за одного впечатляющего примера: выделите класс заданий, где разница воспроизводится, и оставьте остальные на подходящей более дешёвой модели.

Что проверить перед переключением model ID

В прямом API используйте claude-opus-5-5 или claude-fable-5-1. По описанию Opus и описанию Fable, у обеих моделей окно контекста 1 млн токенов и стандартный максимум ответа 128 тыс. токенов. Это пределы моделей, а не бесплатный объём или одинаковая цена длинного запроса.

Для существующего агента замены одного ID недостаточно. Проверьте effort, max_tokens, обработку thinking blocks, выбор инструментов, попадания в кэш и собственный сценарий отката. У Opus 5.5 есть особенности thinking и tool choice, которые могут повлиять на прежний код. Практические детали вынесены в отдельные страницы Opus 5.5 и Fable 5.1.

Итак: для сложной новой задачи сначала берите Opus 5.5, измеряйте принятый результат и повышайте effort при необходимости. Fable 5.1 оставляйте там, где она убедительно выигрывает по качеству или полной стоимости работы. Для обычной нагрузки не пропускайте проверку Sonnet и Haiku.