AIFreeAPI Logo

Fable 5.1 или Opus 5: где дешевле API и когда решает кэш

A
5 min readСравнение AI-моделей

У Opus 5 вдвое дешевле обычный ввод, вывод и запись кэша. У Fable 5.1 вдвое дешевле чтение из кэша. Победителя определяет структура реальной задачи.

Сравнение Fable 5.1 и Opus 5 с тарифами Claude API, порогом окупаемости кэша и последовательностью практического выбора

Для большинства нагрузок ответ прост: начинайте с Opus 5. Его стандартная ставка за входные и выходные токены вдвое ниже, чем у Fable 5.1. Но в длинных агентских сессиях появляется исключение: чтение из кэша у Fable стоит $0,25 за миллион токенов против $0,50 у Opus. Если почти весь контекст многократно используется повторно, итоговый счёт способен измениться.

Поэтому «какая модель дешевле» — это два разных вопроса. Цена одинакового числа токенов чаще говорит в пользу Opus. Стоимость завершённой и принятой задачи может оказаться ниже у Fable, если модель использует заметно меньше токенов, делает меньше попыток или снижает объём ручной доработки.

На 4 сентября 2026 года сама Anthropic в обзоре моделей советует Opus 5 для большинства задач. Fable 5.1 предназначена для требовательных рассуждений и длительной агентской работы, в том числе когда Opus с повышенным effort не достигает заданного результата.

Актуальная линейка даёт четыре разных точки старта

Haiku, Sonnet, Opus и Fable полезнее воспринимать не как места в рейтинге, а как кандидатов под разные ограничения.

МодельID в Claude APIВход / выход за 1 млн токеновКонтекст / максимум выходаОтносительная скорость
Haiku 4.5claude-haiku-4-5-20251001$1 / $5200K / 64Kсамая высокая
Sonnet 5claude-sonnet-5$2 / $101 млн / 128Kвысокая
Opus 5claude-opus-5$5 / $251 млн / 128Kсредняя
Fable 5.1claude-fable-5-1$10 / $501 млн / 128Kниже

Это стандартные долларовые ставки прямого Claude API. Они не описывают лимиты подписок Claude, доступность модели в конкретном аккаунте, тариф посредника в рублях или региональную цену партнёрской облачной платформы.

Haiku разумно проверять на массовых операциях с быстрым автоматическим контролем. Sonnet часто закрывает повседневный код, анализ и вызов инструментов без перехода к дорогим моделям. Opus подходит для сложной инженерной работы и ошибок с высокой ценой. Fable имеет смысл добавлять только к задачам, где уже виден конкретный предел Opus.

Выбор Fable 5.1 или Opus 5 за 90 секунд по риску задачи, повторяемости контекста, порогу кэша и стоимости принятой работы
Выбор Fable 5.1 или Opus 5 за 90 секунд по риску задачи, повторяемости контекста, порогу кэша и стоимости принятой работы

Из пяти ставок только одна ниже у Fable

Таблица цен Claude API отдельно считает свежий ввод, запись в кэш и повторное чтение:

USD за 1 млн токеновFable 5.1Opus 5
Свежий ввод$10$5
Вывод$50$25
Запись кэша на 5 минут$12,50$6,25
Запись кэша на 1 час$20$10
Чтение из кэша$0,25$0,50
Batch: ввод / вывод$5 / $25$2,50 / $12,50

Дешёвое чтение не возникает само по себе. В документации по prompt caching сначала создаётся запись для неизменного префикса. Повторный запрос получает ставку чтения, только если префикс совпал и срок хранения не закончился. По умолчанию он равен пяти минутам; часовая запись стоит дороже. Изменение tools, system или ранней истории способно уничтожить предполагаемое попадание в кэш.

Не подменяйте стандартный Opus его fast mode. Быстрый режим — отдельная research preview прямого API со ставкой $10/$50. Он покупает меньшую задержку и не участвует в обычном сравнении $5/$25.

Порог можно рассчитать до запуска

Пусть все величины указаны в миллионах токенов:

  • I — свежий ввод;
  • O — вывод;
  • W5 — запись кэша на пять минут;
  • W1 — запись кэша на час;
  • C — чтение из кэша.

Если обе модели расходуют одинаковое количество каждого типа, их счета равны:

Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C

Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C

Отсюда следует условие, при котором Fable дешевле:

C > 20I + 100O + 25W5 + 40W1

Например, запрос использует 100 тысяч свежих входных и 20 тысяч выходных токенов, а новой записи кэша нет. Для окупаемости Fable требуется больше 4 млн токенов чтения из кэша. При 1,5 млн такой входной истории Fable обойдётся примерно в $2,38, Opus — в $1,75. При 6 млн результат меняется: около $3,50 против $4.

Новая запись кэша сдвигает границу ещё дальше. Первый ход поэтому может быть выгоднее на Opus, хотя серия последующих ходов — на Fable. Формула проверяет только прайс-лист при равных объёмах; модели в действительности могут расходовать разное число токенов.

Порог окупаемости кэша для Fable 5.1 и Opus 5 с тарифами, числовыми примерами и расчётом стоимости принятой задачи
Порог окупаемости кэша для Fable 5.1 и Opus 5 с тарифами, числовыми примерами и расчётом стоимости принятой задачи

Откуда взялся результат «Fable дешевле Opus»

Cognition опубликовала данные Fable 5.1 в Devin: в FrontierCode 1.1 Extended при thinking level medium средняя цена задания составила $2,68 для Fable 5.1 и $3,51 для Opus 5. По данным компании, Fable использовала на 33% меньше токенов, а более 95% токенов обеих моделей были чтением из кэша. Типичное задание читало около 3 млн кэшированных токенов на Fable и 4,5 млн на Opus.

Этот результат объясним: самая крупная часть нагрузки попала в единственную категорию, где ставка Fable ниже, и сама Fable прочитала меньше токенов. Но это не общий закон. Набор задач FrontierCode, инструменты Devin, структура кэша, medium thinking и критерии приёмки принадлежат конкретному испытанию поставщика.

Ещё одна похожая цифра имеет другой знаменатель. В анонсе Fable 5.1 Anthropic оценивает экономию примерно в 25% для типичных и до 45% для очень агентных нагрузок по сравнению с Fable 5. Оценка построена на четырёх неделях реального использования в августе 2026 года при стандартном effort. Это не скидка относительно Opus 5.

Измеряйте не вызов, а принятую работу

Составьте небольшой набор реальных заданий: обычные, сложные и дорогие при ошибке. У каждого должен быть наблюдаемый критерий — тесты, schema, сверка чисел с источником, результат браузерного сценария или бизнес-условие. Обе модели получают одинаковые входные данные, инструменты, права, время и правило остановки.

Сохраняйте по каждому запуску:

ДанныеЧто они показывают
Все классы токеновреальную долю свежего ввода, записей, чтений, thinking и вывода
Приёмкупервый успех, успех после повтора или окончательный провал
Времяпуть до первого принятого результата, медиану и P95
Сбоитайм-ауты, отказы, ошибочные tool calls, циклы и fallback
Труд человекауточнения, проверку, исправления и восстановление контекста
Переделкуотменённые или повторно выполненные изменения

Итоговая метрика:

стоимость принятой задачи = (токены + инструменты + повторы + работа человека + переделки) / число принятых задач

Если Opus стабильно проходит с первой попытки, низкая ставка чтения Fable редко покроет двойную цену ввода и вывода. Если длинный агент постоянно перечитывает одно и то же хранилище, а Opus требует больше ходов и исправлений, Fable стоит оставить как узкое повышение уровня.

Такой подход одновременно защищает от лишнего сравнения дорогих моделей. Если Sonnet 5 проходит проверку за $2/$10, выбирать между Opus и Fable для всей нагрузки незачем. Если задачу легко автоматически проверить и хватает 200K контекста, Haiku может быть ещё разумнее.

Перед переключением уточните, где именно идёт счёт

Формулы относятся к стандартному прямому Claude API. Batch, fast mode, коэффициент для US-only inference, цены Bedrock и Google Cloud, наценка шлюза и подписка Claude образуют другие расчёты. Сначала проверьте платформу, model ID и поля usage, которые действительно появятся в счёте.

Fable 5.1 также использует всегда включённое adaptive thinking и имеет отдельные условия для tool choice и сохранённых thinking blocks. До расширения трафика проверьте effort, max_tokens, попадания в кэш, инструменты, отказы и откат. Подробности собраны в отдельном руководстве по Claude Fable 5.1.

Практичный выбор на старте — Opus 5, а при умеренном риске даже Sonnet 5. Fable 5.1 получает трафик только после того, как реальные задания покажут недостающую способность или более низкую полную стоимость.