Для большинства нагрузок ответ прост: начинайте с Opus 5. Его стандартная ставка за входные и выходные токены вдвое ниже, чем у Fable 5.1. Но в длинных агентских сессиях появляется исключение: чтение из кэша у Fable стоит $0,25 за миллион токенов против $0,50 у Opus. Если почти весь контекст многократно используется повторно, итоговый счёт способен измениться.
Поэтому «какая модель дешевле» — это два разных вопроса. Цена одинакового числа токенов чаще говорит в пользу Opus. Стоимость завершённой и принятой задачи может оказаться ниже у Fable, если модель использует заметно меньше токенов, делает меньше попыток или снижает объём ручной доработки.
На 4 сентября 2026 года сама Anthropic в обзоре моделей советует Opus 5 для большинства задач. Fable 5.1 предназначена для требовательных рассуждений и длительной агентской работы, в том числе когда Opus с повышенным effort не достигает заданного результата.
Актуальная линейка даёт четыре разных точки старта
Haiku, Sonnet, Opus и Fable полезнее воспринимать не как места в рейтинге, а как кандидатов под разные ограничения.
| Модель | ID в Claude API | Вход / выход за 1 млн токенов | Контекст / максимум выхода | Относительная скорость |
|---|---|---|---|---|
| Haiku 4.5 | claude-haiku-4-5-20251001 | $1 / $5 | 200K / 64K | самая высокая |
| Sonnet 5 | claude-sonnet-5 | $2 / $10 | 1 млн / 128K | высокая |
| Opus 5 | claude-opus-5 | $5 / $25 | 1 млн / 128K | средняя |
| Fable 5.1 | claude-fable-5-1 | $10 / $50 | 1 млн / 128K | ниже |
Это стандартные долларовые ставки прямого Claude API. Они не описывают лимиты подписок Claude, доступность модели в конкретном аккаунте, тариф посредника в рублях или региональную цену партнёрской облачной платформы.
Haiku разумно проверять на массовых операциях с быстрым автоматическим контролем. Sonnet часто закрывает повседневный код, анализ и вызов инструментов без перехода к дорогим моделям. Opus подходит для сложной инженерной работы и ошибок с высокой ценой. Fable имеет смысл добавлять только к задачам, где уже виден конкретный предел Opus.

Из пяти ставок только одна ниже у Fable
Таблица цен Claude API отдельно считает свежий ввод, запись в кэш и повторное чтение:
| USD за 1 млн токенов | Fable 5.1 | Opus 5 |
|---|---|---|
| Свежий ввод | $10 | $5 |
| Вывод | $50 | $25 |
| Запись кэша на 5 минут | $12,50 | $6,25 |
| Запись кэша на 1 час | $20 | $10 |
| Чтение из кэша | $0,25 | $0,50 |
| Batch: ввод / вывод | $5 / $25 | $2,50 / $12,50 |
Дешёвое чтение не возникает само по себе. В документации по prompt caching сначала создаётся запись для неизменного префикса. Повторный запрос получает ставку чтения, только если префикс совпал и срок хранения не закончился. По умолчанию он равен пяти минутам; часовая запись стоит дороже. Изменение tools, system или ранней истории способно уничтожить предполагаемое попадание в кэш.
Не подменяйте стандартный Opus его fast mode. Быстрый режим — отдельная research preview прямого API со ставкой $10/$50. Он покупает меньшую задержку и не участвует в обычном сравнении $5/$25.
Порог можно рассчитать до запуска
Пусть все величины указаны в миллионах токенов:
I— свежий ввод;O— вывод;W5— запись кэша на пять минут;W1— запись кэша на час;C— чтение из кэша.
Если обе модели расходуют одинаковое количество каждого типа, их счета равны:
Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C
Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C
Отсюда следует условие, при котором Fable дешевле:
C > 20I + 100O + 25W5 + 40W1
Например, запрос использует 100 тысяч свежих входных и 20 тысяч выходных токенов, а новой записи кэша нет. Для окупаемости Fable требуется больше 4 млн токенов чтения из кэша. При 1,5 млн такой входной истории Fable обойдётся примерно в $2,38, Opus — в $1,75. При 6 млн результат меняется: около $3,50 против $4.
Новая запись кэша сдвигает границу ещё дальше. Первый ход поэтому может быть выгоднее на Opus, хотя серия последующих ходов — на Fable. Формула проверяет только прайс-лист при равных объёмах; модели в действительности могут расходовать разное число токенов.

Откуда взялся результат «Fable дешевле Opus»
Cognition опубликовала данные Fable 5.1 в Devin: в FrontierCode 1.1 Extended при thinking level medium средняя цена задания составила $2,68 для Fable 5.1 и $3,51 для Opus 5. По данным компании, Fable использовала на 33% меньше токенов, а более 95% токенов обеих моделей были чтением из кэша. Типичное задание читало около 3 млн кэшированных токенов на Fable и 4,5 млн на Opus.
Этот результат объясним: самая крупная часть нагрузки попала в единственную категорию, где ставка Fable ниже, и сама Fable прочитала меньше токенов. Но это не общий закон. Набор задач FrontierCode, инструменты Devin, структура кэша, medium thinking и критерии приёмки принадлежат конкретному испытанию поставщика.
Ещё одна похожая цифра имеет другой знаменатель. В анонсе Fable 5.1 Anthropic оценивает экономию примерно в 25% для типичных и до 45% для очень агентных нагрузок по сравнению с Fable 5. Оценка построена на четырёх неделях реального использования в августе 2026 года при стандартном effort. Это не скидка относительно Opus 5.
Измеряйте не вызов, а принятую работу
Составьте небольшой набор реальных заданий: обычные, сложные и дорогие при ошибке. У каждого должен быть наблюдаемый критерий — тесты, schema, сверка чисел с источником, результат браузерного сценария или бизнес-условие. Обе модели получают одинаковые входные данные, инструменты, права, время и правило остановки.
Сохраняйте по каждому запуску:
| Данные | Что они показывают |
|---|---|
| Все классы токенов | реальную долю свежего ввода, записей, чтений, thinking и вывода |
| Приёмку | первый успех, успех после повтора или окончательный провал |
| Время | путь до первого принятого результата, медиану и P95 |
| Сбои | тайм-ауты, отказы, ошибочные tool calls, циклы и fallback |
| Труд человека | уточнения, проверку, исправления и восстановление контекста |
| Переделку | отменённые или повторно выполненные изменения |
Итоговая метрика:
стоимость принятой задачи = (токены + инструменты + повторы + работа человека + переделки) / число принятых задач
Если Opus стабильно проходит с первой попытки, низкая ставка чтения Fable редко покроет двойную цену ввода и вывода. Если длинный агент постоянно перечитывает одно и то же хранилище, а Opus требует больше ходов и исправлений, Fable стоит оставить как узкое повышение уровня.
Такой подход одновременно защищает от лишнего сравнения дорогих моделей. Если Sonnet 5 проходит проверку за $2/$10, выбирать между Opus и Fable для всей нагрузки незачем. Если задачу легко автоматически проверить и хватает 200K контекста, Haiku может быть ещё разумнее.
Перед переключением уточните, где именно идёт счёт
Формулы относятся к стандартному прямому Claude API. Batch, fast mode, коэффициент для US-only inference, цены Bedrock и Google Cloud, наценка шлюза и подписка Claude образуют другие расчёты. Сначала проверьте платформу, model ID и поля usage, которые действительно появятся в счёте.
Fable 5.1 также использует всегда включённое adaptive thinking и имеет отдельные условия для tool choice и сохранённых thinking blocks. До расширения трафика проверьте effort, max_tokens, попадания в кэш, инструменты, отказы и откат. Подробности собраны в отдельном руководстве по Claude Fable 5.1.
Практичный выбор на старте — Opus 5, а при умеренном риске даже Sonnet 5. Fable 5.1 получает трафик только после того, как реальные задания покажут недостающую способность или более низкую полную стоимость.



