По состоянию на 1 октября 2026 года из трёх моделей по API можно вызвать только две: Claude Sonnet 5.5 и Claude Opus 5.5. Gemini 4 Argon, которую Google анонсировала 30 сентября, выдаётся лишь командам киберзащиты, допущенным к программе Fairwind; ни ID модели, ни даты открытия для разработчиков в анонсе Google нет. Поэтому практический выбор сегодня выглядит так:
- Sonnet 5.5 — для чётко поставленных повседневных задач: генерация кода, анализ данных, агенты с инструментами. Цена $2 за 1 млн входных токенов и $10 за 1 млн выходных.
- Opus 5.5 — для многочасовых автономных агентов, крупного рефакторинга и сложной системной инженерии. Цена ровно вдвое выше: $4 и $20.
- Argon — стоит заложить в план повторную проверку, если ваши задачи связаны с длинным контекстом, видео, юридическими или финансовыми агентами. В этих строках таблицы Google отрыв от Opus 5.5 наибольший, но проверить его самостоятельно пока невозможно.
Все цены ниже — официальные, в долларах США за 1 млн токенов, без налогов. Все бенчмарки опубликованы вендорами или лидербордами; у каждого числа указано, кто его получил.
Какие из трёх моделей доступны сегодня
| Gemini 4 Argon | Claude Sonnet 5.5 | Claude Opus 5.5 | |
|---|---|---|---|
| Вышла | анонс 30 сентября 2026 года | 28 сентября 2026 года | 22 сентября 2026 года |
| Кто может вызвать | участники программы Fairwind | все клиенты Claude API | все клиенты Claude API |
| ID модели | не опубликован | claude-sonnet-5-5 | claude-opus-5-5 |
| Окно контекста | не указано | 1 млн токенов | 1 млн токенов |
| Максимум вывода | 1 млн токенов | 128 тыс. токенов | 128 тыс. токенов |
| Скорость по оценке вендора | не указана | Fast | Moderate |
Google обещает открыть Argon разработчикам, компаниям и обычным пользователям «как можно скорее», начиная с платных клиентов API и подписчиков Google AI Ultra. Срока нет. На страницах моделей и цен Gemini API модель Argon не значится. Название «Gemini 4 Pro», которое ходило до анонса, официальным не является: модель называется Gemini 4 Argon.
Если нужна именно модель Google и именно сейчас, самая новая из доступных — gemini-3.8-flash. Это модель другого класса и другой цены: $0,75 за ввод и $3,75 за вывод до 31 декабря 2026 года, затем $1,50 и $7,50; есть бесплатный уровень. Подробности — в разборе Gemini 3.8 Flash API: ID модели, цены, лимиты и миграция.
Обе модели Claude, по обзору моделей Anthropic, работают в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Обе принимают текст и изображения, отдают текст, надёжная граница знаний — июнь 2026 года. Различаются они настройками по умолчанию. Параметр effort задаёт, сколько усилий модель тратит на рассуждения: у Opus 5.5 по умолчанию стоит medium, у Sonnet 5.5 — high. В Opus 5.5 адаптивное мышление включено всегда; в Sonnet 5.5 рассуждение перед ответом можно убрать настройкой thinking: {"type": "between_tools"}, но только на уровнях low, medium и high.
Сколько стоят токены: Argon как Sonnet 5.5, затем как Opus 5.5
| Категория, за 1 млн токенов | Argon, вводная цена | Argon, обычная цена | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|---|
| Ввод | $2 | $4 | $2 | $4 |
| Вывод | $10 | $20 | $10 | $20 |
| Чтение из кэша | $0,10 | не указана | $0,20 | $0,20 |
| Запись в кэш на 5 минут | не указана | не указана | $2,50 | $5 |
| Запись в кэш на 1 час | не указана | не указана | $4 | $8 |
| Batch, ввод и вывод | не указана | не указана | $1 и $5 | $2 и $10 |
Цены Claude взяты из тарифной таблицы Anthropic, цены Argon — из анонса Google и сноски к нему. Три наблюдения из этой таблицы влияют на выбор.
Первое: вводная цена Argon совпадает с ценой Sonnet 5.5, а обычная — с ценой Opus 5.5. Когда закончится вводный период, Google не сообщает. Бюджет, рассчитанный под $2 и $10, после его окончания удвоится.
Второе: кэшированный ввод Argon продаётся со скидкой 95 % от цены ввода. При вводной цене это $0,10 за 1 млн токенов, вдвое меньше, чем чтение из кэша у обеих моделей Claude. Сохранится ли скидка при обычной цене, в анонсе не сказано.
Третье: чтение из кэша у Sonnet 5.5 и Opus 5.5 стоит одинаково, $0,20. Чем больше в запросе закэшированного контекста, тем меньше разница между ними. У Opus 5.5 есть ещё быстрый режим (fast mode, исследовательская версия, только Claude API) по $8 и $40; у Sonnet 5.5 его нет. За обработку только в США Anthropic берёт коэффициент 1,1; Bedrock и Google Cloud назначают цены самостоятельно.
Пример А: один запрос без кэша
Условие: 100 000 входных и 20 000 выходных токенов. Формула: ввод в млн × цена ввода + вывод в млн × цена вывода.
| Модель | Расчёт | Итог |
|---|---|---|
| Sonnet 5.5 | 0,1 × 2 + 0,02 × 10 | $0,40 |
| Opus 5.5 | 0,1 × 4 + 0,02 × 20 | $0,80 |
| Argon, вводная цена | 0,1 × 2 + 0,02 × 10 | $0,40 |
| Argon, обычная цена | 0,1 × 4 + 0,02 × 20 | $0,80 |
Пример Б: шаг агента с большим кэшем
Условие: 200 000 токенов прочитано из кэша, 20 000 новых входных токенов, 5 000 выходных.
| Модель | Расчёт | Итог |
|---|---|---|
| Sonnet 5.5 | 0,2 × 0,20 + 0,02 × 2 + 0,005 × 10 | $0,13 |
| Opus 5.5 | 0,2 × 0,20 + 0,02 × 4 + 0,005 × 20 | $0,22 |
| Argon, вводная цена | 0,2 × 0,10 + 0,02 × 2 + 0,005 × 10 | $0,11 |

В примере Б Sonnet 5.5 дешевле Opus 5.5 на 41 %, а не на 50 %: (0,22 − 0,13) / 0,22 ≈ 0,41. Причина — одинаковая цена чтения из кэша.
Оба примера предполагают, что модели тратят одинаковое число токенов. В реальной работе это не так: число токенов зависит от токенизатора, уровня effort и объёма рассуждений (как они попадают в счёт — Токены рассуждений в OpenAI, Claude и Gemini: оплата и контроль). Запись в кэш, инструменты и налоги в расчёты не входят, а строки Argon останутся условными, пока модель нельзя вызвать. Чтобы пересчитать под себя, подставьте собственные числа токенов из логов.
Бенчмарки: кто измерял и что из этого следует
Единого независимого сравнения трёх моделей по многим тестам пока нет. Есть три набора чисел от трёх разных авторов, и смешивать их столбцы нельзя.
Vals Index: единственная шкала, где есть все три
Vals Index — сводный индекс независимого лидерборда Vals AI по задачам из финансов, программирования, права и налогов, взвешенным по вкладу в ВВП. Версия 2.1, обновление от 30 сентября 2026 года:
| Модель | Балл, % | Стоимость одного теста | Время |
|---|---|---|---|
| Gemini 4 Argon | 68,90 | $15,68 | 46 мин 33 с |
| Claude Sonnet 5.5 | 67,04 | $21,34 | 1 ч 18 мин |
| Claude Opus 5.5 | 66,97 | $32,14 | 1 ч 19 мин |
Отсюда следуют две вещи. Sonnet 5.5 и Opus 5.5 разделяют 0,07 процентного пункта, и Vals считает их результат фактически равным, при этом тест на Sonnet 5.5 обходится примерно в две трети стоимости теста на Opus 5.5 (21,34 / 32,14 ≈ 0,66). Argon опережает обе модели Claude примерно на 1,9 пункта, а тест с ней стоит дешевле и проходит быстрее. По какой цене Vals считал Argon, на странице не указано; если по вводной, после её отмены стоимость теста вырастет.
Ограничение: это один индекс с собственным набором задач, и его строки меняются при перезапусках. Ссылаясь на эти числа, указывайте версию и дату.
Таблица Google: Argon против Opus 5.5, без Sonnet 5.5
В сравнительной таблице Google Sonnet 5.5 отсутствует. В 14 из 18 строк с результатом Opus 5.5 впереди Argon, в четырёх — Opus 5.5.
| Тест, % | Argon | Opus 5.5 |
|---|---|---|
| Vals Index | 68,9 | 67,0 |
| AutomationBench | 51,3 | 42,5 |
| Vals Finance Agent v2 | 65,4 | 58,6 |
| Harvey Legal Agent Benchmark | 19,6 | 3,8 |
| DeepSWE v1.1 | 77,9 | 74,2 |
| Vibe Code Bench | 91,9 | 90,3 |
| LABBench 2 | 88,8 | 73,1 |
| RiemannBench | 76,0 | 69,6 |
| GraphWalks, до 128 тыс. токенов | 99,7 | 90,6 |
| GraphWalks, от 256 тыс. до 1 млн | 84,2 | 66,8 |
| Agent's Last Exam | 39,5 | 38,2 |
| Chartography | 71,6 | 66,3 |
| LVBench | 91,7 | 83,7 |
| CWE-bench v1 | 68,0 | 67,0 |
| FrontierSWE v2 | 55,0 | 62,3 |
| Terminal-Bench 4.0 | 57,4 | 66,4 |
| PostTrainBench | 45,3 | 49,3 |
| Terminal-Bench Science 0.1 | 57,6 | 63,3 |
Читать таблицу стоит с оговорками из методики Google. Тесты отобраны самим вендором. Argon запускалась с максимальными настройками мышления, а числа конкурентов в основном взяты из их собственных отчётов или публичных лидербордов. Часть строк Google посчитала сама для всех моделей: PostTrainBench, LABBench 2, GraphWalks и LVBench. В LVBench условия были разными: Gemini получала видео с частотой один кадр в секунду, Opus 5.5 — 600 кадров, как сказано в методике, «из-за ограничений API».
Практический смысл таков. Opus 5.5 впереди в работе в терминале (обе строки Terminal-Bench), во FrontierSWE и в ML-инженерии (PostTrainBench). Самые крупные отрывы Argon — длинный контекст, юридические и финансовые агенты, научные задачи LABBench 2 и видео. В программировании картина смешанная: DeepSWE и Vibe Code Bench за Argon, FrontierSWE и Terminal-Bench за Opus 5.5.
Числа Anthropic: Sonnet 5.5 против Opus 5.5
Anthropic в анонсе Sonnet 5.5 сравнивает две свои модели сама:
| Тест | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Terminal-Bench 4.0, % | 70,6 | 66,4 |
| FrontierCode 1.1, % | 46,2 при max, 52,1 при xhigh | 54,4 |
| CursorBench 4.0, % | 55,5 | 57,8 |
| GDPval-AA v2.1, баллы | 1844 | 1846 |
| AA-Briefcase v1.1, баллы | 1811 | 1822 |
| Humanity's Last Exam с инструментами, % | 64,5 | 67,7 |
| OSWorld 2.1, % | 80,1 | 81,8 |
| Chartography без инструментов, % | 61,6 | 64,4 |
Opus 5.5 впереди в семи строках из восьми, но разрыв чаще всего составляет несколько пунктов. Sonnet 5.5 выигрывает Terminal-Bench 4.0, где результат Opus 5.5 получен на xhigh, лучшем для него уровне. Расхожая формула «почти как Opus, но вдвое дешевле» этим числам соответствует, с поправкой самой Anthropic: на сложных задачах с открытой постановкой Opus 5.5, по её словам, «остаётся заметно сильнее».
Два уточнения. Заявления Anthropic о том, что Sonnet 5.5 генерирует ответ более чем на 30 % быстрее и обходится до 30 % дешевле на задачу, относятся к сравнению с Sonnet 5, а не с Opus 5.5 или Gemini. И результат Opus 5.5 в Chartography здесь 64,4 %, а в таблице Google — 66,3 %: это разные запуски, и каждое число остаётся при своём источнике. По той же причине нельзя ставить 70,6 % Sonnet 5.5 из таблицы Anthropic рядом с 57,4 % Argon из таблицы Google как прямое сравнение: совместного замера этих двух моделей ни один вендор не публиковал.
Что выбрать сейчас: Sonnet 5.5 или Opus 5.5
Правило выбора из трёх шагов.
- Оцените постановку задачи. Если задача чётко очерчена — написать функцию по описанию, разобрать выгрузку, сгенерировать текст, выполнить цепочку вызовов инструментов, — берите Sonnet 5.5. На Vals Index она идёт вровень с Opus 5.5, токен стоит вдвое меньше, а по оценке Anthropic она быстрее.
- Если агент работает часами или задача не имеет ясных границ, берите Opus 5.5. Руководство Anthropic по выбору модели относит к ней многочасовых автономных агентов для программирования, масштабный рефакторинг, сложную системную инженерию, задачи с большим объёмом изображений и управление компьютером. Там же сказано, что большинство нагрузок стоит начинать с Opus 5.5.
- Прежде чем менять модель, попробуйте изменить
effort. Anthropic прямо пишет, что настройка этого параметра часто даёт больше, чем переход на другую модель. Как подобрать уровень, описано в материале Claude Opus 5.5: какой уровень effort выбрать и как его задать.

Если сомнения остаются, прогоните набор собственных типовых задач на обеих моделях и сравните не только качество, но и фактическое число токенов: уровни effort по умолчанию у моделей разные (high у Sonnet 5.5, medium у Opus 5.5), поэтому расход токенов на одну задачу может не совпасть.
При переходе с более старых моделей Claude учтите, что обе модели 5.5 отклоняют принудительный вызов инструмента (tool_choice со значением any или tool) с ошибкой 400 и не принимают thinking: {"type": "disabled"}. Полный список изменений — в статье Claude Opus 5.5: сколько стоит API и что проверить при переходе с Opus 5. Если вы выбираете не между двумя, а между всеми моделями Anthropic, пригодится Opus 5.5 или Fable 5.1: какую модель Claude выбрать для API.
Когда перепроверить выбор после открытия Argon
Откладывать проект до выхода Argon незачем: срока нет, а поведение её API не описано. Вернуться к вопросу стоит, если выполняется хотя бы одно условие:
- Ответ не помещается в 128 тыс. токенов. У Argon заявлен лимит вывода 1 млн токенов, у обеих моделей Claude — 128 тыс. в синхронном режиме.
- Задача опирается на очень длинный контекст. На GraphWalks от 256 тыс. до 1 млн токенов у Argon 84,2 % против 66,8 % у Opus 5.5 (замер Google). Размер окна контекста Argon при этом не опубликован.
- Вы строите юридического или финансового агента, работаете с видео или научными задачами уровня LABBench 2. В этих строках отрыв Argon наибольший.
- Большая часть счёта — чтение из кэша. При вводной цене оно вдвое дешевле, чем у Claude.
Менее вероятно, что Argon изменит выбор, если ваш агент в основном работает в терминале или занимается ML-инженерией: в этих тестах впереди Opus 5.5, а в Terminal-Bench 4.0 по данным Anthropic ещё выше Sonnet 5.5.
Когда модель появится в документации Gemini API, проверьте по порядку:
- ID модели и окно контекста.
- Лимиты запросов для вашего уровня аккаунта.
- Дату окончания вводной цены и то, какой окажется цена кэша и Batch после неё.
- Поведение при вызове инструментов и управлении мышлением: у Claude 5.5 именно здесь есть жёсткие ограничения, и код под них придётся сверить с правилами Gemini API.
- Результат на ваших собственных задачах с подсчётом токенов, а не только цену за миллион.
Частые вопросы
Можно ли уже вызвать Gemini 4 Argon через API?
Нет. По состоянию на 1 октября 2026 года доступ есть только у команд киберзащиты из программы Fairwind. Google обещает открыть модель сначала платным клиентам API и подписчикам Google AI Ultra, но дату не называет.
Что сильнее: Gemini 4 Argon или Claude Opus 5.5?
По таблице Google Argon впереди в 14 строках из 18, Opus 5.5 — в четырёх: FrontierSWE v2, обе строки Terminal-Bench и PostTrainBench. На независимом Vals Index у Argon 68,90 % против 66,97 %. Таблицу составил сам вендор, а воспроизвести эти результаты снаружи до открытия модели нельзя.
Что дешевле: Argon, Sonnet 5.5 или Opus 5.5?
По цене токена Sonnet 5.5 и Argon на вводном тарифе стоят одинаково, $2 и $10, а Opus 5.5 и Argon на обычном тарифе — $4 и $20. Реальная стоимость задачи зависит от числа потраченных токенов: на Vals Index один тест обошёлся в $15,68 у Argon, $21,34 у Sonnet 5.5 и $32,14 у Opus 5.5.
Есть ли прямое сравнение Argon и Sonnet 5.5?
От вендоров нет: Google сравнивает Argon с Opus 5.5, Anthropic — Sonnet 5.5 с Opus 5.5. Обе модели на одной шкале есть только в Vals Index: 68,90 % у Argon и 67,04 % у Sonnet 5.5.



