# Gemini 4 Argon, Opus 5.5 или Sonnet 5.5: что выбрать для API

> На 1 октября 2026 года Gemini 4 Argon разработчикам недоступна, выбирать приходится между Sonnet 5.5 за $2/$10 и Opus 5.5 за $4/$20. Цены, расчёты и бенчмарки.

- Source: https://www.aifreeapi.com/ru/posts/gemini-4-argon-vs-claude-opus-5-5-vs-sonnet-5-5
- Language: ru
- Published: 2026-10-01
- Updated: 2026-10-01
- Publisher: AI Free API (https://www.aifreeapi.com)

**По состоянию на 1 октября 2026 года из трёх моделей по API можно вызвать только две: Claude Sonnet 5.5 и Claude Opus 5.5.** Gemini 4 Argon, которую Google анонсировала 30 сентября, выдаётся лишь командам киберзащиты, допущенным к программе Fairwind; ни ID модели, ни даты открытия для разработчиков в [анонсе Google](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/) нет. Поэтому практический выбор сегодня выглядит так:

- **Sonnet 5.5** — для чётко поставленных повседневных задач: генерация кода, анализ данных, агенты с инструментами. Цена $2 за 1 млн входных токенов и $10 за 1 млн выходных.
- **Opus 5.5** — для многочасовых автономных агентов, крупного рефакторинга и сложной системной инженерии. Цена ровно вдвое выше: $4 и $20.
- **Argon** — стоит заложить в план повторную проверку, если ваши задачи связаны с длинным контекстом, видео, юридическими или финансовыми агентами. В этих строках таблицы Google отрыв от Opus 5.5 наибольший, но проверить его самостоятельно пока невозможно.

Все цены ниже — официальные, в долларах США за 1 млн токенов, без налогов. Все бенчмарки опубликованы вендорами или лидербордами; у каждого числа указано, кто его получил.

![Цена ввода за 1 млн токенов: Gemini 4 Argon $2, Claude Opus 5.5 $4, Claude Sonnet 5.5 $2; Argon пока закрыта для API](https://www.aifreeapi.com/posts/ru/gemini-4-argon-vs-claude-opus-5-5-vs-sonnet-5-5/img/cover.webp)

## Какие из трёх моделей доступны сегодня

| | Gemini 4 Argon | Claude Sonnet 5.5 | Claude Opus 5.5 |
| --- | --- | --- | --- |
| Вышла | анонс 30 сентября 2026 года | 28 сентября 2026 года | 22 сентября 2026 года |
| Кто может вызвать | участники программы Fairwind | все клиенты Claude API | все клиенты Claude API |
| ID модели | не опубликован | `claude-sonnet-5-5` | `claude-opus-5-5` |
| Окно контекста | не указано | 1 млн токенов | 1 млн токенов |
| Максимум вывода | 1 млн токенов | 128 тыс. токенов | 128 тыс. токенов |
| Скорость по оценке вендора | не указана | Fast | Moderate |

Google обещает открыть Argon разработчикам, компаниям и обычным пользователям «как можно скорее», начиная с платных клиентов API и подписчиков Google AI Ultra. Срока нет. На страницах [моделей](https://ai.google.dev/gemini-api/docs/models) и [цен](https://ai.google.dev/gemini-api/docs/pricing) Gemini API модель Argon не значится. Название «Gemini 4 Pro», которое ходило до анонса, официальным не является: модель называется Gemini 4 Argon.

Если нужна именно модель Google и именно сейчас, самая новая из доступных — `gemini-3.8-flash`. Это модель другого класса и другой цены: $0,75 за ввод и $3,75 за вывод до 31 декабря 2026 года, затем $1,50 и $7,50; есть бесплатный уровень. Подробности — в разборе [Gemini 3.8 Flash API: ID модели, цены, лимиты и миграция](/ru/posts/gemini-3-8-flash).

Обе модели Claude, по [обзору моделей Anthropic](https://platform.claude.com/docs/en/about-claude/models/overview), работают в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Обе принимают текст и изображения, отдают текст, надёжная граница знаний — июнь 2026 года. Различаются они настройками по умолчанию. Параметр `effort` задаёт, сколько усилий модель тратит на рассуждения: у Opus 5.5 по умолчанию стоит `medium`, у Sonnet 5.5 — `high`. В Opus 5.5 адаптивное мышление включено всегда; в Sonnet 5.5 рассуждение перед ответом можно убрать настройкой `thinking: {"type": "between_tools"}`, но только на уровнях `low`, `medium` и `high`.

## Сколько стоят токены: Argon как Sonnet 5.5, затем как Opus 5.5

| Категория, за 1 млн токенов | Argon, вводная цена | Argon, обычная цена | Sonnet 5.5 | Opus 5.5 |
| --- | ---: | ---: | ---: | ---: |
| Ввод | $2 | $4 | $2 | $4 |
| Вывод | $10 | $20 | $10 | $20 |
| Чтение из кэша | $0,10 | не указана | $0,20 | $0,20 |
| Запись в кэш на 5 минут | не указана | не указана | $2,50 | $5 |
| Запись в кэш на 1 час | не указана | не указана | $4 | $8 |
| Batch, ввод и вывод | не указана | не указана | $1 и $5 | $2 и $10 |

Цены Claude взяты из [тарифной таблицы Anthropic](https://platform.claude.com/docs/en/about-claude/pricing), цены Argon — из анонса Google и сноски к нему. Три наблюдения из этой таблицы влияют на выбор.

Первое: вводная цена Argon совпадает с ценой Sonnet 5.5, а обычная — с ценой Opus 5.5. Когда закончится вводный период, Google не сообщает. Бюджет, рассчитанный под $2 и $10, после его окончания удвоится.

Второе: кэшированный ввод Argon продаётся со скидкой 95 % от цены ввода. При вводной цене это $0,10 за 1 млн токенов, вдвое меньше, чем чтение из кэша у обеих моделей Claude. Сохранится ли скидка при обычной цене, в анонсе не сказано.

Третье: чтение из кэша у Sonnet 5.5 и Opus 5.5 стоит одинаково, $0,20. Чем больше в запросе закэшированного контекста, тем меньше разница между ними. У Opus 5.5 есть ещё быстрый режим (fast mode, исследовательская версия, только Claude API) по $8 и $40; у Sonnet 5.5 его нет. За обработку только в США Anthropic берёт коэффициент 1,1; Bedrock и Google Cloud назначают цены самостоятельно.

### Пример А: один запрос без кэша

Условие: 100 000 входных и 20 000 выходных токенов. Формула: ввод в млн × цена ввода + вывод в млн × цена вывода.

| Модель | Расчёт | Итог |
| --- | --- | ---: |
| Sonnet 5.5 | 0,1 × 2 + 0,02 × 10 | $0,40 |
| Opus 5.5 | 0,1 × 4 + 0,02 × 20 | $0,80 |
| Argon, вводная цена | 0,1 × 2 + 0,02 × 10 | $0,40 |
| Argon, обычная цена | 0,1 × 4 + 0,02 × 20 | $0,80 |

### Пример Б: шаг агента с большим кэшем

Условие: 200 000 токенов прочитано из кэша, 20 000 новых входных токенов, 5 000 выходных.

| Модель | Расчёт | Итог |
| --- | --- | ---: |
| Sonnet 5.5 | 0,2 × 0,20 + 0,02 × 2 + 0,005 × 10 | $0,13 |
| Opus 5.5 | 0,2 × 0,20 + 0,02 × 4 + 0,005 × 20 | $0,22 |
| Argon, вводная цена | 0,2 × 0,10 + 0,02 × 2 + 0,005 × 10 | $0,11 |

![Расчёт шага агента с кэшем: Sonnet 5.5 — $0,13, Opus 5.5 — $0,22, Argon по вводной цене — $0,11, с разбивкой на чтение из кэша, новый ввод и вывод](https://www.aifreeapi.com/posts/ru/gemini-4-argon-vs-claude-opus-5-5-vs-sonnet-5-5/img/agent-step-cost.webp)

В примере Б Sonnet 5.5 дешевле Opus 5.5 на 41 %, а не на 50 %: (0,22 − 0,13) / 0,22 ≈ 0,41. Причина — одинаковая цена чтения из кэша.

Оба примера предполагают, что модели тратят одинаковое число токенов. В реальной работе это не так: число токенов зависит от токенизатора, уровня `effort` и объёма рассуждений (как они попадают в счёт — [Токены рассуждений в OpenAI, Claude и Gemini: оплата и контроль](/ru/posts/reasoning-token-billing)). Запись в кэш, инструменты и налоги в расчёты не входят, а строки Argon останутся условными, пока модель нельзя вызвать. Чтобы пересчитать под себя, подставьте собственные числа токенов из логов.

## Бенчмарки: кто измерял и что из этого следует

Единого независимого сравнения трёх моделей по многим тестам пока нет. Есть три набора чисел от трёх разных авторов, и смешивать их столбцы нельзя.

### Vals Index: единственная шкала, где есть все три

[Vals Index](https://www.vals.ai/benchmarks/vals_index) — сводный индекс независимого лидерборда Vals AI по задачам из финансов, программирования, права и налогов, взвешенным по вкладу в ВВП. Версия 2.1, обновление от 30 сентября 2026 года:

| Модель | Балл, % | Стоимость одного теста | Время |
| --- | ---: | ---: | ---: |
| Gemini 4 Argon | 68,90 | $15,68 | 46 мин 33 с |
| Claude Sonnet 5.5 | 67,04 | $21,34 | 1 ч 18 мин |
| Claude Opus 5.5 | 66,97 | $32,14 | 1 ч 19 мин |

Отсюда следуют две вещи. Sonnet 5.5 и Opus 5.5 разделяют 0,07 процентного пункта, и Vals считает их результат фактически равным, при этом тест на Sonnet 5.5 обходится примерно в две трети стоимости теста на Opus 5.5 (21,34 / 32,14 ≈ 0,66). Argon опережает обе модели Claude примерно на 1,9 пункта, а тест с ней стоит дешевле и проходит быстрее. По какой цене Vals считал Argon, на странице не указано; если по вводной, после её отмены стоимость теста вырастет.

Ограничение: это один индекс с собственным набором задач, и его строки меняются при перезапусках. Ссылаясь на эти числа, указывайте версию и дату.

### Таблица Google: Argon против Opus 5.5, без Sonnet 5.5

В [сравнительной таблице Google](https://deepmind.google/models/gemini/) Sonnet 5.5 отсутствует. В 14 из 18 строк с результатом Opus 5.5 впереди Argon, в четырёх — Opus 5.5.

| Тест, % | Argon | Opus 5.5 |
| --- | ---: | ---: |
| Vals Index | 68,9 | 67,0 |
| AutomationBench | 51,3 | 42,5 |
| Vals Finance Agent v2 | 65,4 | 58,6 |
| Harvey Legal Agent Benchmark | 19,6 | 3,8 |
| DeepSWE v1.1 | 77,9 | 74,2 |
| Vibe Code Bench | 91,9 | 90,3 |
| LABBench 2 | 88,8 | 73,1 |
| RiemannBench | 76,0 | 69,6 |
| GraphWalks, до 128 тыс. токенов | 99,7 | 90,6 |
| GraphWalks, от 256 тыс. до 1 млн | 84,2 | 66,8 |
| Agent's Last Exam | 39,5 | 38,2 |
| Chartography | 71,6 | 66,3 |
| LVBench | 91,7 | 83,7 |
| CWE-bench v1 | 68,0 | 67,0 |
| FrontierSWE v2 | 55,0 | **62,3** |
| Terminal-Bench 4.0 | 57,4 | **66,4** |
| PostTrainBench | 45,3 | **49,3** |
| Terminal-Bench Science 0.1 | 57,6 | **63,3** |

Читать таблицу стоит с оговорками из [методики Google](https://deepmind.google/models/evals-methodology/gemini-4-argon). Тесты отобраны самим вендором. Argon запускалась с максимальными настройками мышления, а числа конкурентов в основном взяты из их собственных отчётов или публичных лидербордов. Часть строк Google посчитала сама для всех моделей: PostTrainBench, LABBench 2, GraphWalks и LVBench. В LVBench условия были разными: Gemini получала видео с частотой один кадр в секунду, Opus 5.5 — 600 кадров, как сказано в методике, «из-за ограничений API».

Практический смысл таков. Opus 5.5 впереди в работе в терминале (обе строки Terminal-Bench), во FrontierSWE и в ML-инженерии (PostTrainBench). Самые крупные отрывы Argon — длинный контекст, юридические и финансовые агенты, научные задачи LABBench 2 и видео. В программировании картина смешанная: DeepSWE и Vibe Code Bench за Argon, FrontierSWE и Terminal-Bench за Opus 5.5.

### Числа Anthropic: Sonnet 5.5 против Opus 5.5

[Anthropic в анонсе Sonnet 5.5](https://www.anthropic.com/claude-sonnet-5-5) сравнивает две свои модели сама:

| Тест | Sonnet 5.5 | Opus 5.5 |
| --- | ---: | ---: |
| Terminal-Bench 4.0, % | **70,6** | 66,4 |
| FrontierCode 1.1, % | 46,2 при `max`, 52,1 при `xhigh` | 54,4 |
| CursorBench 4.0, % | 55,5 | 57,8 |
| GDPval-AA v2.1, баллы | 1844 | 1846 |
| AA-Briefcase v1.1, баллы | 1811 | 1822 |
| Humanity's Last Exam с инструментами, % | 64,5 | 67,7 |
| OSWorld 2.1, % | 80,1 | 81,8 |
| Chartography без инструментов, % | 61,6 | 64,4 |

Opus 5.5 впереди в семи строках из восьми, но разрыв чаще всего составляет несколько пунктов. Sonnet 5.5 выигрывает Terminal-Bench 4.0, где результат Opus 5.5 получен на `xhigh`, лучшем для него уровне. Расхожая формула «почти как Opus, но вдвое дешевле» этим числам соответствует, с поправкой самой Anthropic: на сложных задачах с открытой постановкой Opus 5.5, по её словам, «остаётся заметно сильнее».

Два уточнения. Заявления Anthropic о том, что Sonnet 5.5 генерирует ответ более чем на 30 % быстрее и обходится до 30 % дешевле на задачу, относятся к сравнению с Sonnet 5, а не с Opus 5.5 или Gemini. И результат Opus 5.5 в Chartography здесь 64,4 %, а в таблице Google — 66,3 %: это разные запуски, и каждое число остаётся при своём источнике. По той же причине нельзя ставить 70,6 % Sonnet 5.5 из таблицы Anthropic рядом с 57,4 % Argon из таблицы Google как прямое сравнение: совместного замера этих двух моделей ни один вендор не публиковал.

## Что выбрать сейчас: Sonnet 5.5 или Opus 5.5

Правило выбора из трёх шагов.

1. **Оцените постановку задачи.** Если задача чётко очерчена — написать функцию по описанию, разобрать выгрузку, сгенерировать текст, выполнить цепочку вызовов инструментов, — берите Sonnet 5.5. На Vals Index она идёт вровень с Opus 5.5, токен стоит вдвое меньше, а по оценке Anthropic она быстрее.
2. **Если агент работает часами или задача не имеет ясных границ, берите Opus 5.5.** [Руководство Anthropic по выбору модели](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) относит к ней многочасовых автономных агентов для программирования, масштабный рефакторинг, сложную системную инженерию, задачи с большим объёмом изображений и управление компьютером. Там же сказано, что большинство нагрузок стоит начинать с Opus 5.5.
3. **Прежде чем менять модель, попробуйте изменить `effort`.** Anthropic прямо пишет, что настройка этого параметра часто даёт больше, чем переход на другую модель. Как подобрать уровень, описано в материале [Claude Opus 5.5: какой уровень effort выбрать и как его задать](/ru/posts/claude-opus-5-5-effort).

![Три карточки выбора: Sonnet 5.5 для чётко очерченных задач, Opus 5.5 для долгих и открытых, Gemini 4 Argon — вернуться после открытия доступа](https://www.aifreeapi.com/posts/ru/gemini-4-argon-vs-claude-opus-5-5-vs-sonnet-5-5/img/model-choice.webp)

Если сомнения остаются, прогоните набор собственных типовых задач на обеих моделях и сравните не только качество, но и фактическое число токенов: уровни `effort` по умолчанию у моделей разные (`high` у Sonnet 5.5, `medium` у Opus 5.5), поэтому расход токенов на одну задачу может не совпасть.

При переходе с более старых моделей Claude учтите, что обе модели 5.5 отклоняют принудительный вызов инструмента (`tool_choice` со значением `any` или `tool`) с ошибкой 400 и не принимают `thinking: {"type": "disabled"}`. Полный список изменений — в статье [Claude Opus 5.5: сколько стоит API и что проверить при переходе с Opus 5](/ru/posts/claude-opus-5-5). Если вы выбираете не между двумя, а между всеми моделями Anthropic, пригодится [Opus 5.5 или Fable 5.1: какую модель Claude выбрать для API](/ru/posts/claude-sonnet-vs-opus-vs-haiku-vs-fable).

## Когда перепроверить выбор после открытия Argon

Откладывать проект до выхода Argon незачем: срока нет, а поведение её API не описано. Вернуться к вопросу стоит, если выполняется хотя бы одно условие:

- **Ответ не помещается в 128 тыс. токенов.** У Argon заявлен лимит вывода 1 млн токенов, у обеих моделей Claude — 128 тыс. в синхронном режиме.
- **Задача опирается на очень длинный контекст.** На GraphWalks от 256 тыс. до 1 млн токенов у Argon 84,2 % против 66,8 % у Opus 5.5 (замер Google). Размер окна контекста Argon при этом не опубликован.
- **Вы строите юридического или финансового агента, работаете с видео или научными задачами уровня LABBench 2.** В этих строках отрыв Argon наибольший.
- **Большая часть счёта — чтение из кэша.** При вводной цене оно вдвое дешевле, чем у Claude.

Менее вероятно, что Argon изменит выбор, если ваш агент в основном работает в терминале или занимается ML-инженерией: в этих тестах впереди Opus 5.5, а в Terminal-Bench 4.0 по данным Anthropic ещё выше Sonnet 5.5.

Когда модель появится в документации Gemini API, проверьте по порядку:

1. ID модели и окно контекста.
2. Лимиты запросов для вашего уровня аккаунта.
3. Дату окончания вводной цены и то, какой окажется цена кэша и Batch после неё.
4. Поведение при вызове инструментов и управлении мышлением: у Claude 5.5 именно здесь есть жёсткие ограничения, и код под них придётся сверить с правилами Gemini API.
5. Результат на ваших собственных задачах с подсчётом токенов, а не только цену за миллион.

## Частые вопросы

### Можно ли уже вызвать Gemini 4 Argon через API?

Нет. По состоянию на 1 октября 2026 года доступ есть только у команд киберзащиты из программы Fairwind. Google обещает открыть модель сначала платным клиентам API и подписчикам Google AI Ultra, но дату не называет.

### Что сильнее: Gemini 4 Argon или Claude Opus 5.5?

По таблице Google Argon впереди в 14 строках из 18, Opus 5.5 — в четырёх: FrontierSWE v2, обе строки Terminal-Bench и PostTrainBench. На независимом Vals Index у Argon 68,90 % против 66,97 %. Таблицу составил сам вендор, а воспроизвести эти результаты снаружи до открытия модели нельзя.

### Что дешевле: Argon, Sonnet 5.5 или Opus 5.5?

По цене токена Sonnet 5.5 и Argon на вводном тарифе стоят одинаково, $2 и $10, а Opus 5.5 и Argon на обычном тарифе — $4 и $20. Реальная стоимость задачи зависит от числа потраченных токенов: на Vals Index один тест обошёлся в $15,68 у Argon, $21,34 у Sonnet 5.5 и $32,14 у Opus 5.5.

### Есть ли прямое сравнение Argon и Sonnet 5.5?

От вендоров нет: Google сравнивает Argon с Opus 5.5, Anthropic — Sonnet 5.5 с Opus 5.5. Обе модели на одной шкале есть только в Vals Index: 68,90 % у Argon и 67,04 % у Sonnet 5.5.
