Перейти к содержанию

Gemini 4 Argon, Opus 5.5 или Sonnet 5.5: что выбрать для API

Argon лидирует в Vals Index, но вызвать её пока нельзя. Sonnet 5.5 и Opus 5.5 там идут вровень, хотя токен Opus 5.5 стоит вдвое дороже.

A
••11 мин чтения•Сравнение AI-моделей
Три столбика на платформе: Argon и Sonnet 5.5 по $2 за ввод, Opus 5.5 вдвое выше — $4 за 1 млн токенов

По состоянию на 1 октября 2026 года из трёх моделей по API можно вызвать только две: Claude Sonnet 5.5 и Claude Opus 5.5. Gemini 4 Argon, которую Google анонсировала 30 сентября, выдаётся лишь командам киберзащиты, допущенным к программе Fairwind; ни ID модели, ни даты открытия для разработчиков в анонсе Google нет. Поэтому практический выбор сегодня выглядит так:

  • Sonnet 5.5 — для чётко поставленных повседневных задач: генерация кода, анализ данных, агенты с инструментами. Цена $2 за 1 млн входных токенов и $10 за 1 млн выходных.
  • Opus 5.5 — для многочасовых автономных агентов, крупного рефакторинга и сложной системной инженерии. Цена ровно вдвое выше: $4 и $20.
  • Argon — стоит заложить в план повторную проверку, если ваши задачи связаны с длинным контекстом, видео, юридическими или финансовыми агентами. В этих строках таблицы Google отрыв от Opus 5.5 наибольший, но проверить его самостоятельно пока невозможно.

Все цены ниже — официальные, в долларах США за 1 млн токенов, без налогов. Все бенчмарки опубликованы вендорами или лидербордами; у каждого числа указано, кто его получил.

Какие из трёх моделей доступны сегодня

Gemini 4 ArgonClaude Sonnet 5.5Claude Opus 5.5
Вышлаанонс 30 сентября 2026 года28 сентября 2026 года22 сентября 2026 года
Кто может вызватьучастники программы Fairwindвсе клиенты Claude APIвсе клиенты Claude API
ID моделине опубликованclaude-sonnet-5-5claude-opus-5-5
Окно контекстане указано1 млн токенов1 млн токенов
Максимум вывода1 млн токенов128 тыс. токенов128 тыс. токенов
Скорость по оценке вендоране указанаFastModerate

Google обещает открыть Argon разработчикам, компаниям и обычным пользователям «как можно скорее», начиная с платных клиентов API и подписчиков Google AI Ultra. Срока нет. На страницах моделей и цен Gemini API модель Argon не значится. Название «Gemini 4 Pro», которое ходило до анонса, официальным не является: модель называется Gemini 4 Argon.

Если нужна именно модель Google и именно сейчас, самая новая из доступных — gemini-3.8-flash. Это модель другого класса и другой цены: $0,75 за ввод и $3,75 за вывод до 31 декабря 2026 года, затем $1,50 и $7,50; есть бесплатный уровень. Подробности — в разборе Gemini 3.8 Flash API: ID модели, цены, лимиты и миграция.

Обе модели Claude, по обзору моделей Anthropic, работают в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Обе принимают текст и изображения, отдают текст, надёжная граница знаний — июнь 2026 года. Различаются они настройками по умолчанию. Параметр effort задаёт, сколько усилий модель тратит на рассуждения: у Opus 5.5 по умолчанию стоит medium, у Sonnet 5.5 — high. В Opus 5.5 адаптивное мышление включено всегда; в Sonnet 5.5 рассуждение перед ответом можно убрать настройкой thinking: {"type": "between_tools"}, но только на уровнях low, medium и high.

Сколько стоят токены: Argon как Sonnet 5.5, затем как Opus 5.5

Категория, за 1 млн токеновArgon, вводная ценаArgon, обычная ценаSonnet 5.5Opus 5.5
Ввод$2$4$2$4
Вывод$10$20$10$20
Чтение из кэша$0,10не указана$0,20$0,20
Запись в кэш на 5 минутне указанане указана$2,50$5
Запись в кэш на 1 часне указанане указана$4$8
Batch, ввод и выводне указанане указана$1 и $5$2 и $10

Цены Claude взяты из тарифной таблицы Anthropic, цены Argon — из анонса Google и сноски к нему. Три наблюдения из этой таблицы влияют на выбор.

Первое: вводная цена Argon совпадает с ценой Sonnet 5.5, а обычная — с ценой Opus 5.5. Когда закончится вводный период, Google не сообщает. Бюджет, рассчитанный под $2 и $10, после его окончания удвоится.

Второе: кэшированный ввод Argon продаётся со скидкой 95 % от цены ввода. При вводной цене это $0,10 за 1 млн токенов, вдвое меньше, чем чтение из кэша у обеих моделей Claude. Сохранится ли скидка при обычной цене, в анонсе не сказано.

Третье: чтение из кэша у Sonnet 5.5 и Opus 5.5 стоит одинаково, $0,20. Чем больше в запросе закэшированного контекста, тем меньше разница между ними. У Opus 5.5 есть ещё быстрый режим (fast mode, исследовательская версия, только Claude API) по $8 и $40; у Sonnet 5.5 его нет. За обработку только в США Anthropic берёт коэффициент 1,1; Bedrock и Google Cloud назначают цены самостоятельно.

Пример А: один запрос без кэша

Условие: 100 000 входных и 20 000 выходных токенов. Формула: ввод в млн × цена ввода + вывод в млн × цена вывода.

МодельРасчётИтог
Sonnet 5.50,1 × 2 + 0,02 × 10$0,40
Opus 5.50,1 × 4 + 0,02 × 20$0,80
Argon, вводная цена0,1 × 2 + 0,02 × 10$0,40
Argon, обычная цена0,1 × 4 + 0,02 × 20$0,80

Пример Б: шаг агента с большим кэшем

Условие: 200 000 токенов прочитано из кэша, 20 000 новых входных токенов, 5 000 выходных.

МодельРасчётИтог
Sonnet 5.50,2 × 0,20 + 0,02 × 2 + 0,005 × 10$0,13
Opus 5.50,2 × 0,20 + 0,02 × 4 + 0,005 × 20$0,22
Argon, вводная цена0,2 × 0,10 + 0,02 × 2 + 0,005 × 10$0,11
Расчёт шага агента с кэшем: Sonnet 5.5 — $0,13, Opus 5.5 — $0,22, Argon по вводной цене — $0,11, с разбивкой на чтение из кэша, новый ввод и вывод

В примере Б Sonnet 5.5 дешевле Opus 5.5 на 41 %, а не на 50 %: (0,22 − 0,13) / 0,22 ≈ 0,41. Причина — одинаковая цена чтения из кэша.

Оба примера предполагают, что модели тратят одинаковое число токенов. В реальной работе это не так: число токенов зависит от токенизатора, уровня effort и объёма рассуждений (как они попадают в счёт — Токены рассуждений в OpenAI, Claude и Gemini: оплата и контроль). Запись в кэш, инструменты и налоги в расчёты не входят, а строки Argon останутся условными, пока модель нельзя вызвать. Чтобы пересчитать под себя, подставьте собственные числа токенов из логов.

Бенчмарки: кто измерял и что из этого следует

Единого независимого сравнения трёх моделей по многим тестам пока нет. Есть три набора чисел от трёх разных авторов, и смешивать их столбцы нельзя.

Vals Index: единственная шкала, где есть все три

Vals Index — сводный индекс независимого лидерборда Vals AI по задачам из финансов, программирования, права и налогов, взвешенным по вкладу в ВВП. Версия 2.1, обновление от 30 сентября 2026 года:

МодельБалл, %Стоимость одного тестаВремя
Gemini 4 Argon68,90$15,6846 мин 33 с
Claude Sonnet 5.567,04$21,341 ч 18 мин
Claude Opus 5.566,97$32,141 ч 19 мин

Отсюда следуют две вещи. Sonnet 5.5 и Opus 5.5 разделяют 0,07 процентного пункта, и Vals считает их результат фактически равным, при этом тест на Sonnet 5.5 обходится примерно в две трети стоимости теста на Opus 5.5 (21,34 / 32,14 ≈ 0,66). Argon опережает обе модели Claude примерно на 1,9 пункта, а тест с ней стоит дешевле и проходит быстрее. По какой цене Vals считал Argon, на странице не указано; если по вводной, после её отмены стоимость теста вырастет.

Ограничение: это один индекс с собственным набором задач, и его строки меняются при перезапусках. Ссылаясь на эти числа, указывайте версию и дату.

Таблица Google: Argon против Opus 5.5, без Sonnet 5.5

В сравнительной таблице Google Sonnet 5.5 отсутствует. В 14 из 18 строк с результатом Opus 5.5 впереди Argon, в четырёх — Opus 5.5.

Тест, %ArgonOpus 5.5
Vals Index68,967,0
AutomationBench51,342,5
Vals Finance Agent v265,458,6
Harvey Legal Agent Benchmark19,63,8
DeepSWE v1.177,974,2
Vibe Code Bench91,990,3
LABBench 288,873,1
RiemannBench76,069,6
GraphWalks, до 128 тыс. токенов99,790,6
GraphWalks, от 256 тыс. до 1 млн84,266,8
Agent's Last Exam39,538,2
Chartography71,666,3
LVBench91,783,7
CWE-bench v168,067,0
FrontierSWE v255,062,3
Terminal-Bench 4.057,466,4
PostTrainBench45,349,3
Terminal-Bench Science 0.157,663,3

Читать таблицу стоит с оговорками из методики Google. Тесты отобраны самим вендором. Argon запускалась с максимальными настройками мышления, а числа конкурентов в основном взяты из их собственных отчётов или публичных лидербордов. Часть строк Google посчитала сама для всех моделей: PostTrainBench, LABBench 2, GraphWalks и LVBench. В LVBench условия были разными: Gemini получала видео с частотой один кадр в секунду, Opus 5.5 — 600 кадров, как сказано в методике, «из-за ограничений API».

Практический смысл таков. Opus 5.5 впереди в работе в терминале (обе строки Terminal-Bench), во FrontierSWE и в ML-инженерии (PostTrainBench). Самые крупные отрывы Argon — длинный контекст, юридические и финансовые агенты, научные задачи LABBench 2 и видео. В программировании картина смешанная: DeepSWE и Vibe Code Bench за Argon, FrontierSWE и Terminal-Bench за Opus 5.5.

Числа Anthropic: Sonnet 5.5 против Opus 5.5

Anthropic в анонсе Sonnet 5.5 сравнивает две свои модели сама:

ТестSonnet 5.5Opus 5.5
Terminal-Bench 4.0, %70,666,4
FrontierCode 1.1, %46,2 при max, 52,1 при xhigh54,4
CursorBench 4.0, %55,557,8
GDPval-AA v2.1, баллы18441846
AA-Briefcase v1.1, баллы18111822
Humanity's Last Exam с инструментами, %64,567,7
OSWorld 2.1, %80,181,8
Chartography без инструментов, %61,664,4

Opus 5.5 впереди в семи строках из восьми, но разрыв чаще всего составляет несколько пунктов. Sonnet 5.5 выигрывает Terminal-Bench 4.0, где результат Opus 5.5 получен на xhigh, лучшем для него уровне. Расхожая формула «почти как Opus, но вдвое дешевле» этим числам соответствует, с поправкой самой Anthropic: на сложных задачах с открытой постановкой Opus 5.5, по её словам, «остаётся заметно сильнее».

Два уточнения. Заявления Anthropic о том, что Sonnet 5.5 генерирует ответ более чем на 30 % быстрее и обходится до 30 % дешевле на задачу, относятся к сравнению с Sonnet 5, а не с Opus 5.5 или Gemini. И результат Opus 5.5 в Chartography здесь 64,4 %, а в таблице Google — 66,3 %: это разные запуски, и каждое число остаётся при своём источнике. По той же причине нельзя ставить 70,6 % Sonnet 5.5 из таблицы Anthropic рядом с 57,4 % Argon из таблицы Google как прямое сравнение: совместного замера этих двух моделей ни один вендор не публиковал.

Что выбрать сейчас: Sonnet 5.5 или Opus 5.5

Правило выбора из трёх шагов.

  1. Оцените постановку задачи. Если задача чётко очерчена — написать функцию по описанию, разобрать выгрузку, сгенерировать текст, выполнить цепочку вызовов инструментов, — берите Sonnet 5.5. На Vals Index она идёт вровень с Opus 5.5, токен стоит вдвое меньше, а по оценке Anthropic она быстрее.
  2. Если агент работает часами или задача не имеет ясных границ, берите Opus 5.5. Руководство Anthropic по выбору модели относит к ней многочасовых автономных агентов для программирования, масштабный рефакторинг, сложную системную инженерию, задачи с большим объёмом изображений и управление компьютером. Там же сказано, что большинство нагрузок стоит начинать с Opus 5.5.
  3. Прежде чем менять модель, попробуйте изменить effort. Anthropic прямо пишет, что настройка этого параметра часто даёт больше, чем переход на другую модель. Как подобрать уровень, описано в материале Claude Opus 5.5: какой уровень effort выбрать и как его задать.
Три карточки выбора: Sonnet 5.5 для чётко очерченных задач, Opus 5.5 для долгих и открытых, Gemini 4 Argon — вернуться после открытия доступа

Если сомнения остаются, прогоните набор собственных типовых задач на обеих моделях и сравните не только качество, но и фактическое число токенов: уровни effort по умолчанию у моделей разные (high у Sonnet 5.5, medium у Opus 5.5), поэтому расход токенов на одну задачу может не совпасть.

При переходе с более старых моделей Claude учтите, что обе модели 5.5 отклоняют принудительный вызов инструмента (tool_choice со значением any или tool) с ошибкой 400 и не принимают thinking: {"type": "disabled"}. Полный список изменений — в статье Claude Opus 5.5: сколько стоит API и что проверить при переходе с Opus 5. Если вы выбираете не между двумя, а между всеми моделями Anthropic, пригодится Opus 5.5 или Fable 5.1: какую модель Claude выбрать для API.

Когда перепроверить выбор после открытия Argon

Откладывать проект до выхода Argon незачем: срока нет, а поведение её API не описано. Вернуться к вопросу стоит, если выполняется хотя бы одно условие:

  • Ответ не помещается в 128 тыс. токенов. У Argon заявлен лимит вывода 1 млн токенов, у обеих моделей Claude — 128 тыс. в синхронном режиме.
  • Задача опирается на очень длинный контекст. На GraphWalks от 256 тыс. до 1 млн токенов у Argon 84,2 % против 66,8 % у Opus 5.5 (замер Google). Размер окна контекста Argon при этом не опубликован.
  • Вы строите юридического или финансового агента, работаете с видео или научными задачами уровня LABBench 2. В этих строках отрыв Argon наибольший.
  • Большая часть счёта — чтение из кэша. При вводной цене оно вдвое дешевле, чем у Claude.

Менее вероятно, что Argon изменит выбор, если ваш агент в основном работает в терминале или занимается ML-инженерией: в этих тестах впереди Opus 5.5, а в Terminal-Bench 4.0 по данным Anthropic ещё выше Sonnet 5.5.

Когда модель появится в документации Gemini API, проверьте по порядку:

  1. ID модели и окно контекста.
  2. Лимиты запросов для вашего уровня аккаунта.
  3. Дату окончания вводной цены и то, какой окажется цена кэша и Batch после неё.
  4. Поведение при вызове инструментов и управлении мышлением: у Claude 5.5 именно здесь есть жёсткие ограничения, и код под них придётся сверить с правилами Gemini API.
  5. Результат на ваших собственных задачах с подсчётом токенов, а не только цену за миллион.

Частые вопросы

Можно ли уже вызвать Gemini 4 Argon через API?

Нет. По состоянию на 1 октября 2026 года доступ есть только у команд киберзащиты из программы Fairwind. Google обещает открыть модель сначала платным клиентам API и подписчикам Google AI Ultra, но дату не называет.

Что сильнее: Gemini 4 Argon или Claude Opus 5.5?

По таблице Google Argon впереди в 14 строках из 18, Opus 5.5 — в четырёх: FrontierSWE v2, обе строки Terminal-Bench и PostTrainBench. На независимом Vals Index у Argon 68,90 % против 66,97 %. Таблицу составил сам вендор, а воспроизвести эти результаты снаружи до открытия модели нельзя.

Что дешевле: Argon, Sonnet 5.5 или Opus 5.5?

По цене токена Sonnet 5.5 и Argon на вводном тарифе стоят одинаково, $2 и $10, а Opus 5.5 и Argon на обычном тарифе — $4 и $20. Реальная стоимость задачи зависит от числа потраченных токенов: на Vals Index один тест обошёлся в $15,68 у Argon, $21,34 у Sonnet 5.5 и $32,14 у Opus 5.5.

Есть ли прямое сравнение Argon и Sonnet 5.5?

От вендоров нет: Google сравнивает Argon с Opus 5.5, Anthropic — Sonnet 5.5 с Opus 5.5. Обе модели на одной шкале есть только в Vals Index: 68,90 % у Argon и 67,04 % у Sonnet 5.5.