AIFreeAPI Logo

Модели Grok в 2026 году: сравнение 4.6, 4.5, 4.3 и 4.20

A
7 min readAI Model Comparison

Grok 4.6 — разумная отправная точка для сложных общих задач, но 4.3 остаётся сильным контрольным вариантом благодаря окну 1M, Batch и более низкой цене.

Карта выбора моделей Grok 4.6, 4.5, 4.3, 4.20 и Build 0.1 по типу API-задачи

На 26 августа 2026 года в официальном каталоге моделей SpaceXAI рекомендует grok-4.6 для программирования и универсальных задач. Однако в прямом API по-прежнему доступны grok-4.5, grok-4.3, три маршрута Grok 4.20 и специализированный grok-build-0.1. Это не лестница, где больший номер автоматически означает лучший выбор.

Для нового сложного приложения логично начать испытание с 4.6. Если важны окно в миллион токенов, Batch, режим без рассуждений или более низкие тарифы, в тот же тест стоит включить 4.3. Стабильную систему на 4.5 лучше сохранить как контроль до окончания сравнения. Multi-Agent и Build должны доказывать пользу на своих узких типах работы.

Здесь сравниваются контракты текстового вывода прямого xAI API. Выбор модели в приложении Grok, включённые лимиты Grok Build, доступность через Cursor и наценка стороннего шлюза — другие продукты. Наличие ID в API-документации ничего не обещает о тарифе, регионе или интерфейсе посредника.

Карта действующих маршрутов

Модель APIКонтекст и рассуждениеКогда проверять первойВажная граница
grok-4.6500K; low, medium, high, xhighСложные агенты, код, общие задачи с инструментамиПри 200K токенов в промпте весь запрос переходит на повышенный тариф
grok-4.5500K; low, medium, highКонтроль для уже работающей системыБольше не является основной рекомендацией каталога
grok-4.31M; none, low, medium, high; BatchБольшие документы, потоковые структурированные задачи, работа без reasoningНизкая цена запроса не гарантирует низкую цену принятого результата
grok-4.20-0309-reasoning1M; фиксированный reasoning-маршрутКогда требуется воспроизвести конкретное поведение 4.20Датированный ID не является новым универсальным default
grok-4.20-0309-non-reasoning1M; без рассужденийПроверяемые задачи, чувствительные к задержкеОшибка или повторный вызов меняют итоговую экономику
grok-4.20-multi-agent-03091M; параллельное исследование; BetaИсследования, которые действительно делятся на независимые частиБольше агентов означает другой путь выполнения и расход
grok-build-0.1256K; специализация на agentic codingИзменения репозитория, веб-разработка, восстановление сборкиНе является дешёвой универсальной заменой 4.6

Контракт Grok 4.6 указывает окно 500 000 токенов, ввод текста и изображений, текстовый вывод и срез знаний на 1 февраля 2026 года. Доступны Responses API, Chat Completions, function calling, Web Search, X Search и выполнение кода. По умолчанию используется high reasoning effort.

Актуальные сведения не появляются автоматически. После даты среза модель получает их только при явно включённом Web Search или X Search. Поэтому в тесте нужны не только ответы, но и качество выбора источников, цитаты, обработка отказа инструмента, задержка и отдельная стоимость вызовов.

Что даёт 4.6 — и чего не доказывает анонс

SpaceXAI описывает 4.6 как развитие 4.5 для более длинных агентных процессов, сложной интерактивной работы и программирования. В анонсе 4.6 опубликованы результаты, где версия 4.6 High превосходит 4.5 High в ряде оценок.

Это данные, опубликованные или собранные поставщиком. Они формируют проверяемую гипотезу — например, что 4.6 реже теряет цель после многих шагов, — но не выбирают модель для частной базы поддержки или конкретного репозитория. Сравнивайте кандидатов с одинаковыми правами, контекстом, reasoning effort, тайм-аутом и критериями приёмки. Записывайте долю результата, принятого с первой попытки, повторные вызовы, вмешательства, P95 времени, сбои инструментов и суммарные расходы.

С этой точки зрения 4.5 полезна не как «почти новая», а как чистая контрольная группа. Если убрать её до испытания 4.6, любое отличие превращается в впечатление, а быстрый откат становится сложнее.

4.3 экономит токены, но считать нужно принятую работу

Grok 4.3 предлагает окно 1M, Batch и режимы от none до high. Короткие тарифы за миллион входных, кэшированных входных и выходных токенов составляют $1,25 / $0,20 / $2,50. Для 4.6 это $2 / $0,50 / $6.

Запрос без кэша с 100K входных и 20K выходных токенов, без инструментов и повторов, стоит:

  • 4.3: 0,1 × $1,25 + 0,02 × $2,50 = $0,175;
  • 4.6: 0,1 × $2 + 0,02 × $6 = $0,32.

Это цена запроса, а не завершённой задачи. Если 4.3 требует двух попыток и ручного исправления, а 4.6 проходит с первого раза, преимущество исчезает. Практический показатель включает токены, инструменты, повторы и труд человека, поделённые на количество принятых результатов.

Есть и резкий порог. По действующей таблице цен, начиная с 200K токенов в промпте повышенные ставки применяются ко всему запросу, а не только к части сверх порога. Для 4.3 они становятся $2,50 / $0,40 / $5, для 4.6 — $4 / $1 / $12. Удаление дубликатов, retrieval, кэширование общего префикса и сжатие контекста могут дать больший эффект, чем формальная максимальная длина окна.

Web Search, X Search и выполнение кода тарифицируются отдельно: сейчас по $5 за 1000 вызовов сверх токенов модели. У агента число вызовов меняется от задачи к задаче, поэтому бюджет подтверждают реальные usage-логи.

Расчёт цены запроса, порог 200K и полная стоимость принятой задачи для Grok 4.3 и 4.6
Расчёт цены запроса, порог 200K и полная стоимость принятой задачи для Grok 4.3 и 4.6

Когда нужны 4.20 и Grok Build

У трёх ID 4.20 окно 1M и токенные ставки 4.3, но различается исполнение. Reasoning и non-reasoning фиксируют режим. grok-4.20-multi-agent-0309 запускает параллельных агентов для глубокого исследования и в официальном контракте помечен Beta. Его разумно проверять, когда работа делится на независимые вопросы, пропущенная точка зрения дорого стоит, а человек может проверить источники и синтез.

grok-build-0.1 — модель для agentic coding с окном 256K и короткими ставками $1 / $0,20 / $2. Её следует испытывать на изменениях кода, веб-разработке и восстановлении сборок. Включённое потребление в продукте Grok Build нельзя считать эквивалентом прямого API-биллинга.

Миграция: успешный старый ID ещё не означает старую модель

Руководство по выводу моделей из эксплуатации сообщает, что старые Grok 4 Fast, 4.1 Fast, grok-4-0709 и grok-3 перенаправляются на 4.3 с заданными настройками reasoning. grok-code-fast-1 ведёт на grok-build-0.1. Биллинг следует за фактической моделью назначения.

Найдите ID в коде, переменных окружения, конфигурационных сервисах, очередях и шлюзах. Зафиксируйте текущую точку назначения каждого alias. Прогоните один набор проверок: обычный запрос, контекст около 200K, сбой инструмента, структурированный вывод и safety refusal. Модель и reasoning effort должны переключаться обратимо. Расширяйте трафик только после небольшой когорты, если приёмка, задержка и стоимость остаются в границах.

Шесть шагов честного испытания моделей Grok с одинаковыми условиями, метриками и обратимым развёртыванием
Шесть шагов честного испытания моделей Grok с одинаковыми условиями, метриками и обратимым развёртыванием

Простое имя или суффикс -latest могут перейти на новую версию, тогда как датированный ID остаётся фиксированным. Для разработки движущийся alias удобен. Для критичной системы чаще полезнее закреплённая версия, запланированное обновление и известная точка отката.

Итоговый выбор условен: 4.6 — первый кандидат для сложной общей работы; 4.3 — более дешёвый контроль с окном 1M и режимом без рассуждений; 4.5 — временный контроль для честной оценки обновления; 4.20 Multi-Agent и Build 0.1 — отдельные эксперименты для специализированных задач.

Если решение выходит за пределы семейства Grok, используйте отдельное сравнение Grok 4.6, GPT-5.6 Sol и Claude Fable 5 для программирования. Версия определяет старт теста; одинаковые задания, явные критерии и обратимое развёртывание определяют итог.