На 26 августа 2026 года в официальном каталоге моделей SpaceXAI рекомендует grok-4.6 для программирования и универсальных задач. Однако в прямом API по-прежнему доступны grok-4.5, grok-4.3, три маршрута Grok 4.20 и специализированный grok-build-0.1. Это не лестница, где больший номер автоматически означает лучший выбор.
Для нового сложного приложения логично начать испытание с 4.6. Если важны окно в миллион токенов, Batch, режим без рассуждений или более низкие тарифы, в тот же тест стоит включить 4.3. Стабильную систему на 4.5 лучше сохранить как контроль до окончания сравнения. Multi-Agent и Build должны доказывать пользу на своих узких типах работы.
Здесь сравниваются контракты текстового вывода прямого xAI API. Выбор модели в приложении Grok, включённые лимиты Grok Build, доступность через Cursor и наценка стороннего шлюза — другие продукты. Наличие ID в API-документации ничего не обещает о тарифе, регионе или интерфейсе посредника.
Карта действующих маршрутов
| Модель API | Контекст и рассуждение | Когда проверять первой | Важная граница |
|---|---|---|---|
grok-4.6 | 500K; low, medium, high, xhigh | Сложные агенты, код, общие задачи с инструментами | При 200K токенов в промпте весь запрос переходит на повышенный тариф |
grok-4.5 | 500K; low, medium, high | Контроль для уже работающей системы | Больше не является основной рекомендацией каталога |
grok-4.3 | 1M; none, low, medium, high; Batch | Большие документы, потоковые структурированные задачи, работа без reasoning | Низкая цена запроса не гарантирует низкую цену принятого результата |
grok-4.20-0309-reasoning | 1M; фиксированный reasoning-маршрут | Когда требуется воспроизвести конкретное поведение 4.20 | Датированный ID не является новым универсальным default |
grok-4.20-0309-non-reasoning | 1M; без рассуждений | Проверяемые задачи, чувствительные к задержке | Ошибка или повторный вызов меняют итоговую экономику |
grok-4.20-multi-agent-0309 | 1M; параллельное исследование; Beta | Исследования, которые действительно делятся на независимые части | Больше агентов означает другой путь выполнения и расход |
grok-build-0.1 | 256K; специализация на agentic coding | Изменения репозитория, веб-разработка, восстановление сборки | Не является дешёвой универсальной заменой 4.6 |
Контракт Grok 4.6 указывает окно 500 000 токенов, ввод текста и изображений, текстовый вывод и срез знаний на 1 февраля 2026 года. Доступны Responses API, Chat Completions, function calling, Web Search, X Search и выполнение кода. По умолчанию используется high reasoning effort.
Актуальные сведения не появляются автоматически. После даты среза модель получает их только при явно включённом Web Search или X Search. Поэтому в тесте нужны не только ответы, но и качество выбора источников, цитаты, обработка отказа инструмента, задержка и отдельная стоимость вызовов.
Что даёт 4.6 — и чего не доказывает анонс
SpaceXAI описывает 4.6 как развитие 4.5 для более длинных агентных процессов, сложной интерактивной работы и программирования. В анонсе 4.6 опубликованы результаты, где версия 4.6 High превосходит 4.5 High в ряде оценок.
Это данные, опубликованные или собранные поставщиком. Они формируют проверяемую гипотезу — например, что 4.6 реже теряет цель после многих шагов, — но не выбирают модель для частной базы поддержки или конкретного репозитория. Сравнивайте кандидатов с одинаковыми правами, контекстом, reasoning effort, тайм-аутом и критериями приёмки. Записывайте долю результата, принятого с первой попытки, повторные вызовы, вмешательства, P95 времени, сбои инструментов и суммарные расходы.
С этой точки зрения 4.5 полезна не как «почти новая», а как чистая контрольная группа. Если убрать её до испытания 4.6, любое отличие превращается в впечатление, а быстрый откат становится сложнее.
4.3 экономит токены, но считать нужно принятую работу
Grok 4.3 предлагает окно 1M, Batch и режимы от none до high. Короткие тарифы за миллион входных, кэшированных входных и выходных токенов составляют $1,25 / $0,20 / $2,50. Для 4.6 это $2 / $0,50 / $6.
Запрос без кэша с 100K входных и 20K выходных токенов, без инструментов и повторов, стоит:
- 4.3:
0,1 × $1,25 + 0,02 × $2,50 = $0,175; - 4.6:
0,1 × $2 + 0,02 × $6 = $0,32.
Это цена запроса, а не завершённой задачи. Если 4.3 требует двух попыток и ручного исправления, а 4.6 проходит с первого раза, преимущество исчезает. Практический показатель включает токены, инструменты, повторы и труд человека, поделённые на количество принятых результатов.
Есть и резкий порог. По действующей таблице цен, начиная с 200K токенов в промпте повышенные ставки применяются ко всему запросу, а не только к части сверх порога. Для 4.3 они становятся $2,50 / $0,40 / $5, для 4.6 — $4 / $1 / $12. Удаление дубликатов, retrieval, кэширование общего префикса и сжатие контекста могут дать больший эффект, чем формальная максимальная длина окна.
Web Search, X Search и выполнение кода тарифицируются отдельно: сейчас по $5 за 1000 вызовов сверх токенов модели. У агента число вызовов меняется от задачи к задаче, поэтому бюджет подтверждают реальные usage-логи.

Когда нужны 4.20 и Grok Build
У трёх ID 4.20 окно 1M и токенные ставки 4.3, но различается исполнение. Reasoning и non-reasoning фиксируют режим. grok-4.20-multi-agent-0309 запускает параллельных агентов для глубокого исследования и в официальном контракте помечен Beta. Его разумно проверять, когда работа делится на независимые вопросы, пропущенная точка зрения дорого стоит, а человек может проверить источники и синтез.
grok-build-0.1 — модель для agentic coding с окном 256K и короткими ставками $1 / $0,20 / $2. Её следует испытывать на изменениях кода, веб-разработке и восстановлении сборок. Включённое потребление в продукте Grok Build нельзя считать эквивалентом прямого API-биллинга.
Миграция: успешный старый ID ещё не означает старую модель
Руководство по выводу моделей из эксплуатации сообщает, что старые Grok 4 Fast, 4.1 Fast, grok-4-0709 и grok-3 перенаправляются на 4.3 с заданными настройками reasoning. grok-code-fast-1 ведёт на grok-build-0.1. Биллинг следует за фактической моделью назначения.
Найдите ID в коде, переменных окружения, конфигурационных сервисах, очередях и шлюзах. Зафиксируйте текущую точку назначения каждого alias. Прогоните один набор проверок: обычный запрос, контекст около 200K, сбой инструмента, структурированный вывод и safety refusal. Модель и reasoning effort должны переключаться обратимо. Расширяйте трафик только после небольшой когорты, если приёмка, задержка и стоимость остаются в границах.

Простое имя или суффикс -latest могут перейти на новую версию, тогда как датированный ID остаётся фиксированным. Для разработки движущийся alias удобен. Для критичной системы чаще полезнее закреплённая версия, запланированное обновление и известная точка отката.
Итоговый выбор условен: 4.6 — первый кандидат для сложной общей работы; 4.3 — более дешёвый контроль с окном 1M и режимом без рассуждений; 4.5 — временный контроль для честной оценки обновления; 4.20 Multi-Agent и Build 0.1 — отдельные эксперименты для специализированных задач.
Если решение выходит за пределы семейства Grok, используйте отдельное сравнение Grok 4.6, GPT-5.6 Sol и Claude Fable 5 для программирования. Версия определяет старт теста; одинаковые задания, явные критерии и обратимое развёртывание определяют итог.



