Перейти к содержанию

OpenAI Ultrafast и Sol: в чём разница и что доступно в API

Ultrafast и Sol — режим и модель, а не два варианта. GPT-6.1 Sol сегодня работает в Standard и Fast; тот же запрос в Astra Ultrafast в 33 раза дороже.

A
••11 мин чтения•Сравнение AI-моделей
Два одинаковых блока на подставке: синий с подписью «GPT-6.1 Sol — модель» и розовый с подписью «Ultrafast — режим»

Ultrafast и Sol нельзя выбирать друг вместо друга: Ultrafast — это уровень обслуживания (service tier) в OpenAI API, то есть режим, в котором обрабатывается запрос, а Sol — семейство моделей. Вопрос на практике звучит иначе: какую модель можно запустить в режиме Ultrafast.

По состоянию на 3 октября 2026 года ответ такой. В Ultrafast всем пользователям API открыта одна модель — GPT-6 Astra, по $60 за 1 млн входных и $300 за 1 млн выходных токенов. GPT-6.1 Sol Ultrafast объявлен OpenAI 29 сентября, но в руководстве по Ultrafast и на вкладке Ultrafast в прайсе API его нет. Единственная модель Sol с каким-либо доступом к Ultrafast — GPT-5.6 Sol, и это предварительный доступ по запросу через менеджеров OpenAI, без опубликованной цены.

Сама GPT-6.1 Sol сегодня работает в режимах Standard и Fast. Запрос с 250 000 входных и 10 000 выходных токенов стоит на ней $0,22 в Standard и $0,44 в Fast; такой же запрос к GPT-6 Astra в Ultrafast — $7,20, почти в 33 раза дороже. Расчёт и условия разобраны ниже.

Ultrafast и Sol — в чём разница: режим обработки и модель

Разница в том, что эти слова отвечают на разные вопросы: модель определяет, кто отвечает на запрос, а уровень обслуживания — с какой скоростью и по какой ставке. OpenAI описывает Ultrafast как самый быстрый уровень обслуживания в API, который стоит использовать, когда скорость оправдывает более высокую цену.

UltrafastSol
Что этоуровень обслуживания запросасемейство моделей: GPT-6.1 Sol, GPT-6 Sol, GPT-5.6 Sol
Где задаётся в APIполе service_tierполе model
На что влияетскорость генерации выходных токенов и ставка за токенкачество ответа и базовая ставка
Соседние вариантыStandard, FastGPT-6 Astra (сильнее и дороже), GPT-6 Luna (дешевле)

Путаница возникла из-за названий. В августе OpenAI показала Ultrafast на примере GPT-5.6 Sol, а 29 сентября в анонсе GPT-6.1 Sol назвала рядом сразу два продукта: GPT-6 Astra Ultrafast и GPT-6.1 Sol Ultrafast. «GPT-6.1 Sol Ultrafast» — не отдельная модель, а GPT-6.1 Sol, запущенная в режиме Ultrafast.

Ultrafast также не то же самое, что Fast mode. Fast — отдельный уровень с ценой вдвое выше Standard (до 30 июля 2026 года он назывался Priority processing), Ultrafast для GPT-6 Astra — вшестеро выше Standard.

Какие модели Sol работают в Ultrafast на 3 октября 2026 года

Ни одна модель Sol не открыта в Ultrafast для всех. В документации OpenAI состояние такое:

МодельUltrafast в APIUltrafast в Codex и ChatGPT WorkЦена Ultrafast в прайсе
GPT-6 Astraда, всем пользователям API, с невысокими лимитамида, на Pro за $500 и подходящих планах Enterprise и Edu$60 / $6 / $300 за 1 млн токенов
GPT-6.1 Solобъявлен, в руководстве по Ultrafast не упоминаетсянет: поддерживаются Standard и Fastнет
GPT-6 Solв руководстве не упоминаетсянетнет
GPT-5.6 Solпредварительный доступ по запросу через менеджеров OpenAIне упоминаетсянет

Цена в таблице — входные, кешированные входные и выходные токены при запросе до 272 000 входных токенов.

Источники здесь расходятся, и это стоит учитывать. В русской версии анонса OpenAI пишет: «Одновременно мы запускаем GPT‑6 Astra Ultrafast — самую быструю передовую модель в мире, до 8 раз быстрее GPT‑6 Astra, — а также GPT‑6.1 Sol Ultrafast». VentureBeat в тот же день уточнил: Ultrafast сразу доступен для GPT-6 Astra, а версия для GPT-6.1 Sol ожидается «в ближайшие дни». Документация подтверждает вторую версию: руководство по Ultrafast называет только GPT-6 Astra и предварительный доступ для GPT-5.6 Sol, на вкладке Ultrafast в прайсе одна строка, а страница о скорости в Codex сообщает, что GPT-6.1 Sol поддерживает Standard и Fast.

Вывод из этого осторожный: GPT-6.1 Sol Ultrafast объявлен, но документированного способа его вызвать и опубликованной цены пока нет. Что вернёт API на запрос с gpt-6.1-sol и service_tier: "ultrafast", документация не описывает. Состояние может измениться за считаные дни, поэтому перед решением стоит открыть вкладку Ultrafast в прайсе: если там появилась строка gpt-6.1-sol, режим запущен и у него есть цена.

Про GPT-5.6 Sol: в августовском анонсе OpenAI говорила об ограниченной предварительной версии для отдельных клиентов. Сейчас в руководстве сказано, что организации, у которых есть команда сопровождения в OpenAI, могут запросить через неё этот доступ или более высокие лимиты. Самостоятельно включить его нельзя.

Как включить Ultrafast в API: service_tier и WebSocket

Чтобы запрос ушёл в Ultrafast, в Responses API нужно указать модель gpt-6-astra и service_tier со значением ultrafast. Отдельной модели или отдельного ключа не требуется. Пример из руководства OpenAI для HTTP:

bash
curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Explain why the sky is blue in one sentence.",
    "service_tier": "ultrafast"
  }'

Запрос платный: он тарифицируется по ставкам Ultrafast.

HTTP поддерживается, но OpenAI настойчиво рекомендует WebSocket, особенно для агентов, которые делают много вызовов инструментов подряд: без постоянного соединения сетевые задержки съедают часть выигрыша. В SDK соединение открывается через client.responses.connect(), а каждый запрос отправляется вызовом connection.response.create(...) с теми же model и service_tier. Следующий ход диалога передаёт идентификатор предыдущего ответа в previous_response_id, и одно соединение используется повторно для новых реплик и результатов инструментов.

Три условия, которые стоит проверить до того, как закладывать Ultrafast в архитектуру:

  • Лимиты. Для GPT-6 Astra в Ultrafast по умолчанию действует 500 000 токенов в минуту на уровнях использования API с 1-го по 3-й, 1 000 000 на 4-м и 5 000 000 на 5-м. Больше — только по запросу через менеджеров OpenAI.
  • Размещение данных. Ultrafast поддерживает только хранение данных в США и глобальную обработку. Региональные конечные точки ЕС и других регионов с ним не работают.
  • Фактический уровень. По описанию сервиса-шлюза OrcaRouter, ответ API возвращает поле service_tier с уровнем, который реально обслужил запрос. В документах OpenAI, перечисленных выше, это не описано, так что утверждение стоит проверить на собственном ответе.

Ultrafast в Codex и ChatGPT Work: нужен Pro за $500

В Codex и ChatGPT Work режим Ultrafast есть только на тарифе Pro за $500 в месяц и на подходящих планах Enterprise и Edu, и только для GPT-6 Astra. На остальных тарифах с самостоятельной оплатой его на старте нет, даже если докупить кредиты. Условия приведены на странице о скорости и в описании тарифов.

Режим в CodexРасход включённого в подписку лимитаКупленные кредиты и оплата по факту в Enterprise
Standard1×1×
Fast2,5×2×
Ultrafast (GPT-6 Astra)8×6×

Эти множители описывают расход, а не ускорение. На Pro за $500 Ultrafast сначала тратит включённый лимит, затем доступные кредиты. В рабочих пространствах Enterprise он по умолчанию выключен и недоступен там, где требуется обработка данных за пределами США.

GPT-6.1 Sol в Codex доступна на Plus, Pro, Business, Enterprise и Edu, но в режимах Standard и Fast. Fast включается командой /fast в CLI; чтобы сделать его режимом по умолчанию, в config.toml задают service_tier = "fast" и fast_mode = true в секции [features].

Если Codex работает с ключом API, а не через подписку, множители кредитов не применяются: расход считается по долларовым ставкам API из следующего раздела.

Сколько стоит запрос: от $0,22 на Sol до $7,20 в Astra Ultrafast

Один и тот же запрос стоит $0,22 на GPT-6.1 Sol в Standard и $7,20 на GPT-6 Astra в Ultrafast. Ставки из прайса OpenAI API по состоянию на 3 октября 2026 года, за 1 млн токенов, для запросов до 272 000 входных токенов:

Модель и режимВходныеКешированные входныеВыходныеЗапрос из примера
GPT-6.1 Sol, Standard$2$0,10$10$0,22
GPT-6.1 Sol, Fast$4$0,20$20$0,44
GPT-5.6 Sol, Standard$4$0,40$20$0,48
GPT-6 Astra, Standard$10$1$50$1,20
GPT-6 Astra, Fast$20$2$100$2,40
GPT-6 Astra, Ultrafast$60$6$300$7,20

Запрос из примера: 50 000 новых входных токенов, 200 000 входных токенов из кеша и 10 000 выходных. Формула одна для всех строк — доля миллиона, умноженная на ставку:

  • GPT-6.1 Sol, Standard: 0,05 × $2 + 0,2 × $0,10 + 0,01 × $10 = $0,22
  • GPT-6 Astra, Standard: 0,05 × $10 + 0,2 × $1 + 0,01 × $50 = $1,20
  • GPT-6 Astra, Ultrafast: 0,05 × $60 + 0,2 × $6 + 0,01 × $300 = $7,20

Отсюда соотношения: Astra Ultrafast дороже GPT-6.1 Sol в Standard в 32,7 раза ($7,20 ÷ $0,22) и дороже GPT-6.1 Sol в Fast в 16,4 раза ($7,20 ÷ $0,44).

Столбчатая диаграмма: один запрос стоит $0,22 на GPT-6.1 Sol Standard, $0,44 в Fast, $1,20 на GPT-6 Astra Standard, $2,40 в Fast и $7,20 в Ultrafast

У расчёта есть границы. Плата за запись в кеш в него не входит. Цена GPT-5.6 Sol — акционная, по примечанию в прайсе она действует как минимум до 21 ноября 2026 года. На региональных конечных точках ставки выше на 10 %. При запросе длиннее 272 000 входных токенов действуют другие ставки: GPT-6 Astra в Ultrafast — $120 / $12 / $450, GPT-6.1 Sol в Standard — $4 / $0,20 / $15.

Главное допущение — одинаковое число токенов на всех строках. На реальной задаче разные модели тратят разное количество токенов, поэтому таблица сравнивает цену одинакового запроса, а не стоимость выполненной задачи. Как это расхождение выглядит для Sol на замерах, показано в материале GPT-6.1 Sol или Claude Opus 5.5: сравнение цен и стоимости задачи.

Сколько будет стоить GPT-6.1 Sol Ultrafast: $12 и $60 — оценка

Официальной цены у GPT-6.1 Sol Ultrafast нет. Цифры $12 за 1 млн входных, $0,60 за кешированные и $60 за выходные токены, которые встречаются в новостях, — расчёт VentureBeat: стандартные ставки GPT-6.1 Sol, умноженные на шесть, при условии что множитель применяется ко всем категориям одинаково. Издание само помечает их как расчётные.

Оценка согласуется с тем, что сказала OpenAI: в анонсе стоимость GPT-6.1 Sol Ultrafast в API описана как примерно такая же, какую раньше разработчики платили за GPT-6 Astra. Стандартные ставки Astra — $10 и $50, шестикратные ставки Sol — $12 и $60.

Если множитель подтвердится, запрос из примера обойдётся в 6 × $0,22 = $1,32. Это близко к $1,20 за GPT-6 Astra в Standard и в 5,5 раза дешевле, чем $7,20 за Astra Ultrafast. До появления строки в прайсе это предположение, и строить на нём бюджет стоит с запасом.

Насколько Ultrafast быстрее: «до 8 раз» — про генерацию токенов

Все официальные цифры скорости — это максимумы для генерации выходных токенов, а не время выполнения задачи. Ниже собраны заявления OpenAI и их пересказ в прессе: это не результаты измерений.

Что заявленоЦифраКто заявил
GPT-6 Astra Ultrafast в Codex против Astra в Standardдо 8 раз быстрееOpenAI, страница о скорости в Codex
Ultrafast в APIдо 6 раз быстрее, до 300 токенов в секундуVentureBeat со ссылкой на материалы DevDay
GPT-5.6 Sol Ultrafast, предварительная версиядо 14 раз быстрее стандартной обработки, до 750 выходных токенов в секундуOpenAI, анонс от 13 августа 2026 года

OpenAI прямо оговаривает, что сравнение «до 8 раз» измеряет скорость генерации токенов, а не ставки и не общее время выполнения задачи. Скорость стандартного режима для GPT-6 Astra и GPT-6.1 Sol компания не публикует, как и скорость Fast mode в API.

Три этапа одного шага агента: сеть и вход — как прежде, генерация ответа — до 8 раз быстрее, инструменты — как прежде; пример: 10 000 выходных токенов за 33 с при 300 токенах в секунду

Чтобы представить порядок величин, можно взять потолок из пересказа VentureBeat. При 300 токенах в секунду 10 000 выходных токенов генерируются примерно 33 секунды (10 000 ÷ 300). Если «в 6 раз» соответствует 50 токенам в секунду в Standard — эта скорость выведена из множителя и нигде не опубликована, — тот же ответ займёт около 200 секунд. Запрос из примера при этом стоит в Ultrafast на $6 дороже, чем в Standard на той же GPT-6 Astra: $7,20 против $1,20.

За пределами множителя остаются сетевые обмены, обработка входных токенов и выполнение инструментов. Агент, который большую часть времени ждёт ответа базы данных или сборки, от Ultrafast ускорится заметно меньше, чем в 6 или 8 раз. Длинный ответ, который читает человек или озвучивает голосовой интерфейс, выиграет больше всего.

Что выбрать сейчас: Sol в Standard или Fast, Astra Ultrafast или подождать

Для большинства задач сегодня разумно оставаться на GPT-6.1 Sol в Standard, а Ultrafast подключать там, где ожидание ответа стоит дороже токенов. По ситуациям:

  • Фоновые и пакетные задачи, разбор документов, рутинные правки кода. GPT-6.1 Sol в Standard: $0,22 за запрос из примера. Скорость здесь мало что меняет.
  • Нужно быстрее, но достаточно качества Sol. Fast mode: цена ровно вдвое выше Standard. Насколько он ускоряет модели GPT-6 в API, OpenAI не публикует, поэтому выигрыш придётся измерить на своих запросах.
  • Ответа ждёт человек или голосовой интерфейс, выходных токенов много, качество Astra нужно. GPT-6 Astra Ultrafast доступен сразу. Среди сценариев для Ultrafast OpenAI называла реагирование на инциденты, финансовые исследования, клиентскую поддержку и голос, торговлю, исследования в реальном времени. Цена — в шесть раз выше Standard той же модели и почти в 33 раза выше GPT-6.1 Sol в Standard на одинаковом запросе.
  • Нужен именно Sol в Ultrafast. Подождать строки gpt-6.1-sol на вкладке Ultrafast в прайсе. Пока её нет, модель и уровень обслуживания лучше вынести в конфигурацию, чтобы переключение свелось к двум параметрам, а в бюджете ориентироваться на шестикратную ставку как на предположение.
  • У организации есть команда сопровождения в OpenAI. Можно запросить предварительный доступ к GPT-5.6 Sol в Ultrafast — режиму с самой высокой заявленной скоростью, до 750 выходных токенов в секунду. Цена обсуждается с OpenAI: в прайсе её нет.
  • Данные должны обрабатываться в ЕС или другом регионе вне США. Ultrafast не подходит: остаются Standard и Fast.

Простой способ проверить, оправданна ли переплата за Astra Ultrafast: посчитать по формуле выше разницу в цене своего типичного запроса и сравнить её со стоимостью времени, которое этот запрос экономит. Опубликованной скорости Standard для этого нет, поэтому сэкономленное время стоит получить замером: один и тот же запрос в Standard и в Ultrafast с фиксацией времени до последнего токена.

Короткие ответы про Ultrafast, Fast mode и тариф Pro

Работает ли уже GPT-6.1 Sol Ultrafast?

По состоянию на 3 октября 2026 года в документации OpenAI такого режима нет: GPT-6.1 Sol отсутствует в руководстве по Ultrafast и на вкладке Ultrafast в прайсе API, а в Codex для неё указаны только Standard и Fast. В анонсе от 29 сентября режим назван, и, по данным VentureBeat, его ждут в ближайшие дни.

Чем Ultrafast отличается от Fast mode?

Это два разных уровня обслуживания. Fast стоит вдвое дороже Standard и доступен для GPT-6.1 Sol и GPT-6 Astra. Ultrafast стоит вшестеро дороже Standard и в прайсе есть только для GPT-6 Astra. В Codex Fast расходует включённый лимит в 2,5 раза быстрее, Ultrafast — в 8 раз.

Что даёт тариф Pro за $500 в отношении Ultrafast?

Pro за $500 в месяц — единственный тариф с самостоятельной оплатой, на котором в Codex и ChatGPT Work доступен GPT-6 Astra Ultrafast. Для вызовов через API подписка не нужна: там Ultrafast оплачивается по токенам и открыт всем пользователям API.

Есть ли модель дешевле Sol и когда её достаточно?

Да, GPT-6 Luna: по прайсу она в 20 раз дешевле GPT-6 Sol. Ставки обеих моделей и условия, при которых Sol окупается, разобраны отдельно: GPT-6 Luna или Sol: сколько стоят и когда Sol окупается. Тот материал написан до выхода GPT-6.1 Sol.