Ultrafast и Sol нельзя выбирать друг вместо друга: Ultrafast — это уровень обслуживания (service tier) в OpenAI API, то есть режим, в котором обрабатывается запрос, а Sol — семейство моделей. Вопрос на практике звучит иначе: какую модель можно запустить в режиме Ultrafast.
По состоянию на 3 октября 2026 года ответ такой. В Ultrafast всем пользователям API открыта одна модель — GPT-6 Astra, по $60 за 1 млн входных и $300 за 1 млн выходных токенов. GPT-6.1 Sol Ultrafast объявлен OpenAI 29 сентября, но в руководстве по Ultrafast и на вкладке Ultrafast в прайсе API его нет. Единственная модель Sol с каким-либо доступом к Ultrafast — GPT-5.6 Sol, и это предварительный доступ по запросу через менеджеров OpenAI, без опубликованной цены.
Сама GPT-6.1 Sol сегодня работает в режимах Standard и Fast. Запрос с 250 000 входных и 10 000 выходных токенов стоит на ней $0,22 в Standard и $0,44 в Fast; такой же запрос к GPT-6 Astra в Ultrafast — $7,20, почти в 33 раза дороже. Расчёт и условия разобраны ниже.
Ultrafast и Sol — в чём разница: режим обработки и модель
Разница в том, что эти слова отвечают на разные вопросы: модель определяет, кто отвечает на запрос, а уровень обслуживания — с какой скоростью и по какой ставке. OpenAI описывает Ultrafast как самый быстрый уровень обслуживания в API, который стоит использовать, когда скорость оправдывает более высокую цену.
| Ultrafast | Sol | |
|---|---|---|
| Что это | уровень обслуживания запроса | семейство моделей: GPT-6.1 Sol, GPT-6 Sol, GPT-5.6 Sol |
| Где задаётся в API | поле service_tier | поле model |
| На что влияет | скорость генерации выходных токенов и ставка за токен | качество ответа и базовая ставка |
| Соседние варианты | Standard, Fast | GPT-6 Astra (сильнее и дороже), GPT-6 Luna (дешевле) |
Путаница возникла из-за названий. В августе OpenAI показала Ultrafast на примере GPT-5.6 Sol, а 29 сентября в анонсе GPT-6.1 Sol назвала рядом сразу два продукта: GPT-6 Astra Ultrafast и GPT-6.1 Sol Ultrafast. «GPT-6.1 Sol Ultrafast» — не отдельная модель, а GPT-6.1 Sol, запущенная в режиме Ultrafast.
Ultrafast также не то же самое, что Fast mode. Fast — отдельный уровень с ценой вдвое выше Standard (до 30 июля 2026 года он назывался Priority processing), Ultrafast для GPT-6 Astra — вшестеро выше Standard.
Какие модели Sol работают в Ultrafast на 3 октября 2026 года
Ни одна модель Sol не открыта в Ultrafast для всех. В документации OpenAI состояние такое:
| Модель | Ultrafast в API | Ultrafast в Codex и ChatGPT Work | Цена Ultrafast в прайсе |
|---|---|---|---|
| GPT-6 Astra | да, всем пользователям API, с невысокими лимитами | да, на Pro за $500 и подходящих планах Enterprise и Edu | $60 / $6 / $300 за 1 млн токенов |
| GPT-6.1 Sol | объявлен, в руководстве по Ultrafast не упоминается | нет: поддерживаются Standard и Fast | нет |
| GPT-6 Sol | в руководстве не упоминается | нет | нет |
| GPT-5.6 Sol | предварительный доступ по запросу через менеджеров OpenAI | не упоминается | нет |
Цена в таблице — входные, кешированные входные и выходные токены при запросе до 272 000 входных токенов.
Источники здесь расходятся, и это стоит учитывать. В русской версии анонса OpenAI пишет: «Одновременно мы запускаем GPT‑6 Astra Ultrafast — самую быструю передовую модель в мире, до 8 раз быстрее GPT‑6 Astra, — а также GPT‑6.1 Sol Ultrafast». VentureBeat в тот же день уточнил: Ultrafast сразу доступен для GPT-6 Astra, а версия для GPT-6.1 Sol ожидается «в ближайшие дни». Документация подтверждает вторую версию: руководство по Ultrafast называет только GPT-6 Astra и предварительный доступ для GPT-5.6 Sol, на вкладке Ultrafast в прайсе одна строка, а страница о скорости в Codex сообщает, что GPT-6.1 Sol поддерживает Standard и Fast.
Вывод из этого осторожный: GPT-6.1 Sol Ultrafast объявлен, но документированного способа его вызвать и опубликованной цены пока нет. Что вернёт API на запрос с gpt-6.1-sol и service_tier: "ultrafast", документация не описывает. Состояние может измениться за считаные дни, поэтому перед решением стоит открыть вкладку Ultrafast в прайсе: если там появилась строка gpt-6.1-sol, режим запущен и у него есть цена.
Про GPT-5.6 Sol: в августовском анонсе OpenAI говорила об ограниченной предварительной версии для отдельных клиентов. Сейчас в руководстве сказано, что организации, у которых есть команда сопровождения в OpenAI, могут запросить через неё этот доступ или более высокие лимиты. Самостоятельно включить его нельзя.
Как включить Ultrafast в API: service_tier и WebSocket
Чтобы запрос ушёл в Ultrafast, в Responses API нужно указать модель gpt-6-astra и service_tier со значением ultrafast. Отдельной модели или отдельного ключа не требуется. Пример из руководства OpenAI для HTTP:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Explain why the sky is blue in one sentence.",
"service_tier": "ultrafast"
}'Запрос платный: он тарифицируется по ставкам Ultrafast.
HTTP поддерживается, но OpenAI настойчиво рекомендует WebSocket, особенно для агентов, которые делают много вызовов инструментов подряд: без постоянного соединения сетевые задержки съедают часть выигрыша. В SDK соединение открывается через client.responses.connect(), а каждый запрос отправляется вызовом connection.response.create(...) с теми же model и service_tier. Следующий ход диалога передаёт идентификатор предыдущего ответа в previous_response_id, и одно соединение используется повторно для новых реплик и результатов инструментов.
Три условия, которые стоит проверить до того, как закладывать Ultrafast в архитектуру:
- Лимиты. Для GPT-6 Astra в Ultrafast по умолчанию действует 500 000 токенов в минуту на уровнях использования API с 1-го по 3-й, 1 000 000 на 4-м и 5 000 000 на 5-м. Больше — только по запросу через менеджеров OpenAI.
- Размещение данных. Ultrafast поддерживает только хранение данных в США и глобальную обработку. Региональные конечные точки ЕС и других регионов с ним не работают.
- Фактический уровень. По описанию сервиса-шлюза OrcaRouter, ответ API возвращает поле
service_tierс уровнем, который реально обслужил запрос. В документах OpenAI, перечисленных выше, это не описано, так что утверждение стоит проверить на собственном ответе.
Ultrafast в Codex и ChatGPT Work: нужен Pro за $500
В Codex и ChatGPT Work режим Ultrafast есть только на тарифе Pro за $500 в месяц и на подходящих планах Enterprise и Edu, и только для GPT-6 Astra. На остальных тарифах с самостоятельной оплатой его на старте нет, даже если докупить кредиты. Условия приведены на странице о скорости и в описании тарифов.
| Режим в Codex | Расход включённого в подписку лимита | Купленные кредиты и оплата по факту в Enterprise |
|---|---|---|
| Standard | 1× | 1× |
| Fast | 2,5× | 2× |
| Ultrafast (GPT-6 Astra) | 8× | 6× |
Эти множители описывают расход, а не ускорение. На Pro за $500 Ultrafast сначала тратит включённый лимит, затем доступные кредиты. В рабочих пространствах Enterprise он по умолчанию выключен и недоступен там, где требуется обработка данных за пределами США.
GPT-6.1 Sol в Codex доступна на Plus, Pro, Business, Enterprise и Edu, но в режимах Standard и Fast. Fast включается командой /fast в CLI; чтобы сделать его режимом по умолчанию, в config.toml задают service_tier = "fast" и fast_mode = true в секции [features].
Если Codex работает с ключом API, а не через подписку, множители кредитов не применяются: расход считается по долларовым ставкам API из следующего раздела.
Сколько стоит запрос: от $0,22 на Sol до $7,20 в Astra Ultrafast
Один и тот же запрос стоит $0,22 на GPT-6.1 Sol в Standard и $7,20 на GPT-6 Astra в Ultrafast. Ставки из прайса OpenAI API по состоянию на 3 октября 2026 года, за 1 млн токенов, для запросов до 272 000 входных токенов:
| Модель и режим | Входные | Кешированные входные | Выходные | Запрос из примера |
|---|---|---|---|---|
| GPT-6.1 Sol, Standard | $2 | $0,10 | $10 | $0,22 |
| GPT-6.1 Sol, Fast | $4 | $0,20 | $20 | $0,44 |
| GPT-5.6 Sol, Standard | $4 | $0,40 | $20 | $0,48 |
| GPT-6 Astra, Standard | $10 | $1 | $50 | $1,20 |
| GPT-6 Astra, Fast | $20 | $2 | $100 | $2,40 |
| GPT-6 Astra, Ultrafast | $60 | $6 | $300 | $7,20 |
Запрос из примера: 50 000 новых входных токенов, 200 000 входных токенов из кеша и 10 000 выходных. Формула одна для всех строк — доля миллиона, умноженная на ставку:
- GPT-6.1 Sol, Standard: 0,05 × $2 + 0,2 × $0,10 + 0,01 × $10 = $0,22
- GPT-6 Astra, Standard: 0,05 × $10 + 0,2 × $1 + 0,01 × $50 = $1,20
- GPT-6 Astra, Ultrafast: 0,05 × $60 + 0,2 × $6 + 0,01 × $300 = $7,20
Отсюда соотношения: Astra Ultrafast дороже GPT-6.1 Sol в Standard в 32,7 раза ($7,20 ÷ $0,22) и дороже GPT-6.1 Sol в Fast в 16,4 раза ($7,20 ÷ $0,44).

У расчёта есть границы. Плата за запись в кеш в него не входит. Цена GPT-5.6 Sol — акционная, по примечанию в прайсе она действует как минимум до 21 ноября 2026 года. На региональных конечных точках ставки выше на 10 %. При запросе длиннее 272 000 входных токенов действуют другие ставки: GPT-6 Astra в Ultrafast — $120 / $12 / $450, GPT-6.1 Sol в Standard — $4 / $0,20 / $15.
Главное допущение — одинаковое число токенов на всех строках. На реальной задаче разные модели тратят разное количество токенов, поэтому таблица сравнивает цену одинакового запроса, а не стоимость выполненной задачи. Как это расхождение выглядит для Sol на замерах, показано в материале GPT-6.1 Sol или Claude Opus 5.5: сравнение цен и стоимости задачи.
Сколько будет стоить GPT-6.1 Sol Ultrafast: $12 и $60 — оценка
Официальной цены у GPT-6.1 Sol Ultrafast нет. Цифры $12 за 1 млн входных, $0,60 за кешированные и $60 за выходные токены, которые встречаются в новостях, — расчёт VentureBeat: стандартные ставки GPT-6.1 Sol, умноженные на шесть, при условии что множитель применяется ко всем категориям одинаково. Издание само помечает их как расчётные.
Оценка согласуется с тем, что сказала OpenAI: в анонсе стоимость GPT-6.1 Sol Ultrafast в API описана как примерно такая же, какую раньше разработчики платили за GPT-6 Astra. Стандартные ставки Astra — $10 и $50, шестикратные ставки Sol — $12 и $60.
Если множитель подтвердится, запрос из примера обойдётся в 6 × $0,22 = $1,32. Это близко к $1,20 за GPT-6 Astra в Standard и в 5,5 раза дешевле, чем $7,20 за Astra Ultrafast. До появления строки в прайсе это предположение, и строить на нём бюджет стоит с запасом.
Насколько Ultrafast быстрее: «до 8 раз» — про генерацию токенов
Все официальные цифры скорости — это максимумы для генерации выходных токенов, а не время выполнения задачи. Ниже собраны заявления OpenAI и их пересказ в прессе: это не результаты измерений.
| Что заявлено | Цифра | Кто заявил |
|---|---|---|
| GPT-6 Astra Ultrafast в Codex против Astra в Standard | до 8 раз быстрее | OpenAI, страница о скорости в Codex |
| Ultrafast в API | до 6 раз быстрее, до 300 токенов в секунду | VentureBeat со ссылкой на материалы DevDay |
| GPT-5.6 Sol Ultrafast, предварительная версия | до 14 раз быстрее стандартной обработки, до 750 выходных токенов в секунду | OpenAI, анонс от 13 августа 2026 года |
OpenAI прямо оговаривает, что сравнение «до 8 раз» измеряет скорость генерации токенов, а не ставки и не общее время выполнения задачи. Скорость стандартного режима для GPT-6 Astra и GPT-6.1 Sol компания не публикует, как и скорость Fast mode в API.

Чтобы представить порядок величин, можно взять потолок из пересказа VentureBeat. При 300 токенах в секунду 10 000 выходных токенов генерируются примерно 33 секунды (10 000 ÷ 300). Если «в 6 раз» соответствует 50 токенам в секунду в Standard — эта скорость выведена из множителя и нигде не опубликована, — тот же ответ займёт около 200 секунд. Запрос из примера при этом стоит в Ultrafast на $6 дороже, чем в Standard на той же GPT-6 Astra: $7,20 против $1,20.
За пределами множителя остаются сетевые обмены, обработка входных токенов и выполнение инструментов. Агент, который большую часть времени ждёт ответа базы данных или сборки, от Ultrafast ускорится заметно меньше, чем в 6 или 8 раз. Длинный ответ, который читает человек или озвучивает голосовой интерфейс, выиграет больше всего.
Что выбрать сейчас: Sol в Standard или Fast, Astra Ultrafast или подождать
Для большинства задач сегодня разумно оставаться на GPT-6.1 Sol в Standard, а Ultrafast подключать там, где ожидание ответа стоит дороже токенов. По ситуациям:
- Фоновые и пакетные задачи, разбор документов, рутинные правки кода. GPT-6.1 Sol в Standard: $0,22 за запрос из примера. Скорость здесь мало что меняет.
- Нужно быстрее, но достаточно качества Sol. Fast mode: цена ровно вдвое выше Standard. Насколько он ускоряет модели GPT-6 в API, OpenAI не публикует, поэтому выигрыш придётся измерить на своих запросах.
- Ответа ждёт человек или голосовой интерфейс, выходных токенов много, качество Astra нужно. GPT-6 Astra Ultrafast доступен сразу. Среди сценариев для Ultrafast OpenAI называла реагирование на инциденты, финансовые исследования, клиентскую поддержку и голос, торговлю, исследования в реальном времени. Цена — в шесть раз выше Standard той же модели и почти в 33 раза выше GPT-6.1 Sol в Standard на одинаковом запросе.
- Нужен именно Sol в Ultrafast. Подождать строки
gpt-6.1-solна вкладке Ultrafast в прайсе. Пока её нет, модель и уровень обслуживания лучше вынести в конфигурацию, чтобы переключение свелось к двум параметрам, а в бюджете ориентироваться на шестикратную ставку как на предположение. - У организации есть команда сопровождения в OpenAI. Можно запросить предварительный доступ к GPT-5.6 Sol в Ultrafast — режиму с самой высокой заявленной скоростью, до 750 выходных токенов в секунду. Цена обсуждается с OpenAI: в прайсе её нет.
- Данные должны обрабатываться в ЕС или другом регионе вне США. Ultrafast не подходит: остаются Standard и Fast.
Простой способ проверить, оправданна ли переплата за Astra Ultrafast: посчитать по формуле выше разницу в цене своего типичного запроса и сравнить её со стоимостью времени, которое этот запрос экономит. Опубликованной скорости Standard для этого нет, поэтому сэкономленное время стоит получить замером: один и тот же запрос в Standard и в Ultrafast с фиксацией времени до последнего токена.
Короткие ответы про Ultrafast, Fast mode и тариф Pro
Работает ли уже GPT-6.1 Sol Ultrafast?
По состоянию на 3 октября 2026 года в документации OpenAI такого режима нет: GPT-6.1 Sol отсутствует в руководстве по Ultrafast и на вкладке Ultrafast в прайсе API, а в Codex для неё указаны только Standard и Fast. В анонсе от 29 сентября режим назван, и, по данным VentureBeat, его ждут в ближайшие дни.
Чем Ultrafast отличается от Fast mode?
Это два разных уровня обслуживания. Fast стоит вдвое дороже Standard и доступен для GPT-6.1 Sol и GPT-6 Astra. Ultrafast стоит вшестеро дороже Standard и в прайсе есть только для GPT-6 Astra. В Codex Fast расходует включённый лимит в 2,5 раза быстрее, Ultrafast — в 8 раз.
Что даёт тариф Pro за $500 в отношении Ultrafast?
Pro за $500 в месяц — единственный тариф с самостоятельной оплатой, на котором в Codex и ChatGPT Work доступен GPT-6 Astra Ultrafast. Для вызовов через API подписка не нужна: там Ultrafast оплачивается по токенам и открыт всем пользователям API.
Есть ли модель дешевле Sol и когда её достаточно?
Да, GPT-6 Luna: по прайсу она в 20 раз дешевле GPT-6 Sol. Ставки обеих моделей и условия, при которых Sol окупается, разобраны отдельно: GPT-6 Luna или Sol: сколько стоят и когда Sol окупается. Тот материал написан до выхода GPT-6.1 Sol.



