# OpenAI Ultrafast и Sol: в чём разница и что доступно в API

> Ultrafast — режим обслуживания в OpenAI API, Sol — модель. На 3 октября 2026 года в Ultrafast всем открыта только GPT-6 Astra; Sol Ultrafast в прайсе нет.

- Source: https://www.aifreeapi.com/ru/posts/openai-ultrafast-vs-sol
- Language: ru
- Published: 2026-10-03
- Updated: 2026-10-03
- Publisher: AI Free API (https://www.aifreeapi.com)

Ultrafast и Sol нельзя выбирать друг вместо друга: Ultrafast — это уровень обслуживания (service tier) в OpenAI API, то есть режим, в котором обрабатывается запрос, а Sol — семейство моделей. Вопрос на практике звучит иначе: какую модель можно запустить в режиме Ultrafast.

По состоянию на 3 октября 2026 года ответ такой. В Ultrafast всем пользователям API открыта одна модель — GPT-6 Astra, по $60 за 1 млн входных и $300 за 1 млн выходных токенов. GPT-6.1 Sol Ultrafast объявлен OpenAI 29 сентября, но в [руководстве по Ultrafast](https://developers.openai.com/api/docs/guides/ultrafast-mode) и на вкладке Ultrafast в [прайсе API](https://developers.openai.com/api/docs/pricing) его нет. Единственная модель Sol с каким-либо доступом к Ultrafast — GPT-5.6 Sol, и это предварительный доступ по запросу через менеджеров OpenAI, без опубликованной цены.

Сама GPT-6.1 Sol сегодня работает в режимах Standard и Fast. Запрос с 250 000 входных и 10 000 выходных токенов стоит на ней $0,22 в Standard и $0,44 в Fast; такой же запрос к GPT-6 Astra в Ultrafast — $7,20, почти в 33 раза дороже. Расчёт и условия разобраны ниже.

## Ultrafast и Sol — в чём разница: режим обработки и модель

Разница в том, что эти слова отвечают на разные вопросы: модель определяет, кто отвечает на запрос, а уровень обслуживания — с какой скоростью и по какой ставке. OpenAI описывает Ultrafast как самый быстрый уровень обслуживания в API, который стоит использовать, когда скорость оправдывает более высокую цену.

| | Ultrafast | Sol |
|---|---|---|
| Что это | уровень обслуживания запроса | семейство моделей: GPT-6.1 Sol, GPT-6 Sol, GPT-5.6 Sol |
| Где задаётся в API | поле `service_tier` | поле `model` |
| На что влияет | скорость генерации выходных токенов и ставка за токен | качество ответа и базовая ставка |
| Соседние варианты | Standard, Fast | GPT-6 Astra (сильнее и дороже), GPT-6 Luna (дешевле) |

Путаница возникла из-за названий. В августе OpenAI показала Ultrafast на примере GPT-5.6 Sol, а 29 сентября в [анонсе GPT-6.1 Sol](https://openai.com/index/introducing-gpt-6-1-sol/) назвала рядом сразу два продукта: GPT-6 Astra Ultrafast и GPT-6.1 Sol Ultrafast. «GPT-6.1 Sol Ultrafast» — не отдельная модель, а GPT-6.1 Sol, запущенная в режиме Ultrafast.

Ultrafast также не то же самое, что Fast mode. Fast — отдельный уровень с ценой вдвое выше Standard (до 30 июля 2026 года он назывался Priority processing), Ultrafast для GPT-6 Astra — вшестеро выше Standard.

## Какие модели Sol работают в Ultrafast на 3 октября 2026 года

Ни одна модель Sol не открыта в Ultrafast для всех. В документации OpenAI состояние такое:

| Модель | Ultrafast в API | Ultrafast в Codex и ChatGPT Work | Цена Ultrafast в прайсе |
|---|---|---|---|
| GPT-6 Astra | да, всем пользователям API, с невысокими лимитами | да, на Pro за $500 и подходящих планах Enterprise и Edu | $60 / $6 / $300 за 1 млн токенов |
| GPT-6.1 Sol | объявлен, в руководстве по Ultrafast не упоминается | нет: поддерживаются Standard и Fast | нет |
| GPT-6 Sol | в руководстве не упоминается | нет | нет |
| GPT-5.6 Sol | предварительный доступ по запросу через менеджеров OpenAI | не упоминается | нет |

Цена в таблице — входные, кешированные входные и выходные токены при запросе до 272 000 входных токенов.

Источники здесь расходятся, и это стоит учитывать. В русской версии анонса OpenAI пишет: «Одновременно мы запускаем GPT‑6 Astra Ultrafast — самую быструю передовую модель в мире, до 8 раз быстрее GPT‑6 Astra, — а также GPT‑6.1 Sol Ultrafast». [VentureBeat](https://venturebeat.com/technology/openais-gpt-6-1-sol-offers-astra-like-performance-at-1-5th-price-a-new-ultrafast-tier-clocks-at-300-tokens-per-second) в тот же день уточнил: Ultrafast сразу доступен для GPT-6 Astra, а версия для GPT-6.1 Sol ожидается «в ближайшие дни». Документация подтверждает вторую версию: руководство по Ultrafast называет только GPT-6 Astra и предварительный доступ для GPT-5.6 Sol, на вкладке Ultrafast в прайсе одна строка, а [страница о скорости в Codex](https://learn.chatgpt.com/docs/agent-configuration/speed) сообщает, что GPT-6.1 Sol поддерживает Standard и Fast.

Вывод из этого осторожный: GPT-6.1 Sol Ultrafast объявлен, но документированного способа его вызвать и опубликованной цены пока нет. Что вернёт API на запрос с `gpt-6.1-sol` и `service_tier: "ultrafast"`, документация не описывает. Состояние может измениться за считаные дни, поэтому перед решением стоит открыть вкладку Ultrafast в прайсе: если там появилась строка `gpt-6.1-sol`, режим запущен и у него есть цена.

Про GPT-5.6 Sol: в [августовском анонсе](https://openai.com/index/previewing-ultrafast/) OpenAI говорила об ограниченной предварительной версии для отдельных клиентов. Сейчас в руководстве сказано, что организации, у которых есть команда сопровождения в OpenAI, могут запросить через неё этот доступ или более высокие лимиты. Самостоятельно включить его нельзя.

## Как включить Ultrafast в API: service_tier и WebSocket

Чтобы запрос ушёл в Ultrafast, в Responses API нужно указать модель `gpt-6-astra` и `service_tier` со значением `ultrafast`. Отдельной модели или отдельного ключа не требуется. Пример из руководства OpenAI для HTTP:

```bash
curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Explain why the sky is blue in one sentence.",
    "service_tier": "ultrafast"
  }'
```

Запрос платный: он тарифицируется по ставкам Ultrafast.

HTTP поддерживается, но OpenAI настойчиво рекомендует WebSocket, особенно для агентов, которые делают много вызовов инструментов подряд: без постоянного соединения сетевые задержки съедают часть выигрыша. В SDK соединение открывается через `client.responses.connect()`, а каждый запрос отправляется вызовом `connection.response.create(...)` с теми же `model` и `service_tier`. Следующий ход диалога передаёт идентификатор предыдущего ответа в `previous_response_id`, и одно соединение используется повторно для новых реплик и результатов инструментов.

Три условия, которые стоит проверить до того, как закладывать Ultrafast в архитектуру:

- **Лимиты.** Для GPT-6 Astra в Ultrafast по умолчанию действует 500 000 токенов в минуту на уровнях использования API с 1-го по 3-й, 1 000 000 на 4-м и 5 000 000 на 5-м. Больше — только по запросу через менеджеров OpenAI.
- **Размещение данных.** Ultrafast поддерживает только хранение данных в США и глобальную обработку. Региональные конечные точки ЕС и других регионов с ним не работают.
- **Фактический уровень.** По описанию сервиса-шлюза [OrcaRouter](https://www.orcarouter.ai/blog/gpt-5-6-sol-ultrafast-vs-gpt-5-6-sol), ответ API возвращает поле `service_tier` с уровнем, который реально обслужил запрос. В документах OpenAI, перечисленных выше, это не описано, так что утверждение стоит проверить на собственном ответе.

## Ultrafast в Codex и ChatGPT Work: нужен Pro за $500

В Codex и ChatGPT Work режим Ultrafast есть только на тарифе Pro за $500 в месяц и на подходящих планах Enterprise и Edu, и только для GPT-6 Astra. На остальных тарифах с самостоятельной оплатой его на старте нет, даже если докупить кредиты. Условия приведены на [странице о скорости](https://learn.chatgpt.com/docs/agent-configuration/speed) и в [описании тарифов](https://learn.chatgpt.com/docs/pricing).

| Режим в Codex | Расход включённого в подписку лимита | Купленные кредиты и оплата по факту в Enterprise |
|---|---|---|
| Standard | 1× | 1× |
| Fast | 2,5× | 2× |
| Ultrafast (GPT-6 Astra) | 8× | 6× |

Эти множители описывают расход, а не ускорение. На Pro за $500 Ultrafast сначала тратит включённый лимит, затем доступные кредиты. В рабочих пространствах Enterprise он по умолчанию выключен и недоступен там, где требуется обработка данных за пределами США.

GPT-6.1 Sol в Codex доступна на Plus, Pro, Business, Enterprise и Edu, но в режимах Standard и Fast. Fast включается командой `/fast` в CLI; чтобы сделать его режимом по умолчанию, в `config.toml` задают `service_tier = "fast"` и `fast_mode = true` в секции `[features]`.

Если Codex работает с ключом API, а не через подписку, множители кредитов не применяются: расход считается по долларовым ставкам API из следующего раздела.

## Сколько стоит запрос: от $0,22 на Sol до $7,20 в Astra Ultrafast

Один и тот же запрос стоит $0,22 на GPT-6.1 Sol в Standard и $7,20 на GPT-6 Astra в Ultrafast. Ставки из [прайса OpenAI API](https://developers.openai.com/api/docs/pricing) по состоянию на 3 октября 2026 года, за 1 млн токенов, для запросов до 272 000 входных токенов:

| Модель и режим | Входные | Кешированные входные | Выходные | Запрос из примера |
|---|---|---|---|---|
| GPT-6.1 Sol, Standard | $2 | $0,10 | $10 | $0,22 |
| GPT-6.1 Sol, Fast | $4 | $0,20 | $20 | $0,44 |
| GPT-5.6 Sol, Standard | $4 | $0,40 | $20 | $0,48 |
| GPT-6 Astra, Standard | $10 | $1 | $50 | $1,20 |
| GPT-6 Astra, Fast | $20 | $2 | $100 | $2,40 |
| GPT-6 Astra, Ultrafast | $60 | $6 | $300 | $7,20 |

Запрос из примера: 50 000 новых входных токенов, 200 000 входных токенов из кеша и 10 000 выходных. Формула одна для всех строк — доля миллиона, умноженная на ставку:

- GPT-6.1 Sol, Standard: 0,05 × $2 + 0,2 × $0,10 + 0,01 × $10 = $0,22
- GPT-6 Astra, Standard: 0,05 × $10 + 0,2 × $1 + 0,01 × $50 = $1,20
- GPT-6 Astra, Ultrafast: 0,05 × $60 + 0,2 × $6 + 0,01 × $300 = $7,20

Отсюда соотношения: Astra Ultrafast дороже GPT-6.1 Sol в Standard в 32,7 раза ($7,20 ÷ $0,22) и дороже GPT-6.1 Sol в Fast в 16,4 раза ($7,20 ÷ $0,44).

![Столбчатая диаграмма: один запрос стоит $0,22 на GPT-6.1 Sol Standard, $0,44 в Fast, $1,20 на GPT-6 Astra Standard, $2,40 в Fast и $7,20 в Ultrafast](https://www.aifreeapi.com/posts/ru/openai-ultrafast-vs-sol/img/request-cost-by-tier.webp)

У расчёта есть границы. Плата за запись в кеш в него не входит. Цена GPT-5.6 Sol — акционная, по примечанию в прайсе она действует как минимум до 21 ноября 2026 года. На региональных конечных точках ставки выше на 10 %. При запросе длиннее 272 000 входных токенов действуют другие ставки: GPT-6 Astra в Ultrafast — $120 / $12 / $450, GPT-6.1 Sol в Standard — $4 / $0,20 / $15.

Главное допущение — одинаковое число токенов на всех строках. На реальной задаче разные модели тратят разное количество токенов, поэтому таблица сравнивает цену одинакового запроса, а не стоимость выполненной задачи. Как это расхождение выглядит для Sol на замерах, показано в материале [GPT-6.1 Sol или Claude Opus 5.5: сравнение цен и стоимости задачи](/ru/posts/gpt-6-1-sol-vs-claude-opus-5-5).

## Сколько будет стоить GPT-6.1 Sol Ultrafast: $12 и $60 — оценка

Официальной цены у GPT-6.1 Sol Ultrafast нет. Цифры $12 за 1 млн входных, $0,60 за кешированные и $60 за выходные токены, которые встречаются в новостях, — расчёт VentureBeat: стандартные ставки GPT-6.1 Sol, умноженные на шесть, при условии что множитель применяется ко всем категориям одинаково. Издание само помечает их как расчётные.

Оценка согласуется с тем, что сказала OpenAI: в анонсе стоимость GPT-6.1 Sol Ultrafast в API описана как примерно такая же, какую раньше разработчики платили за GPT-6 Astra. Стандартные ставки Astra — $10 и $50, шестикратные ставки Sol — $12 и $60.

Если множитель подтвердится, запрос из примера обойдётся в 6 × $0,22 = $1,32. Это близко к $1,20 за GPT-6 Astra в Standard и в 5,5 раза дешевле, чем $7,20 за Astra Ultrafast. До появления строки в прайсе это предположение, и строить на нём бюджет стоит с запасом.

## Насколько Ultrafast быстрее: «до 8 раз» — про генерацию токенов

Все официальные цифры скорости — это максимумы для генерации выходных токенов, а не время выполнения задачи. Ниже собраны заявления OpenAI и их пересказ в прессе: это не результаты измерений.

| Что заявлено | Цифра | Кто заявил |
|---|---|---|
| GPT-6 Astra Ultrafast в Codex против Astra в Standard | до 8 раз быстрее | OpenAI, страница о скорости в Codex |
| Ultrafast в API | до 6 раз быстрее, до 300 токенов в секунду | VentureBeat со ссылкой на материалы DevDay |
| GPT-5.6 Sol Ultrafast, предварительная версия | до 14 раз быстрее стандартной обработки, до 750 выходных токенов в секунду | OpenAI, анонс от 13 августа 2026 года |

OpenAI прямо оговаривает, что сравнение «до 8 раз» измеряет скорость генерации токенов, а не ставки и не общее время выполнения задачи. Скорость стандартного режима для GPT-6 Astra и GPT-6.1 Sol компания не публикует, как и скорость Fast mode в API.

![Три этапа одного шага агента: сеть и вход — как прежде, генерация ответа — до 8 раз быстрее, инструменты — как прежде; пример: 10 000 выходных токенов за 33 с при 300 токенах в секунду](https://www.aifreeapi.com/posts/ru/openai-ultrafast-vs-sol/img/ultrafast-speed-scope.webp)

Чтобы представить порядок величин, можно взять потолок из пересказа VentureBeat. При 300 токенах в секунду 10 000 выходных токенов генерируются примерно 33 секунды (10 000 ÷ 300). Если «в 6 раз» соответствует 50 токенам в секунду в Standard — эта скорость выведена из множителя и нигде не опубликована, — тот же ответ займёт около 200 секунд. Запрос из примера при этом стоит в Ultrafast на $6 дороже, чем в Standard на той же GPT-6 Astra: $7,20 против $1,20.

За пределами множителя остаются сетевые обмены, обработка входных токенов и выполнение инструментов. Агент, который большую часть времени ждёт ответа базы данных или сборки, от Ultrafast ускорится заметно меньше, чем в 6 или 8 раз. Длинный ответ, который читает человек или озвучивает голосовой интерфейс, выиграет больше всего.

## Что выбрать сейчас: Sol в Standard или Fast, Astra Ultrafast или подождать

Для большинства задач сегодня разумно оставаться на GPT-6.1 Sol в Standard, а Ultrafast подключать там, где ожидание ответа стоит дороже токенов. По ситуациям:

- **Фоновые и пакетные задачи, разбор документов, рутинные правки кода.** GPT-6.1 Sol в Standard: $0,22 за запрос из примера. Скорость здесь мало что меняет.
- **Нужно быстрее, но достаточно качества Sol.** Fast mode: цена ровно вдвое выше Standard. Насколько он ускоряет модели GPT-6 в API, OpenAI не публикует, поэтому выигрыш придётся измерить на своих запросах.
- **Ответа ждёт человек или голосовой интерфейс, выходных токенов много, качество Astra нужно.** GPT-6 Astra Ultrafast доступен сразу. Среди сценариев для Ultrafast OpenAI называла реагирование на инциденты, финансовые исследования, клиентскую поддержку и голос, торговлю, исследования в реальном времени. Цена — в шесть раз выше Standard той же модели и почти в 33 раза выше GPT-6.1 Sol в Standard на одинаковом запросе.
- **Нужен именно Sol в Ultrafast.** Подождать строки `gpt-6.1-sol` на вкладке Ultrafast в прайсе. Пока её нет, модель и уровень обслуживания лучше вынести в конфигурацию, чтобы переключение свелось к двум параметрам, а в бюджете ориентироваться на шестикратную ставку как на предположение.
- **У организации есть команда сопровождения в OpenAI.** Можно запросить предварительный доступ к GPT-5.6 Sol в Ultrafast — режиму с самой высокой заявленной скоростью, до 750 выходных токенов в секунду. Цена обсуждается с OpenAI: в прайсе её нет.
- **Данные должны обрабатываться в ЕС или другом регионе вне США.** Ultrafast не подходит: остаются Standard и Fast.

Простой способ проверить, оправданна ли переплата за Astra Ultrafast: посчитать по формуле выше разницу в цене своего типичного запроса и сравнить её со стоимостью времени, которое этот запрос экономит. Опубликованной скорости Standard для этого нет, поэтому сэкономленное время стоит получить замером: один и тот же запрос в Standard и в Ultrafast с фиксацией времени до последнего токена.

## Короткие ответы про Ultrafast, Fast mode и тариф Pro

### Работает ли уже GPT-6.1 Sol Ultrafast?

По состоянию на 3 октября 2026 года в документации OpenAI такого режима нет: GPT-6.1 Sol отсутствует в руководстве по Ultrafast и на вкладке Ultrafast в прайсе API, а в Codex для неё указаны только Standard и Fast. В анонсе от 29 сентября режим назван, и, по данным VentureBeat, его ждут в ближайшие дни.

### Чем Ultrafast отличается от Fast mode?

Это два разных уровня обслуживания. Fast стоит вдвое дороже Standard и доступен для GPT-6.1 Sol и GPT-6 Astra. Ultrafast стоит вшестеро дороже Standard и в прайсе есть только для GPT-6 Astra. В Codex Fast расходует включённый лимит в 2,5 раза быстрее, Ultrafast — в 8 раз.

### Что даёт тариф Pro за $500 в отношении Ultrafast?

Pro за $500 в месяц — единственный тариф с самостоятельной оплатой, на котором в Codex и ChatGPT Work доступен GPT-6 Astra Ultrafast. Для вызовов через API подписка не нужна: там Ultrafast оплачивается по токенам и открыт всем пользователям API.

### Есть ли модель дешевле Sol и когда её достаточно?

Да, GPT-6 Luna: по прайсу она в 20 раз дешевле GPT-6 Sol. Ставки обеих моделей и условия, при которых Sol окупается, разобраны отдельно: [GPT-6 Luna или Sol: сколько стоят и когда Sol окупается](/ru/posts/gpt-6-luna-vs-sol-price). Тот материал написан до выхода GPT-6.1 Sol.
