Ultrafast 和 Sol 不是两个要二选一的东西。Ultrafast 是 OpenAI 的服务层级,决定同一个模型以多快的速度吐出结果、按多少倍收费;Sol 是模型系列,现在的主力是 GPT-6.1 Sol。一次请求里两样都要选:先选模型,再选它跑在 Standard、Fast 还是 Ultrafast 上。
真正要判断的是「Sol 能不能跑在 Ultrafast 上」。截至 2026 年 10 月 3 日,答案分三种:
- GPT-6 Astra Ultrafast:所有 API 用户都能调用,价格是 Astra 标准价的 6 倍,即每百万 token 输入 $60、输出 $300。OpenAI API 定价表
- GPT-6.1 Sol Ultrafast:OpenAI 在 9 月 29 日的公告里已经宣布,但 Ultrafast 指南、定价表和 Codex 的速度说明里都还没有它,没有公开价格,也没有写明的调用方式。
- GPT-5.6 Sol Ultrafast:仍是预览,需要通过 OpenAI 客户团队申请,没有公开价格。Ultrafast 模式指南
所以今天手里只有一个普通 API 账号的话,能用的组合是 GPT-6.1 Sol 的 Standard 或 Fast,以及 GPT-6 Astra 的 Standard、Fast 或 Ultrafast。
Ultrafast 和 Sol 是什么关系:一个是服务层级,一个是模型
Ultrafast 在 OpenAI 文档里的定义是「OpenAI API 中最快的服务层级」,和 Standard、Fast 并列。它通过请求里的 service_tier 字段指定,模型本身不变:GPT-6 Astra 开了 Ultrafast 还是 GPT-6 Astra,变的是输出速度和计费倍率。
Sol 则是模型名。OpenAI 当前的旗舰系列里,Astra 是综合能力最强的一档,Sol 居中,Luna 最便宜。GPT-6.1 Sol 于 2026 年 9 月 29 日发布,API 模型 ID 是 gpt-6.1-sol,标准价为每百万 token 输入 $2、输出 $10。OpenAI:推出 GPT-6.1 Sol
两个名字之所以会被放在一起比,是因为 Ultrafast 最初就是随 Sol 亮相的。2026 年 8 月 13 日 OpenAI 预览 Ultrafast 时,搭配的模型是 GPT-5.6 Sol:「比标准处理最高快 14 倍」「每秒最多可生成 750 个输出 token」,由 Cerebras 提供算力,只「面向部分精选客户提供限量预览」,当时没有公布价格。OpenAI:Ultrafast 模式预览 到 9 月底,Ultrafast 才扩展到 GPT-6 系列,而且先落地的是 Astra,不是 Sol。

GPT-6.1 Sol Ultrafast 现在能不能用:已宣布,文档里还没有入口
截至 2026 年 10 月 3 日,GPT-6.1 Sol Ultrafast 处在「已宣布、未在文档中开放」的状态。几处官方信息并不一致,放在一起看是这样的:
| 出处 | 关于 GPT-6.1 Sol Ultrafast 的说法 |
|---|---|
| OpenAI 9 月 29 日公告 | 「与此同时,我们还推出了 GPT‑6 Astra Ultrafast 和 GPT‑6.1 Sol Ultrafast」,通过 API 提供,也面向每月 500 美元的 Pro 档位开放 |
| API 的 Ultrafast 指南 | 只写 GPT-6 Astra 广泛可用、GPT-5.6 Sol 可申请预览,全文没有出现 GPT-6.1 Sol |
| API 定价表的 Ultrafast 页签 | 只有 gpt-6-astra 一行 |
| Codex 的速度说明 | 「GPT-6.1 Sol supports Standard and Fast where available」,即只支持 Standard 和 Fast |
| VentureBeat 对 DevDay 的报道 | Astra 的 Ultrafast 立即可用,6.1 Sol 的版本「将在未来几天内」推出 |
公告说推出了,可操作的文档里却找不到,VentureBeat 的「未来几天内」是目前最能解释这个落差的说法。VentureBeat 报道 这件事随时可能变化,判断它是否上线,看两处就够:定价表的 Ultrafast 页签里有没有出现 gpt-6.1-sol 这一行,以及 Ultrafast 指南的可用模型有没有加上它。
按账号类型,今天各自能用到什么:
| 你的情况 | 能跑在 Ultrafast 上的模型 | 条件 |
|---|---|---|
| 普通 API 账号(用量等级 1–5) | GPT-6 Astra | 直接可用,默认速率限制较低 |
| 有 OpenAI 客户团队对接的组织 | GPT-6 Astra,另可申请 GPT-5.6 Sol 预览 | 向客户团队申请更高限额或预览资格 |
| Codex / ChatGPT Work 的 Pro $500 | GPT-6 Astra | 先扣套餐内额度,用完后扣 credits |
| 符合条件的 Enterprise、Edu | GPT-6 Astra | Enterprise 工作区默认关闭,需要先启用 |
| Plus、Pro $100、Pro $200、Business 等其他自助套餐 | 无 | 购买 credits 也不能开 Ultrafast |
表里没有任何一行能让 GPT-6.1 Sol 跑在 Ultrafast 上,这就是当前的实际情况。
Ultrafast 多少钱:Astra 是标准价的 6 倍,Sol 没有公开价
API 上唯一有标价的 Ultrafast 是 GPT-6 Astra:每百万 token 输入 $60、缓存输入 $6、缓存写入 $75、输出 $300,每一项都是它标准价的 6 倍、Fast 价的 3 倍。下表是 2026 年 10 月 3 日定价表上的短上下文价格(单次输入不超过 272K token),单位为美元每百万 token:
| 模型与层级 | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| GPT-6.1 Sol Standard | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6.1 Sol Fast | $4.00 | $0.20 | $5.00 | $20.00 |
| GPT-6.1 Sol Ultrafast | 未公布 | 未公布 | 未公布 | 未公布 |
| GPT-5.6 Sol Standard | $4.00 | $0.40 | $5.00 | $20.00 |
| GPT-5.6 Sol Ultrafast(预览) | 未公布 | 未公布 | 未公布 | 未公布 |
| GPT-6 Astra Standard | $10.00 | $1.00 | $12.50 | $50.00 |
| GPT-6 Astra Fast | $20.00 | $2.00 | $25.00 | $100.00 |
| GPT-6 Astra Ultrafast | $60.00 | $6.00 | $75.00 | $300.00 |
几个会影响账单的细节:输入超过 272K token 时走长上下文价,GPT-6 Astra Ultrafast 变成输入 $120、输出 $450;GPT-5.6 Sol 的 $4 / $20 是促销价,定价页写明至少持续到 2026 年 11 月 21 日。OpenAI API 定价表
同一个请求在各层级要花多少
拿一个典型的智能体请求来算:5 万 token 新输入、20 万 token 缓存输入、1 万 token 输出。总输入 25 万,仍在 272K 的短上下文档内;不计缓存写入费。算式是「新输入 × 输入价 + 缓存输入 × 缓存价 + 输出 × 输出价」,token 数以百万为单位:
| 模型与层级 | 算式 | 单次费用 |
|---|---|---|
| GPT-6.1 Sol Standard | 0.05 × 2 + 0.2 × 0.10 + 0.01 × 10 | $0.22 |
| GPT-6.1 Sol Fast | 0.05 × 4 + 0.2 × 0.20 + 0.01 × 20 | $0.44 |
| GPT-5.6 Sol Standard | 0.05 × 4 + 0.2 × 0.40 + 0.01 × 20 | $0.48 |
| GPT-6 Astra Standard | 0.05 × 10 + 0.2 × 1 + 0.01 × 50 | $1.20 |
| GPT-6 Astra Fast | 0.05 × 20 + 0.2 × 2 + 0.01 × 100 | $2.40 |
| GPT-6 Astra Ultrafast | 0.05 × 60 + 0.2 × 6 + 0.01 × 300 | $7.20 |
今天要用上 Ultrafast,只能走最后一行。同一个请求,$7.20 是 GPT-6.1 Sol Standard 的约 32.7 倍、GPT-6.1 Sol Fast 的约 16.4 倍。这笔差价里有两层:换成 Astra 本身贵 5 倍多,Ultrafast 再乘 6。
这张表比的是同一份 token 用量的标价。不同模型完成同一件事用掉的 token 并不相同,所以它不等于「完成一项任务的成本」;把自己的三个 token 数代进算式,就能得到自己的版本。

GPT-6.1 Sol Ultrafast 的 $12 / $60 是推算,不是官方价
流传的「GPT-6.1 Sol Ultrafast 每百万 token 输入 $12、缓存输入 $0.60、输出 $60」出自 VentureBeat,是把 Astra 的 6 倍倍率套到 Sol 标准价上得到的,报道里注明了前提是「倍率统一适用」。OpenAI 自己只说过一句:借助 GPT‑6.1 Sol Ultrafast,开发者支付的 API 费用与此前使用 GPT‑6 Astra「大致相同」。
两种说法对得上。按 $12 / $0.60 / $60 算上面那个请求:0.05 × 12 + 0.2 × 0.60 + 0.01 × 60 = $1.32,和 GPT-6 Astra Standard 的 $1.20 接近。如果最终定价就是 6 倍,Sol 跑 Ultrafast 的花费不到今天 Astra Ultrafast 的五分之一($1.32 对 $7.20)。在价目表出现这一行之前,这只能当作估算预算时的假设。
Ultrafast 和 Fast 模式差在哪:2 倍价与 6 倍价
Fast 和 Ultrafast 是两个不同的层级,不是同一个东西的两种叫法。Fast 模式就是原来的 Priority processing,2026 年 7 月 30 日改的名;它对 GPT-6.1 Sol、GPT-6 Astra、GPT-6 Luna 都开放,API 价格是标准价的 2 倍。Ultrafast 是另一套更快的层级,API 价格是标准价的 6 倍,目前只有 Astra 有公开价目。
| Fast | Ultrafast | |
|---|---|---|
| API 价格 | 标准价 × 2 | 标准价 × 6(仅 GPT-6 Astra 有标价) |
| GPT-6.1 Sol 能否使用 | 能 | 截至 2026 年 10 月 3 日不能 |
| Codex 套餐内额度消耗 | 标准的 2.5 倍 | 标准的 8 倍 |
| Codex credits、Enterprise 按量计费 | 标准的 2 倍 | 标准的 6 倍 |
| 官方给出的速度 | GPT-5.6、GPT-5.5 为 1.5 倍;GPT-6 系列没有给出倍数 | Codex 中 GPT-6 Astra 最高 8 倍 |
对只想让 GPT-6.1 Sol 快一些的人,Fast 是今天唯一的加速选项:同一个请求从 $0.22 变成 $0.44。OpenAI 没有公布 GPT-6 系列在 Fast 模式下快多少,付 2 倍价之前,值得先用自己的请求量一下首字时间和总耗时。
API 里怎么调用 Ultrafast:service_tier 设为 ultrafast
调用方式是在 Responses API 的请求里把 service_tier 设为 ultrafast,模型用 gpt-6-astra。文档给出的 HTTP 示例:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Explain why the sky is blue in one sentence.",
"service_tier": "ultrafast"
}'这是文档里的示例,发出去就按 Ultrafast 价计费。上线前有三件事要先确认:
- 连接方式。OpenAI「强烈建议」用 WebSocket(SDK 里的
client.responses.connect()),尤其是连续多次调用工具的智能体。没有持久连接时,每次请求的网络开销会抵掉一部分速度优势。HTTP 可以用,适合单次、低频的请求。 - 速率限制。GPT-6 Astra 的 Ultrafast 默认限额是:用量等级 1–3 为每分钟 50 万 token,等级 4 为 100 万,等级 5 为 500 万。要更高的限额需要找 OpenAI 客户团队。
- 数据驻留。Ultrafast 只支持美国数据驻留和全球处理,不支持欧盟或其他非美国的区域处理端点。有这类合规要求的项目用不了 Ultrafast。
文档里的示例只用了 gpt-6-astra。把 service_tier: "ultrafast" 配上 gpt-6.1-sol 会返回什么,公开文档里没有说明,不要按「会自动加速」去设计流程。
Codex 里怎么开 Ultrafast:要 Pro $500,或符合条件的 Enterprise、Edu
在 Codex 和 ChatGPT Work(OpenAI 中文公告里写作「ChatGPT 工作」)里,Ultrafast 只对每月 $500 的 Pro 档位以及符合条件的 Enterprise、Edu 套餐开放,能加速的模型是 GPT-6 Astra。其他自助套餐在首发阶段没有 Ultrafast,买了 credits 也不行。Codex 速度说明
计费上要留意它消耗额度的速度:
- 用套餐内额度时,Ultrafast 按标准的 8 倍扣;Pro $500 先扣套餐内额度,用完后再扣 credits。
- 用购买的 credits 或 Enterprise 按量计费时,按标准的 6 倍计。GPT-6 Astra 的标准费率是每百万 token 输入 250、缓存输入 25、输出 1,250 credits,乘 6 就是 Ultrafast 的消耗。Codex 价格说明
- Enterprise 工作区默认关闭 Ultrafast;要求推理驻留在美国以外的工作区无法使用。
GPT-6.1 Sol 在 Codex 里只有 Standard 和 Fast。Fast 可以在 CLI 里用 /fast 切换,或在 config.toml 里写 service_tier = "fast" 并在 [features] 下设 fast_mode = true;代价是套餐内额度按 2.5 倍扣,credits 按 2 倍计。Sol 的 credits 费率是 Astra 的五分之一(输入 50、输出 250),Sol 和 Luna 在 API 与 Codex 两套计费下的算法见GPT-6 Luna 与 Sol 价格对比:API 和 Codex 分别怎么算,那篇讲的是上一版 GPT-6 Sol,计费结构相同。
快 8 倍、14 倍指的是什么:输出 token 的生成速度,不是任务耗时
官方给出的倍数都带「最高」,量的都是输出 token 的生成速度。Codex 文档写得很直接:8 倍这个比较「衡量的是 token 生成速度,不是计费倍率,也不是任务的整体完成时间」。
三组数字各有出处,不能混着用:
| 数字 | 对象 | 出处 |
|---|---|---|
| 最高 14 倍、每秒最多 750 个输出 token | GPT-5.6 Sol Ultrafast(预览,Cerebras 提供支持) | OpenAI 8 月 13 日公告 |
| 最高 8 倍 | GPT-6 Astra Ultrafast,对比 Codex 中的 Astra 标准模式 | OpenAI 9 月 29 日公告与 Codex 文档 |
| API 中 6 倍、最高约每秒 300 token | GPT-6 系列的 Ultrafast | VentureBeat 对 DevDay 材料的转述,OpenAI 页面上没有 |
GPT-6 Astra 和 GPT-6.1 Sol 在标准模式下每秒多少 token,OpenAI 没有公布,所以「8 倍」换算不出一个确定的绝对速度。
倍数只作用于生成这一段。网络往返、工具执行、输入处理的时间都在倍数之外。举个量级上的例子:1 万个输出 token 按每秒 300 个生成,大约 33 秒;如果标准模式是它的六分之一,即每秒 50 个(由「6 倍」倒推的假设值,并非公布数据),大约 200 秒。一个任务如果有一半时间花在跑测试、等外部接口上,这一半不会因为换了层级而缩短。
现在怎么选:今天要速度用 Astra Ultrafast,要 Sol 的价格就先用 Fast
按你最在意的那一项来定:
- 延迟是硬指标,而且今天就要:用 GPT-6 Astra Ultrafast。代价是同一请求约为 GPT-6.1 Sol Standard 的 33 倍。OpenAI 列举的适用场景是事故响应、金融研究、客服与语音、电商、实时研究,共同点是有人或有系统在实时等结果,等待本身有成本。
- 预算按 Sol 的价位做的:用 GPT-6.1 Sol Standard;嫌慢就开 Fast,费用翻倍但仍只有 Astra Standard 的三分之一多($0.44 对 $1.20)。
- 想要的就是「Sol 的智能 + Ultrafast 的速度」:等定价表出现
gpt-6.1-sol的 Ultrafast 行。预算可以先按 Astra 标准价的量级估,即上面算例里的 $1.32 左右,但要标注这是未公布的假设。 - 有 OpenAI 客户团队:可以申请 GPT-5.6 Sol 的 Ultrafast 预览,它的速度上限最高(每秒最多 750 个输出 token),但它是比 GPT-6.1 Sol 更早的模型,价格要向客户团队确认。
- 数据必须留在欧盟等非美国区域:Ultrafast 不可用,在 Standard 和 Fast 之间选。
- 后台批处理、夜间任务、耗时主要在工具执行上的流程:没有人在等输出,多付 6 倍换来的时间用不上,留在 Standard。
值得多付钱的判断可以落到一个问题上:输出生成占了总耗时的多大比例,以及缩短这段时间值多少钱。先在 Standard 下记录一次真实任务里生成、工具、网络各占多久,再决定要不要换层级。
标价之外,不同模型完成同一任务的 token 用量差别很大。如果你同时在 OpenAI 和 Anthropic 之间比较,GPT-6.1 Sol 对比 Opus 5.5:标价差 2 倍,任务成本差 6 倍里有按任务计的成本对照。
常见问题
OpenAI 的 Ultrafast 模式和普通模式有什么区别?
模型相同,速度和价格不同。Ultrafast 是比 Standard(普通模式)和 Fast 更快的服务层级,官方给的上限是:GPT-6 Astra 在 Codex 中最高快 8 倍,GPT-5.6 Sol 预览版最高快 14 倍。API 价格是标准价的 6 倍,目前只有 GPT-6 Astra 有公开标价。
GPT-6.1 Sol Ultrafast 什么时候能用?
OpenAI 没有给出日期。9 月 29 日的公告把它和 Astra Ultrafast 一起宣布,VentureBeat 的报道称「未来几天内」推出;截至 2026 年 10 月 3 日,API 的 Ultrafast 指南和定价表里都还没有它。
Plus 用户能在 Codex 里用 Ultrafast 吗?
不能。Codex 和 ChatGPT Work 里的 Ultrafast 只对 Pro $500 以及符合条件的 Enterprise、Edu 套餐开放,其他自助套餐即使购买 credits 也没有。Plus 能用的是 GPT-6.1 Sol 的 Standard,以及已开放处的 Fast。
中文报道里的「极速版」和 Ultrafast 是一回事吗?
是。「极速版」是中文媒体对 Ultrafast 的叫法,OpenAI 中文页面保留英文名 Ultrafast,并称它为「服务层级」。它和 Fast 模式不是同一个层级,Fast 是 2 倍价,Ultrafast 是 6 倍价。



