For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

速度

在不降低智能水平的前提下提升速度

ChatGPT Work 和 Codex 共享用量。 两者采用相同的 定价、额度和用量限制。请参阅 Codex 定价 了解 详情。

快速模式

GPT-5.5 将于 2026 年 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 的所有套餐中下线。 OpenAI API 不受影响。有关迁移指导,请参阅 GPT-5.5 下线说明

Codex 支持通过消耗更多额度来提升模型速度。

对于 GPT-5.6、GPT-5.5 和 GPT-5.4,快速模式可将模型速度提升至原来的 1.5 倍。 GPT-5.6 和 GPT-5.5 的额度消耗为标准模式的 2.5 倍;GPT-5.4 的额度消耗为标准模式的 2 倍。

在提供 GPT-6 Astra 快速模式的情况下,其额度消耗为标准模式的 2.5 倍。 有关模型可用性,请参阅模型;有关 Token 费率,请参阅 定价

在 CLI 中使用 /fast on/fast off/fast status 可更改或查看 当前设置。您也可以通过 service_tier = "fast"[features].fast_mode = trueconfig.toml 中保存默认设置。 使用 ChatGPT 登录后,您可以在 ChatGPT 桌面应用、Codex CLI 和 IDE 扩展中 使用快速模式。快速模式是一项使用 ChatGPT 额度的功能。使用 API 密钥时, Codex 按 API Token 定价计费,ChatGPT 额度消耗倍数 不适用。API 优先处理采用独立的计费费率;对于 GPT-5.6,其费率为 标准 API Token 费率的 2 倍。

Codex-Spark

GPT-5.3-Codex-Spark 是一款独立的 Codex 模型,速度快但能力较弱,专为近乎即时的实时编程迭代而优化。快速模式通过提高额度消耗来加速受支持的模型,而 Codex-Spark 是一个独立的模型选项,有自己的用量限制。

在研究预览期间,Codex-Spark 仅供 ChatGPT Pro 订阅用户使用。