For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

定价

ChatGPT Work 和 Codex 已包含在您的 ChatGPT 免费版、Go、Plus、Pro、Business、Edu 或企业套餐中

ChatGPT Work 和 Codex 共享用量。在 ChatGPT 中使用 ChatGPT Work 时,其定价、额度和用量上限与 Codex 相同。

定价选项

免费版

通过简短的编程任务探索 Codex 的能力。

    Go

    使用 Codex 完成轻量级编程任务。

    $8/月
    获取 Go

      Plus

      满足您每周几次专注编程的需求。

      • 可通过 Web、CLI、IDE 扩展和 iOS 使用 Codex
      • 自动代码审查和 Slack 集成等云端集成功能
      • GPT-5.6 模型系列,包括 Sol、Terra 和 Luna
      • 使用 GPT-5.6 Luna 处理轻量级或大批量工作负载时,可获得更高的用量上限
      • 使用 ChatGPT 额度灵活扩展用量
      • Plus 套餐包含的其他 ChatGPT 功能

      Pro

      可选择 Plus 5 倍或 20 倍的速率限制。

      起价
      $100/月
      获取 Pro
      包含 Plus 的所有功能,并额外提供:
      • 可使用 GPT-5.3-Codex-Spark(研究预览版),这是一款适用于日常编程任务的快速 Codex 模型
      • Codex 用量是 Plus 的 5 倍或 20 倍*
      • 每月 $200 的档位可无限使用 ChatGPT 语音;任务仍会消耗您的 Codex 用量预算
      • Pro 套餐包含的其他 ChatGPT 功能
      *详细了解两个档位的限制。

      API 密钥

      非常适合在 CI 等共享环境中实现自动化。

      • 可在 CLI、SDK 或 IDE 扩展中使用 Codex
      • 不提供云端功能(如 GitHub 代码审查、Slack 等)
      • 可用模型取决于您的密钥能够访问哪些 API 模型
      • API 定价计费,仅为 Codex 使用的 Token 付费

      邀请朋友和同事

      符合条件的用户可以通过应用左下角的个人资料菜单发送 Codex 邀请。 如果您使用的是符合条件的个人方案,请选择 邀请朋友 ; 如果您使用的是符合条件的 Business 工作空间,请选择 邀请同事 。 然后输入收件人的电子邮件地址并发送邀请。

      邀请对话框会显示当前奖励、受邀人资格要求、邀请上限,以及您所用方案或推广活动的奖励到期时间。个人推荐计划和 Business 推荐计划采用各自的奖励和资格规则。ChatGPT Enterprise 目前不支持推荐。

      2026 年 6 月 11 日至 6 月 24 日,符合条件的 Plus 和 Pro 用户最多可邀请 三位朋友。符合条件的受邀人发送第一条 Codex 消息后,双方 均会获得一次可留待以后使用的速率限制重置机会。该重置机会自发放之日起 30 天内有效。Business 推荐计划另行提供共享工作空间 额度奖励;请先查看 现行条款,再发送 邀请。

      常见问题

      站点的费用是多少?

      公开测试期间,符合条件的 ChatGPT 方案均包含站点。 是否可用取决于您的方案、所在地区和工作空间设置。

      我的方案有哪些使用限额?

      您可以发送的消息数量取决于所用模型、任务的规模和复杂程度,以及任务是在本地还是云端运行。小型脚本或常规函数可能只会消耗一小部分使用配额,而较大的项目、长时间运行的任务,或需要智能体保留更多上下文的长时间会话,每条消息消耗的配额则会明显更多。

      看似相似的任务可能会消耗不同数量的使用配额。模型选择、上下文、推理、工具使用、检索和缓存都会影响用量,因此仅凭提示长度无法可靠估算用量。

      选择最适合您工作的 GPT-5.6 模型:

      • Sol 专为最棘手的工作而设计,包括复杂推理、界定不清的问题、 高级编程和事关重大的决策。
      • Terra 是日常工作的主力模型,适用于生产环境任务、报告编制、 文档分析、编程和需要良好判断力的工作。
      • Luna 针对需要快速、大批量处理的工作进行了优化,例如路由、 分类、提取、支持、后台自动化, 以及目标明确的编程任务。

      以下估算值为每个五小时窗口内可发送的本地消息数量。ChatGPT 方案中的云端聊天使用 GPT-5.6 Sol,消耗的使用配额可能多于本地消息。

      模型

      Plus

      Pro 5x

      Pro 20x

      Business

      API 密钥

      GPT-5.6 Sol 10-100 50-500 200-2,000 10-100

      按用量计费

      GPT-5.6 Terra 25-200 125-1,000 500-4,000 25-200

      按用量计费

      GPT-5.6 Luna 250-2,000 1,250-10,000 5,000-40,000 250-2,000

      按用量计费

      GPT-5.5 15-80 75-400 300-1,600 15-80

      按用量计费

      GPT-5.4 20-100 100-500 400-2,000 20-100

      按用量计费

      GPT-5.4 mini 60-350 300-1,750 1,200-7,000 60-350

      按用量计费

      在 ChatGPT 方案中,本地消息和云端聊天共用一个 五小时 窗口。此外还可能设有每周限额。

      对于采用灵活定价的 Enterprise/Edu 用户,不设固定的速率限制; 可用量随额度增加。

      未采用灵活定价的 Enterprise 和 Edu 方案,在大多数功能上的每席位使用限额与 Plus 相同。

      其他智能体功能的定价生效后,其用量将计入同一使用限额。 目前适用的功能包括 Plus 和 Pro 方案中的 ChatGPT for Excel

      速度配置会增加所有适用模型的额度消耗,因此 也会加快方案内使用配额的消耗。对于支持的模型,快速模式的额度消耗 按更高费率计算。有关支持的模型和费率,请参阅速度。 图像生成消耗方案内使用配额的速度平均也会快约 3-5 倍, 具体取决于图像质量和尺寸。GPT-5.3-Codex-Spark 的研究预览 仅向 ChatGPT Pro 用户开放,推出时不支持通过 API 使用。由于该模型 在专用低延迟硬件上运行,因此有单独的使用限额, 该限额可能根据需求调整。

      桌面版 ChatGPT 语音

      桌面版 ChatGPT 语音使用独立的配额,具体配额取决于您的方案,并按五小时滚动窗口计算。通过语音发起的任务会消耗您现有的 Codex 使用配额。达到任一限额时,ChatGPT 都会通知您。

      桌面版 ChatGPT 语音采用双工模型:GPT-Live 负责实时对话,而 GPT-5.6 Terra 负责在应用中启动和协调任务。

      • Plus: 约 15–30 分钟
      • Pro 5x(每月 $100): 约 1–2.5 小时
      • Pro 20x(每月 $200): 无限使用语音
      • Business: 约 45 分钟
      • Enterprise / Edu(旧版): 约 45 分钟

      无限使用语音并不意味着 Codex 任务也不受限。通过 ChatGPT 语音发起的任务仍会消耗您现有的 Codex 使用配额。

      对于采用额度计费或按量付费的 Business、Edu 和 Enterprise 工作空间,桌面版语音每分钟约消耗 6 点额度。目前无法通过 API 密钥使用桌面版 ChatGPT 语音。

      达到使用限额后会怎样?

      我们希望您能够完成正在进行的工作。如果您在当前轮次尚未结束时达到使用限额,智能体仍可继续处理该轮次,但须遵守合理使用限制。

      达到使用限额后,ChatGPT Plus 和 Pro 用户可以购买额外额度以继续工作,无需升级现有方案。

      采用灵活 定价的 Business、Edu 和 Enterprise 方案 可以购买额外的工作空间额度,以继续工作。

      如果您接近使用限额,也可以切换到较小的模型,让使用配额用得更久。

      所有用户还可以使用 API 密钥发起额外的本地聊天,相关用量按 标准 API 费率计费。

      图像生成如何计入用量限制?

      图像生成与本地 消息和云端聊天共用总体用量限制。图像生成消耗方案所含用量的速度,平均是 不生成图像的类似轮次的 3-5 倍,具体取决于 图像质量和尺寸。达到方案所含用量限制后,图像生成 也会消耗额度

      免费方案不提供图像生成功能。通过 API 密钥使用 Codex 时,图像生成按 API 定价计费,而不计入 ChatGPT 方案所含用量限制。

      在哪里可以查看当前的用量限制?

      您可以在用量 仪表板中查看当前的用量限制。如果想在正在进行的 Codex CLI 会话中查看剩余可用量,可以使用 /status

      每一到两周查看一次仪表板,了解您的用量消耗速度和剩余可用量。如果用量高于预期,请考虑改用较小的模型或缩小任务范围,看看是否仍能获得有用的结果。

      Token 和额度是什么?

      Token 是 ChatGPT 读取和写入的小块信息。您的提示、文件、聊天记录、工具结果以及 ChatGPT 的回复都会使用 Token。

      额度将 Token 用量换算为更简单的计量单位,便于跟踪和管理消耗。额度消耗因模型、上下文、推理和工具而异。达到方案所含用量限制后,您可以使用可用额度继续工作。

      用量按每百万输入 Token、缓存输入 Token 和输出 Token 所消耗的额度计算。详细了解 Token

      下方的费率表列出了各模型和功能每百万 Token 所消耗的额度。

      少数企业客户应继续使用旧版费率表, 直到我们为您切换到新的按 Token 计价方案。如需了解更多信息, 请联系 OpenAI 销售团队

      每 1M Token 消耗的额度

      输入 Token

      缓存输入 Token

      输出 Token

      GPT-5.6 Sol 100 点额度 10 点额度 500 点额度
      Daybreak Blue 100 点额度 10 点额度 500 点额度
      Daybreak Red 312.5 点额度 31.25 点额度 1875 点额度
      GPT-5.6 Terra 50 点额度 5 点额度 300 点额度
      GPT-5.6 Luna 5 点额度 0.5 点额度 30 点额度
      GPT-5.5 125 点额度 12.50 点额度 750 点额度
      GPT-5.4 62.50 点额度 6.250 点额度 375 点额度
      GPT-5.4 mini 18.75 点额度 1.875 点额度 113 点额度
      GPT-5.3-Codex-Spark

      研究预览版

      GPT-Image-2(图像) 200 点额度 50 点额度 750 点额度
      GPT-Image-2(文本) 125 点额度 31.25 点额度 250 点额度

      使用 GPT-5.6 时,每条消息平均消耗 5-30 点额度。

      对于支持的模型,快速模式会以更高的费率消耗额度。具体费率请参阅 速度

      使用 Daybreak 需通过 Trusted Access for Cyber 审批。 Daybreak Blue 采用 GPT-5.6 Sol 的额度费率。Daybreak Red 需要 单独审批和开通。

      GPT-5.6 Sol 的优惠定价至少持续至 2026 年 11 月 21 日。

      速度配置会增加所有适用模型的额度消耗。 对于支持的模型,快速模式会以更高的费率消耗额度。支持的模型及费率请参阅 速度

      详细了解 ChatGPT Plus 和 Pro 的额度。

      详细了解 ChatGPT Business、企业和 Edu 方案的额度。

      哪些操作计入代码审查用量?

      仅当 Codex 通过 GitHub 执行审查时,才会计入代码审查用量。例如, 在 Pull Request 中标记 @Codex 请求审查,或为代码仓库启用自动 审查。在本地或 GitHub 之外执行的审查会计入 您的总体用量限制。

      如何让可用量用得更久?

      上述用量限制和额度消耗均为平均值。您可以尝试以下方法,充分利用用量限额:

      • 控制提示的长度。 给智能体的指令要明确具体, 同时删除不必要的上下文。
      • 限制参考资料的范围。 仅提供相关文件,并尽可能 缩小资料来源或日期范围。
      • 让输出符合实际需求。 明确目标受众、输出格式和篇幅, 并将必要工作与可选改进区分开来。
      • 精简 AGENTS.md。 如果您正在处理较大的项目, 可以通过在代码仓库中分层 放置 AGENTS.md 文件,控制引入的上下文量。
      • 限制所用 MCP 服务器的数量。 每个 MCP 服务器都会增加消息的上下文,从而消耗 更多可用量。不需要时,请禁用 MCP 服务器。
      • 处理日常任务时切换到较小的模型。 改用 GPT-5.6 Terra 或 GPT-5.6 Luna 可以让您的本地消息可用量用得更久,具体取决于 您原先使用的模型。

      如需了解如何选择任务及界定任务范围,请参阅高效使用 Work

      功能可用性

      * 该功能目前仅在特定地区可用。请查阅 相应功能的文档,了解地区限制的详情。

      部分第一方插件不可用。