For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

后台模式

在后台异步执行耗时较长的任务。

Codex深度研究等智能体表明,推理模型可能需要数分钟才能解决复杂问题。后台模式让您能够使用 GPT-5.2 和 GPT-5.2 Pro 等模型可靠地执行耗时较长的任务,无需担心超时或其他连接问题。

后台模式会异步启动这些任务,开发者可以轮询响应对象,持续查看状态。要在后台生成响应,请发起 API 请求,并将 background 设置为 true

零数据保留(ZDR)项目的后台请求以 store=false 运行。响应数据会临时存储在磁盘上约 10 分钟, 以支持异步执行和轮询。

对于使用调整后的滥用 监控的项目,包括 使用增强型调整后滥用监控的项目,如果省略 store 或将其设置为 true,前台请求会遵循标准的 保留规则。只有显式提供 store=true,后台响应才会在 轮询期结束后继续保留。 如果后台请求省略了 store 或将其设置为 false,响应 会在约 10 分钟后被删除。

在后台生成响应
from openai import OpenAI

client = OpenAI()

resp = client.responses.create(
    model="gpt-6-astra",
    input="Write a very long novel about otters in space.",
    background=True,
)

print(resp.status)

轮询后台响应

要查看后台请求的状态,请使用 Responses 的 GET 端点。当请求处于 queued 或 in_progress 状态时,请持续轮询。当请求离开这些状态时,就表示已进入最终状态(终态)。

获取正在后台执行的响应
from openai import OpenAI
from time import sleep

client = OpenAI()

resp = client.responses.create(
    model="gpt-6-astra",
    input="Write a very long novel about otters in space.",
    background=True,
)

while resp.status in {"queued", "in_progress"}:
    print(f"Current status: {resp.status}")
    sleep(2)
    resp = client.responses.retrieve(resp.id)

print(f"Final status: {resp.status}\nOutput:\n{resp.output_text}")

取消后台响应

您也可以按以下方式取消正在处理的响应:

取消正在处理的响应
import os

from openai import OpenAI

response_id = os.environ["OPENAI_RESPONSE_ID"]
client = OpenAI()

resp = client.responses.cancel(response_id)

print(resp.status)

重复取消是幂等的:后续调用只会返回最终的 Response 对象。

流式传输后台响应

您可以创建后台 Response,并立即开始流式接收其中的事件。如果您预计客户端可能断开流连接,并希望稍后能够恢复,这种方式可能会有帮助。为此,请创建一个 Response,并将 backgroundstream 都设置为 true。您需要持续记录一个“游标”,其值对应于每个流式事件中收到的 sequence_number

目前,接收后台响应的首个 Token 所需的时间 比同步响应更长。我们正在努力,争取在未来几周内 缩小这一延迟差距。

生成并流式传输后台响应
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
  "model": "gpt-6-astra",
  "input": "Write a very long novel about otters in space.",
  "background": true,
  "stream": true
}'

// To resume:
curl "https://api.openai.com/v1/responses/resp_123?stream=true&starting_after=42" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY"

限制

  1. 后台请求可以使用 store=false,但响应数据仍会临时存储, 以支持异步执行和轮询。
  2. 要取消同步响应,请终止连接
  3. 只有在创建后台响应时使用了 stream=true,您才能从该响应启动新的流。