For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

Amazon Bedrock 中的 OpenAI 模型

了解通过 AWS 提供的 OpenAI 模型的可用范围、功能覆盖情况和部署差异。

Amazon Bedrock 在 AWS 管理的基础设施上运行其支持的 OpenAI 模型。 您可以通过本指南比较 OpenAI API 功能支持情况, 并使用 OpenAI SDK 进行连接。有关部署配置,请参阅本页链接的 AWS 文档

模型能力和 API 兼容性决定了您的应用能实现哪些功能。 AWS 负责管理 Bedrock 部署的模型访问、区域可用性、路由、计费和 运维控制措施。

Bedrock 可用范围说明

您可以通过两个 Amazon Bedrock 端点访问 OpenAI 模型: bedrock-runtimebedrock-mantle。对于受支持的模型,两个端点都提供兼容 OpenAI 的 Responses API 和 Chat Completions API,但功能 覆盖范围有所不同。

请根据您的应用所需的能力选择端点。 例如,托管式网页搜索目前需要使用 Mantle。有关 Bedrock 特有的能力和端点选择,请参阅 本页的端点差异以及 AWS 的端点比较

GPT-6 Astra 可通过 Bedrock Runtime 使用,也可通过 us-west-2(俄勒冈)的 Mantle 使用。本指南中的示例在 us-east-2 中使用 GPT-5.6 Sol;更换模型前,请先选择 Astra 支持的区域。

有关访问和设置,请参阅 AWS 的 GPT-6 Astra 公告Runtime 端点说明

发送 Responses API 请求

这些示例使用 OpenAI SDK 连接 Mantle 端点。请为您的部署选择 AWS 区域和模型 ID:

  • 带有 Bedrock 提供程序的客户端库会根据 AWS 区域 确定该区域的 Mantle 基础 URL。在本指南的示例中,JavaScript、Python、Go 和 Java 提供程序使用 https://bedrock-mantle.us-east-2.api.aws/openai/v1,对应的区域为 us-east-2。Ruby 示例直接配置此 /openai/v1 端点,因为提供程序默认的 /v1 路由 不支持此模型。
  • 请使用带有 openai. 前缀的 Bedrock 模型 ID,例如 openai.gpt-5.6-sol

这些示例在 us-east-2 中使用 openai.gpt-5.6-sol。对于 Runtime,请按照 AWS 的 Responses API 端点说明选择基础 URL 和推理配置方案。请先检查 Runtime 的要求, 再决定是否复用 Mantle 模型 ID。

以下示例使用存储在 AWS_BEARER_TOKEN_BEDROCK 中的 Bedrock API 密钥。有关生成和使用 Bedrock API 密钥的信息,请参阅 Amazon Bedrock API 密钥

在使用任一 Java 示例之前,请先安装可选的 Java Bedrock 提供程序:

<dependency>
  <groupId>com.openai</groupId>
  <artifactId>openai-java-bedrock</artifactId>
  <version>4.57.0</version>
</dependency>
通过 Amazon Bedrock 发送 Responses API 请求
import OpenAI from "openai";
import { bedrock } from "openai/providers/bedrock";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    apiKey: process.env.AWS_BEARER_TOKEN_BEDROCK,
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

对于长时间运行的应用,建议优先使用标准 AWS 凭证链, 而非静态持有者令牌。JavaScript、Python、Go、Java 和 Ruby SDK 提供程序会获取最新的 AWS 凭证,并使用 SigV4 对每次请求尝试进行签名。凭证链可以包含通过 aws login 配置的凭证、共享 配置方案、工作负载角色,以及实例或容器凭证。

使用此方式之前,请先安装 AWS 凭证链示例所需的 可选依赖项:

npm install @aws-sdk/credential-provider-node @smithy/hash-node @smithy/signature-v4
pip install 'openai[bedrock]'
go get github.com/openai/openai-go/v3/bedrock
bundle add aws-sdk-core

.NET SDK 目前尚未提供同等的 Bedrock 提供程序或 AWS SigV4 身份验证策略。使用 .NET 时,请使用 Bedrock API 密钥;如果您的应用需要 AWS 凭证链,请通过 AWS 支持的客户端发送 已签名的 HTTP 请求。

使用 AWS 管理的 Bedrock 凭证发送请求
import OpenAI from "openai";
import { defaultProvider } from "@aws-sdk/credential-provider-node";
import { bedrock } from "openai/providers/bedrock/aws";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    endpoint: "mantle",
    credentialProvider: defaultProvider(),
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

Responses API 功能可用性

您可以通过此对照表了解与 OpenAI API 的差异。功能是否可用取决于 具体的模型和端点;支持某个 API 并不意味着支持 所有工具或响应模式。

能力OpenAI APIAmazon Bedrock
文本生成可用可用
图像输入可用可用
文件输入可用可用
结构化输出可用可用
函数调用可用可用
异步工具调用在受支持的模型上可用不可用
流式响应可用可用
WebSocket 连接可用不可用
轮次中途引导在受支持的模型上可用不可用
上下文窗口取决于模型取决于模型
推理强度可用可用
推理更新支持的模型可用不可用
Pro 模式支持的模型可用不可用
推理持久化支持的模型可用支持的模型可用
提示缓存可用可用
程序化工具调用支持的模型可用不可用
多智能体支持的模型提供测试版不可用
自定义工具可用可用
客户端 tool_search可用可用
托管式网页搜索可用仅 Mantle 可用
托管式文件搜索可用不可用
计算机使用可用可用
Shell 工具可用不可用
图像生成工具可用不可用
远程 MCP 服务器可用不可用

Amazon Bedrock 不支持异步工具调用(async: true)和推理更新 (configuration_update 输入项)。 轮次中途引导需要 WebSocket,两个 Bedrock 端点 均不提供此功能。

客户端 tool_search 与托管式工具及远程 MCP 服务器支持 有所区别。Mantle 提供托管式网页搜索;托管式文件搜索和 远程 MCP 服务器不可用。

对于支持的模型,Runtime 和 Mantle 均提供计算机使用功能。您的应用程序执行计算机操作并将结果返回给模型;此功能不需要由 Bedrock 托管的执行环境。

在 Amazon Bedrock 上,GPT-5.4 和 GPT-5.5 支持 100 万 Token 的上下文窗口; GPT-5.6 Sol、Terra、Luna 和 GPT-6 Astra 支持 1,050,000 个 Token。有关各模型的具体限制,请查看 AWS 的 OpenAI 模型卡

端点差异

在 Runtime 和 Mantle 之间选择时,请考虑以下 Responses API 差异:

功能Bedrock RuntimeMantle
GPT-6 Astra可用us-west-2(俄勒冈)可用
计算机使用支持的模型可用支持的模型可用
流式响应可用可用
后台模式(background: true不可用可用,受数据保留设置限制
托管式网页搜索不可用在支持的模型上可用
使用 previous_response_id 继续对话每次请求都需包含 model可沿用上一次响应所用的模型

即使您提供了 previous_response_id,Runtime 仍要求提供 model。 后台模式与流式传输是不同的功能,也不代表异步函数调用。 有关完整的端点规范,请参阅 AWS Responses API 文档。有关网页搜索的权限和配置, 请参阅 AWS 网页搜索指南

可用性与运营

Amazon Bedrock 的部署选项和可用性由 AWS 维护。请参阅以下资料,选择并配置您的部署:

由 AWS 管理的事项AWS 文档
模型 ID 和支持的 APIOpenAI 模型卡
各 AWS 区域的模型和端点可用性模型可用性端点可用性
地理范围内和全球范围内的请求路由跨区域推理
账户配额及配额提升申请Amazon Bedrock 配额

AWS 区域并不等同于 OpenAI 数据驻留司法管辖区。如果您的工作负载有位置要求,请查看推理配置方案的目标区域及适用的 AWS 条款,而不只是端点 URL 中的区域。

数据访问与保留

Amazon Bedrock 对运维人员访问和数据保留采用各自独立的控制措施:

  • 零运维人员访问(ZOA) 意味着 AWS 运维人员没有任何技术途径 登录 Mantle 的底层计算系统或访问其中的客户数据。 请参阅 AWS ZOA 设计
  • 零数据保留(ZDR) 意味着当实际生效的保留模式为 none 时, AWS 不会将请求或响应数据写入持久存储。

设置 store: false 并不能保证 ZDR。 对于实际生效的保留模式为 none 的 Responses API 请求,AWS 会拒绝 store: true, 且后台模式不可用。

对于 Amazon Bedrock 中的 OpenAI 模型, 当实际生效的保留模式为 defaultnone 时,AWS 不会与 OpenAI 共享请求或响应内容。 有关可用模式、使用资格以及账户或项目配置,请参阅 AWS 数据保留文档。有关特定模型的保留要求和例外情况,请参阅 Amazon Bedrock 滥用检测

如果 AWS 在图像输入中检测到疑似 CSAM,AWS 可能会将标记的输入或输出移至 ZOA 环境之外,并对其进行存储和审查,仅用于判定其是否为 CSAM。AWS 也可能向国家主管机关提交报告。

身份验证与运营

您的 AWS 管理员控制账户、模型和功能的访问权限。有关凭证的创建和生命周期,请参阅 AWS API 密钥文档;有关身份和权限,请参阅 IAM 文档。本页中的 OpenAI SDK 示例展示了如何提供这些凭证; 这些示例不会配置 AWS 权限。

定价

Amazon Bedrock 的使用费用通过 AWS 计费。在商业区域中,Bedrock 的定价与 OpenAI 直接提供的同等服务定价一致。请注意,在 Bedrock 中使用特定区域的服务,将按与 OpenAI API 区域处理相同的费率计费。使用 Bedrock 须遵守 Amazon 商业条款。

有关直接使用 OpenAI API 的定价,请参阅 API 定价。 有关 Bedrock 的费率、支持的服务层级和计费选项,请参阅 Amazon Bedrock 定价及适用的模型卡。

后续步骤

有关在 ChatGPT Work 和 Codex 中进行设置的说明,请参阅 将 ChatGPT Work 和 Codex 与 Amazon Bedrock 配合使用