For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal

Modelos da OpenAI no Amazon Bedrock

Entenda a disponibilidade, os recursos oferecidos e as diferenças de implantação dos modelos da OpenAI disponibilizados pela AWS.

O Amazon Bedrock executa os modelos compatíveis da OpenAI em infraestrutura gerenciada pela AWS. Use este guia para comparar o suporte a recursos da API da OpenAI e se conectar com o SDK da OpenAI. Para configurar a implantação, consulte a documentação da AWS indicada nesta página.

As capacidades dos modelos e a compatibilidade com a API determinam o que seu aplicativo pode fazer. A AWS gerencia o acesso aos modelos, a disponibilidade regional, o roteamento, o faturamento e os controles operacionais da sua implantação no Bedrock.

Como funciona a disponibilidade no Bedrock

Os modelos da OpenAI estão disponíveis por meio de dois endpoints do Amazon Bedrock: bedrock-runtime e bedrock-mantle. Ambos oferecem suporte às APIs Responses e Chat Completions compatíveis com a OpenAI nos modelos suportados, mas os recursos oferecidos são diferentes.

Escolha o endpoint de acordo com as capacidades de que seu aplicativo precisa. Por exemplo, a pesquisa na Web hospedada atualmente exige o Mantle. Consulte as diferenças entre endpoints nesta página e a comparação de endpoints da AWS para saber mais sobre as capacidades específicas do Bedrock e a escolha do endpoint.

O GPT-6 Astra está disponível por meio do Bedrock Runtime e do Mantle em us-west-2 (Oregon). Os exemplos deste guia usam o GPT-5.6 Sol em us-east-2; selecione a Região compatível com o Astra antes de trocar o modelo.

Para obter informações sobre acesso e configuração, consulte o anúncio do GPT-6 Astra e as instruções do endpoint Runtime da AWS.

Faça requisições à API Responses

Estes exemplos usam o SDK da OpenAI com o endpoint Mantle. Selecione a Região da AWS e o ID do modelo para sua implantação:

  • As bibliotecas cliente com um provedor Bedrock determinam a URL base regional do Mantle a partir da Região da AWS. Os provedores JavaScript, Python, Go e Java usam https://bedrock-mantle.us-east-2.api.aws/openai/v1 nos exemplos deste guia para us-east-2. Os exemplos em Ruby configuram o endpoint /openai/v1 diretamente porque a rota padrão /v1 do provedor não oferece suporte a esse modelo.
  • Use um ID de modelo do Bedrock com o prefixo openai., como openai.gpt-5.6-sol.

Os exemplos usam openai.gpt-5.6-sol em us-east-2. Para o Runtime, siga as instruções do endpoint da API Responses da AWS para selecionar a URL base e o perfil de inferência. Não reutilize um ID de modelo do Mantle sem verificar os requisitos do Runtime.

O exemplo a seguir usa uma chave de API do Bedrock armazenada como AWS_BEARER_TOKEN_BEDROCK. Consulte Chaves de API do Amazon Bedrock para obter informações sobre como gerar e usar uma chave de API do Bedrock.

Instale o provedor Bedrock opcional para Java antes de usar qualquer um dos exemplos em Java:

<dependency>
  <groupId>com.openai</groupId>
  <artifactId>openai-java-bedrock</artifactId>
  <version>4.57.0</version>
</dependency>
Envie uma requisição à API Responses por meio do Amazon Bedrock
import OpenAI from "openai";
import { bedrock } from "openai/providers/bedrock";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    apiKey: process.env.AWS_BEARER_TOKEN_BEDROCK,
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

Para aplicativos de longa duração, prefira a cadeia de credenciais padrão da AWS a um token bearer estático. Os provedores dos SDKs JavaScript, Python, Go, Java e Ruby obtêm credenciais atualizadas da AWS e assinam cada tentativa de requisição com SigV4. A cadeia pode incluir credenciais configuradas com aws login, perfis compartilhados, funções de cargas de trabalho e credenciais de instâncias ou contêineres.

Instale as dependências opcionais dos exemplos com a cadeia de credenciais da AWS antes de usar esta abordagem:

npm install @aws-sdk/credential-provider-node @smithy/hash-node @smithy/signature-v4
pip install 'openai[bedrock]'
go get github.com/openai/openai-go/v3/bedrock
bundle add aws-sdk-core

O SDK .NET atualmente não disponibiliza um provedor Bedrock equivalente nem uma política de autenticação AWS SigV4. Use uma chave de API do Bedrock com .NET ou envie uma requisição HTTP assinada por meio de um cliente com suporte da AWS quando seu aplicativo exigir a cadeia de credenciais da AWS.

Envie uma requisição com credenciais do Bedrock gerenciadas pela AWS
import OpenAI from "openai";
import { defaultProvider } from "@aws-sdk/credential-provider-node";
import { bedrock } from "openai/providers/bedrock/aws";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    endpoint: "mantle",
    credentialProvider: defaultProvider(),
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

Disponibilidade de recursos da API Responses

Use esta matriz para identificar diferenças em relação à API da OpenAI. A disponibilidade varia conforme o modelo e o endpoint; o suporte a uma API não implica suporte a todas as ferramentas ou modos de resposta.

CapacidadeAPI da OpenAIAmazon Bedrock
Geração de textoDisponívelDisponível
Entrada de imagensDisponívelDisponível
Entrada de arquivosDisponívelDisponível
Saídas estruturadasDisponívelDisponível
Chamada de funçãoDisponívelDisponível
Chamada assíncrona de ferramentasDisponível nos modelos compatíveisIndisponível
Respostas em streamingDisponívelDisponível
Conexões WebSocketDisponívelIndisponível
Orientação durante o turnoDisponível nos modelos compatíveisIndisponível
Janela de contextoDepende do modeloDepende do modelo
Esforço de raciocínioDisponívelDisponível
Atualizações de raciocínioDisponível nos modelos compatíveisNão disponível
Modo ProDisponível nos modelos compatíveisNão disponível
Raciocínio persistidoDisponível nos modelos compatíveisDisponível nos modelos compatíveis
Cache de promptsDisponívelDisponível
Chamada programática de ferramentasDisponível nos modelos compatíveisNão disponível
Múltiplos agentesBeta nos modelos compatíveisNão disponível
Ferramentas personalizadasDisponívelDisponível
tool_search no lado do clienteDisponívelDisponível
Pesquisa na Web hospedadaDisponívelSomente no Mantle
Pesquisa de arquivos hospedadaDisponívelNão disponível
Uso do computadorDisponívelDisponível
Ferramenta de shellDisponívelNão disponível
Ferramenta de geração de imagensDisponívelNão disponível
Servidores MCP remotosDisponívelNão disponível

O Amazon Bedrock não oferece suporte à chamada assíncrona de ferramentas (async: true) nem às atualizações de raciocínio (itens de entrada configuration_update). A orientação durante o turno exige WebSockets e não está disponível em nenhum dos dois endpoints do Bedrock.

O tool_search no lado do cliente é diferente do suporte a ferramentas hospedadas e a servidores MCP remotos. A pesquisa na Web hospedada está disponível pelo Mantle; a pesquisa de arquivos hospedada e os servidores MCP remotos não estão disponíveis.

O Uso do computador está disponível no Runtime e no Mantle para os modelos compatíveis. Seu aplicativo executa ações no computador e retorna os resultados ao modelo; esse recurso não exige um ambiente de execução hospedado no Bedrock.

No Amazon Bedrock, GPT-5.4 e GPT-5.5 oferecem suporte a uma janela de contexto de 1 milhão de tokens; GPT-5.6 Sol, Terra, Luna e GPT-6 Astra oferecem suporte a 1.050.000 tokens. Consulte os cartões dos modelos da OpenAI na documentação da AWS para ver os limites específicos de cada modelo.

Diferenças entre endpoints

Considere estas diferenças da API Responses ao escolher entre Runtime e Mantle:

RecursoBedrock RuntimeMantle
GPT-6 AstraDisponívelDisponível em us-west-2 (Oregon)
Uso do computadorDisponível nos modelos compatíveisDisponível nos modelos compatíveis
Respostas em streamingDisponívelDisponível
Modo em segundo plano (background: true)Não disponívelDisponível, sujeito às configurações de retenção de dados
Pesquisa na Web hospedadaNão disponívelDisponível nos modelos compatíveis
Continuação com previous_response_idInclua model em todas as solicitaçõesO modelo pode ser herdado da resposta anterior

O Runtime exige model mesmo quando você fornece previous_response_id. O modo em segundo plano é separado do streaming e não se refere à chamada assíncrona de funções. Consulte a documentação da API Responses da AWS para conhecer o contrato completo do endpoint. Para permissões e configuração de pesquisa na Web, consulte o guia de pesquisa na Web da AWS.

Disponibilidade e operações

A AWS mantém as opções de implantação e a disponibilidade do Amazon Bedrock. Use estas referências para selecionar e configurar sua implantação:

Aspecto gerenciado pela AWSDocumentação da AWS
IDs de modelos e APIs compatíveisCartões dos modelos da OpenAI
Disponibilidade de modelos e endpoints por região da AWSDisponibilidade de modelos e disponibilidade de endpoints
Roteamento geográfico e global de solicitaçõesInferência entre regiões
Cotas da conta e solicitações de aumentoCotas do Amazon Bedrock

Uma região da AWS não é uma jurisdição de residência de dados da OpenAI. Se sua carga de trabalho tiver requisitos de localização, confira as regiões de destino do seu perfil de inferência e os termos aplicáveis da AWS, não apenas a região na URL do endpoint.

Acesso e retenção de dados

O Amazon Bedrock usa controles separados para acesso de operadores e retenção de dados:

  • Zero acesso de operadores (ZOA) significa que os operadores da AWS não dispõem de nenhum mecanismo técnico para fazer login nos sistemas de computação que sustentam o Mantle ou acessar os dados de clientes nesses sistemas. Consulte a arquitetura de ZOA da AWS.
  • Zero retenção de dados (ZDR) significa que a AWS não grava dados de solicitações ou respostas em armazenamento durável quando o modo de retenção efetivo é none.

Definir store: false não garante ZDR. Para solicitações à API Responses com modo de retenção efetivo none, a AWS rejeita store: true, e o modo em segundo plano fica indisponível.

Para os modelos da OpenAI no Amazon Bedrock, a AWS não compartilha o conteúdo de solicitações ou respostas com a OpenAI quando o modo de retenção efetivo é default ou none. Consulte a documentação de retenção de dados da AWS para saber mais sobre os modos disponíveis, a elegibilidade e a configuração de contas ou projetos. Consulte Detecção de abuso no Amazon Bedrock para conhecer os requisitos de retenção e as exceções específicos de cada modelo.

Se a AWS detectar aparente CSAM em uma imagem de entrada, poderá mover a entrada ou saída sinalizada para fora do ambiente ZOA e armazená-la e analisá-la apenas para determinar se é CSAM. A AWS também poderá apresentar uma denúncia às autoridades nacionais.

Autenticação e operações

Seu administrador da AWS controla o acesso a contas, modelos e recursos. Consulte a documentação de chaves de API da AWS para saber mais sobre a criação e o ciclo de vida de credenciais, e a documentação do IAM para saber mais sobre identidades e permissões. Os exemplos do SDK da OpenAI nesta página mostram como fornecer essas credenciais; eles não configuram permissões da AWS.

Preços

O uso do Amazon Bedrock é cobrado pela AWS. Os preços do Bedrock nas regiões comerciais correspondem aos preços diretos da OpenAI para serviços equivalentes. O uso de um serviço específico de uma região no Bedrock será cobrado pela mesma tarifa do processamento regional na API da OpenAI. Os termos comerciais da Amazon se aplicam ao uso do Bedrock.

Consulte Preços da API para conhecer os preços diretos da API da OpenAI. Para saber as tarifas do Bedrock, os níveis de serviço compatíveis e as opções de cobrança, consulte Preços do Amazon Bedrock e o cartão do modelo aplicável.

Próximos passos

Para configurar o ChatGPT Work e o Codex, consulte Use o ChatGPT Work e o Codex com o Amazon Bedrock.