For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal

Modelos de OpenAI en Amazon Bedrock

Comprende la disponibilidad, las funciones disponibles y las diferencias de despliegue de los modelos de OpenAI ofrecidos a través de AWS.

Amazon Bedrock ejecuta modelos compatibles de OpenAI en infraestructura administrada por AWS. Usa esta guía para comparar la compatibilidad con las funciones de la API de OpenAI y conectarte con el SDK de OpenAI. Para configurar el despliegue, consulta la documentación de AWS enlazada en esta página.

Las capacidades del modelo y la compatibilidad con la API determinan lo que puede hacer tu aplicación. AWS administra el acceso a los modelos, la disponibilidad regional, el enrutamiento, la facturación y los controles operativos de tu despliegue de Bedrock.

Cómo funciona la disponibilidad en Bedrock

Los modelos de OpenAI están disponibles a través de dos puntos de acceso de Amazon Bedrock: bedrock-runtime y bedrock-mantle. Ambos admiten la API Responses y la API para completar chats, compatibles con OpenAI, para los modelos admitidos, pero las funciones que ofrecen son diferentes.

Elige el punto de acceso según las capacidades que necesite tu aplicación. Por ejemplo, la búsqueda web alojada actualmente requiere Mantle. Consulta las diferencias entre puntos de acceso en esta página y la comparación de puntos de acceso de AWS para conocer las capacidades específicas de Bedrock y elegir un punto de acceso.

GPT-6 Astra está disponible a través de Bedrock Runtime y de Mantle en us-west-2 (Oregón). Los ejemplos de esta guía usan GPT-5.6 Sol en us-east-2; selecciona la región compatible con Astra antes de cambiar el modelo.

Para obtener información sobre el acceso y la configuración, consulta el anuncio de GPT-6 Astra y las instrucciones del punto de acceso de Runtime de AWS.

Realizar solicitudes a la API Responses

Estos ejemplos usan el SDK de OpenAI con el punto de acceso de Mantle. Selecciona la región de AWS y el ID del modelo para tu despliegue:

  • Las bibliotecas cliente con un proveedor de Bedrock obtienen una URL base regional de Mantle a partir de la región de AWS. Los proveedores de JavaScript, Python, Go y Java usan https://bedrock-mantle.us-east-2.api.aws/openai/v1 para los ejemplos de esta guía en us-east-2. Los ejemplos de Ruby configuran directamente este punto de acceso /openai/v1 porque la ruta predeterminada /v1 del proveedor no es compatible con este modelo.
  • Usa un ID de modelo de Bedrock con el prefijo openai., como openai.gpt-5.6-sol.

Los ejemplos usan openai.gpt-5.6-sol en us-east-2. Para Runtime, sigue las instrucciones del punto de acceso de la API Responses de AWS para seleccionar la URL base y el perfil de inferencia. No reutilices un ID de modelo de Mantle sin verificar los requisitos de Runtime.

El siguiente ejemplo usa una clave de API de Bedrock almacenada como AWS_BEARER_TOKEN_BEDROCK. Consulta Claves de API de Amazon Bedrock para obtener información sobre cómo generar y usar una clave de API de Bedrock.

Instala el proveedor opcional de Bedrock para Java antes de usar cualquiera de los dos ejemplos de Java:

<dependency>
  <groupId>com.openai</groupId>
  <artifactId>openai-java-bedrock</artifactId>
  <version>4.57.0</version>
</dependency>
Enviar una solicitud a la API Responses a través de Amazon Bedrock
import OpenAI from "openai";
import { bedrock } from "openai/providers/bedrock";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    apiKey: process.env.AWS_BEARER_TOKEN_BEDROCK,
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

Para aplicaciones de larga duración, usa preferentemente la cadena de credenciales estándar de AWS en lugar de un token de portador estático. Los proveedores de los SDK de JavaScript, Python, Go, Java y Ruby obtienen credenciales actualizadas de AWS y firman cada intento de solicitud con SigV4. La cadena puede incluir credenciales configuradas con aws login, perfiles compartidos, roles de cargas de trabajo y credenciales de instancias o contenedores.

Instala las dependencias opcionales de los ejemplos de la cadena de credenciales de AWS antes de usar esta opción:

npm install @aws-sdk/credential-provider-node @smithy/hash-node @smithy/signature-v4
pip install 'openai[bedrock]'
go get github.com/openai/openai-go/v3/bedrock
bundle add aws-sdk-core

Actualmente, el SDK de .NET no ofrece un proveedor equivalente de Bedrock ni una política de autenticación SigV4 de AWS. Usa una clave de API de Bedrock con .NET o envía una solicitud HTTP firmada a través de un cliente compatible con AWS cuando tu aplicación requiera la cadena de credenciales de AWS.

Enviar una solicitud con credenciales de Bedrock administradas por AWS
import OpenAI from "openai";
import { defaultProvider } from "@aws-sdk/credential-provider-node";
import { bedrock } from "openai/providers/bedrock/aws";

const client = new OpenAI({
  provider: bedrock({
    region: "us-east-2",
    endpoint: "mantle",
    credentialProvider: defaultProvider(),
  }),
});

const response = await client.responses.create({
  model: "openai.gpt-5.6-sol",
  input: "Write a haiku about cloud infrastructure.",
});

console.log(response.output_text);

Disponibilidad de funciones de la API Responses

Usa esta matriz para identificar las diferencias respecto de la API de OpenAI. La disponibilidad depende del modelo y del punto de acceso; la compatibilidad con una API no implica que se admitan todas las herramientas o todos los modos de respuesta.

CapacidadAPI de OpenAIAmazon Bedrock
Generación de textoDisponibleDisponible
Entrada de imágenesDisponibleDisponible
Entrada de archivosDisponibleDisponible
Resultados estructuradosDisponibleDisponible
Llamada a funcionesDisponibleDisponible
Llamada asíncrona a herramientasDisponible en modelos compatiblesNo disponible
Respuestas con transmisión continuaDisponibleDisponible
Conexiones WebSocketDisponibleNo disponible
Orientación durante el turnoDisponible en modelos compatiblesNo disponible
Ventana de contextoDepende del modeloDepende del modelo
Esfuerzo de razonamientoDisponibleDisponible
Actualizaciones de razonamientoDisponible en los modelos compatiblesNo disponible
Modo ProDisponible en los modelos compatiblesNo disponible
Razonamiento persistenteDisponible en los modelos compatiblesDisponible en los modelos compatibles
Almacenamiento de prompts en cachéDisponibleDisponible
Llamada programática a herramientasDisponible en los modelos compatiblesNo disponible
MultiagenteEn beta en los modelos compatiblesNo disponible
Herramientas personalizadasDisponibleDisponible
tool_search del lado del clienteDisponibleDisponible
Búsqueda web alojadaDisponibleSolo en Mantle
Búsqueda de archivos alojadaDisponibleNo disponible
Uso de la computadoraDisponibleDisponible
Herramienta de shellDisponibleNo disponible
Herramienta de generación de imágenesDisponibleNo disponible
Servidores MCP remotosDisponibleNo disponible

Las llamadas asíncronas a herramientas (async: true) y las actualizaciones de razonamiento (elementos de entrada configuration_update) no son compatibles con Amazon Bedrock. La orientación durante el turno requiere WebSockets y no está disponible a través de ninguno de los dos puntos de acceso de Bedrock.

La función tool_search del lado del cliente es distinta de las herramientas alojadas y de la compatibilidad con servidores MCP remotos. La búsqueda web alojada está disponible a través de Mantle; la búsqueda de archivos alojada y los servidores MCP remotos no están disponibles.

El uso de la computadora está disponible en Runtime y Mantle para los modelos compatibles. Tu aplicación ejecuta acciones en la computadora y devuelve los resultados al modelo; esta capacidad no requiere un entorno de ejecución alojado en Bedrock.

En Amazon Bedrock, GPT-5.4 y GPT-5.5 admiten una ventana de contexto de 1 millón de tokens; GPT-5.6 Sol, Terra, Luna y GPT-6 Astra admiten 1 050 000 tokens. Consulta las tarjetas de los modelos de OpenAI en AWS para conocer los límites específicos de cada modelo.

Diferencias entre puntos de acceso

Estas diferencias de la API Responses se aplican al elegir entre Runtime y Mantle:

CapacidadBedrock RuntimeMantle
GPT-6 AstraDisponibleDisponible en us-west-2 (Oregón)
Uso de la computadoraDisponible en los modelos compatiblesDisponible en los modelos compatibles
Respuestas con transmisión continuaDisponibleDisponible
Modo en segundo plano (background: true)No disponibleDisponible, sujeto a la configuración de retención de datos
Búsqueda web alojadaNo disponibleDisponible en modelos compatibles
Continuar con previous_response_idIncluye model en cada solicitudEl modelo puede heredarse de la respuesta anterior

Runtime requiere model incluso cuando proporcionas previous_response_id. El modo en segundo plano es independiente de la transmisión continua y no se refiere a las llamadas asíncronas a funciones. Consulta la documentación de la API Responses de AWS para conocer el contrato completo del punto de acceso. Para los permisos y la configuración de la búsqueda web, consulta la guía de búsqueda web de AWS.

Disponibilidad y operaciones

AWS administra las opciones de implementación y la disponibilidad de Amazon Bedrock. Usa estas referencias para seleccionar y configurar tu implementación:

Aspecto administrado por AWSDocumentación de AWS
ID de modelos y API compatiblesTarjetas de los modelos de OpenAI
Disponibilidad de modelos y puntos de acceso por región de AWSDisponibilidad de modelos y disponibilidad de puntos de acceso
Enrutamiento geográfico y global de solicitudesInferencia entre regiones
Cuotas de la cuenta y solicitudes de aumentoCuotas de Amazon Bedrock

Una región de AWS no es una jurisdicción de residencia de datos de OpenAI. Si tu carga de trabajo tiene requisitos de ubicación, revisa las regiones de destino de tu perfil de inferencia y los términos aplicables de AWS, no solo la región en la URL de tu punto de acceso.

Acceso y retención de datos

Amazon Bedrock usa controles separados para el acceso de los operadores y la retención de datos:

  • Acceso cero de operadores (ZOA) significa que los operadores de AWS no tienen ningún mecanismo técnico para iniciar sesión en los sistemas de cómputo subyacentes de Mantle ni acceder a los datos de los clientes que se encuentran allí. Consulta el diseño de ZOA de AWS.
  • Retención cero de datos (ZDR) significa que AWS no escribe datos de solicitudes ni de respuestas en almacenamiento duradero cuando el modo de retención efectivo es none.

Establecer store: false no garantiza ZDR. Para las solicitudes a la API Responses con un modo de retención efectivo de none, AWS rechaza store: true y el modo en segundo plano no está disponible.

Para los modelos de OpenAI en Amazon Bedrock, AWS no comparte el contenido de las solicitudes ni de las respuestas con OpenAI cuando el modo de retención efectivo es default o none. Consulta la documentación sobre retención de datos de AWS para conocer los modos disponibles, los requisitos de elegibilidad y la configuración de la cuenta o del proyecto. Consulta la detección de abuso de Amazon Bedrock para conocer los requisitos y las excepciones de retención específicos de cada modelo.

Si AWS detecta aparente MASI en una imagen de entrada, puede trasladar la entrada o salida marcada fuera del entorno ZOA y almacenarla y revisarla únicamente para determinar si se trata de MASI. AWS también puede presentar un informe ante las autoridades nacionales.

Autenticación y operaciones

Tu administrador de AWS controla el acceso a la cuenta, los modelos y las funciones. Consulta la documentación sobre claves de API de AWS para la creación y el ciclo de vida de las credenciales, y la documentación de IAM para las identidades y los permisos. Los ejemplos del SDK de OpenAI en esta página muestran cómo proporcionar esas credenciales; no configuran los permisos de AWS.

Precios

El uso de Amazon Bedrock se factura a través de AWS. Los precios de Bedrock en las regiones comerciales coinciden con los precios directos de OpenAI para servicios equivalentes. Ten en cuenta que usar un servicio específico de una región en Bedrock tendrá la misma tarifa que el procesamiento regional en la API de OpenAI. Los términos comerciales de Amazon se aplican al uso de Bedrock.

Consulta los precios de la API para conocer los precios directos de la API de OpenAI. Para conocer las tarifas de Bedrock, los niveles de servicio compatibles y las opciones de facturación, consulta los precios de Amazon Bedrock y la tarjeta del modelo correspondiente.

Próximos pasos

Para la configuración en ChatGPT Work y Codex, consulta Usa ChatGPT Work y Codex con Amazon Bedrock.