Registro de cambios
septiembre de 2026
Se agregaron controles de gobernanza para la creación de claves de API a nivel de organización y de proyecto. Los administradores pueden permitir únicamente claves de cuentas de servicio, permitir únicamente claves de proyecto propiedad de usuarios o deshabilitar por completo la creación de nuevas claves de API. Las restricciones de la organización tienen prioridad sobre la configuración del proyecto y no afectan a las claves de API existentes. Consulta las prácticas recomendadas para producción para obtener más detalles.
Ahora puedes establecer fechas de vencimiento al crear claves de API de proyecto. Los administradores también pueden imponer una vigencia máxima para las claves a nivel de organización o proyecto en la configuración de la plataforma, de modo que las claves nuevas deban vencer dentro del límite configurado. Consulta las prácticas recomendadas para producción para obtener orientación sobre el vencimiento y la rotación de claves.
Lanzamos la API de agentes en versión beta pública. Crea agentes con un arnés de ejecución administrado de Codex mientras OpenAI se encarga de la orquestación de sesiones, la compactación del contexto y la recuperación.
Usa sesiones duraderas para continuar el trabajo entre turnos, transmitir el progreso en tiempo real y conectar tus propias herramientas y servidores MCP. Ejecuta agentes en sandboxes alojados por OpenAI o conecta un sandbox de tu propia infraestructura o de un proveedor compatible.
Comienza con el inicio rápido de la API de agentes.
GPT-Live 1 ya está disponible de forma general en la API. Crea conversaciones de voz de dúplex completo que puedan continuar mientras un modelo o agente en el backend se encarga del razonamiento y las herramientas.
Usa la delegación mediante Responses con un modelo de OpenAI, o la delegación al cliente para conectar tu propio backend. Las sesiones de voz cuestan $0,05 por minuto y se facturan por segundo; el uso del modelo del backend y de las herramientas se cobra por separado.
Comienza con GPT-Live, el diseño de prompts y la guía de migración. Consulta los precios para obtener más detalles.
El diagnóstico de la caché de prompts ya está disponible de forma general en la API Responses para GPT-5.6 y los modelos posteriores compatibles.
Compara la reutilización de la caché con la de una respuesta anterior, identifica las causas de las fallas de caché y sigue las recomendaciones de solución de problemas para mejorar su reutilización.
Lanzamos GPT Image 2.5 Sunburst y GPT Image 2.5 Flare para generar y editar imágenes mediante la API de imágenes y la herramienta de generación de imágenes de la API Responses.
Usa Sunburst en flujos de trabajo donde la precisión de la edición sea lo más importante, o Flare para generar imágenes cotidianas de alta calidad con rapidez. Ambos modelos admiten las nuevas opciones de calidad xhigh y max y usan las tarifas por token de GPT Image 2. Consulta la guía de generación de imágenes y los precios.
GPT-Rosalind (gpt-rosalind-research) ya está disponible de forma general a través del programa de acceso de confianza para investigaciones internas aprobadas en ciencias de la vida.
Las tarifas estándar son de $5 por cada millón de tokens de entrada, $0,50 por cada millón de tokens de entrada en caché y $25 por cada millón de tokens de salida. La facturación comienza el 5 de octubre de 2026. Consulta los precios para obtener más detalles.
Lanzamos GPT-6 Astra, nuestro modelo más capaz, diseñado para realizar de principio a fin los trabajos más difíciles.
Usa GPT-6 Astra para tareas de razonamiento, programación, uso de la computadora, investigación y creación de documentos. Combina estas capacidades para llevar tareas complejas desde una solicitud inicial hasta un resultado terminado, con el contexto y las herramientas que proporciones.
Cambios clave que debes considerar al migrar:
- GPT-6 Astra no admite el nivel de esfuerzo de razonamiento
none. - GPT-6 Astra no admite valores personalizados de
temperatureotop_p, ni probabilidades logarítmicas (logprobs). - Las llamadas a herramientas requieren la API Responses. Si usas herramientas con Chat Completions, sigue la guía de migración a Responses.
- El monitoreo de desalineación comprueba de forma asíncrona si hay posibles problemas durante el trabajo de los agentes en solicitudes compatibles de la API Responses. Estas comprobaciones pueden activar alertas de seguridad o detener una conversación para su revisión.
Comienza con Uso de GPT-6 Astra para conocer sus capacidades y obtener orientación sobre diseño de prompts y migración. Explora el uso de la computadora para flujos de trabajo en el navegador y el escritorio, y consulta los precios para conocer los niveles de inferencia disponibles.
Agregamos nuevos controles para el trabajo de larga duración con GPT-6 Astra en la API Responses:
- Llamada asíncrona a herramientas: permite que el modelo siga trabajando mientras tu aplicación ejecuta herramientas de función o personalizadas, y devuelve los resultados a medida que estén disponibles.
- Orientación durante el turno: envía instrucciones adicionales mientras una respuesta está en curso a través de WebSockets, para que el modelo pueda incorporar correcciones o cambios en los requisitos.
- Cambiar el esfuerzo de razonamiento durante la conversación: aumenta el esfuerzo para el trabajo difícil o redúcelo para solicitudes de seguimiento rutinarias, sin perder el prefijo del prompt almacenado en caché.
Actualizamos los errores de la API para que las aplicaciones puedan distinguir entre un aumento demasiado rápido del tráfico y una sobrecarga temporal del modelo.
Un aumento demasiado rápido del tráfico puede devolver un error 429 con el código slow_down. Una sobrecarga temporal del modelo devuelve un error 503 con el código server_is_overloaded. Ambas respuestas pueden incluir Retry-After. Si el encabezado está presente, espera al menos el tiempo que indica antes de volver a intentarlo. Si no está presente, usa una espera exponencial entre reintentos. Consulta la guía de códigos de error y la guía de límites de solicitudes.
Las conexiones a api.openai.com ahora pueden usar IPv6.
agosto de 2026
TLS mutuo (mTLS) y la federación de identidades de carga de trabajo X.509 ya están disponibles de forma general para la API de OpenAI. Configura certificados y proveedores de identidad X.509 directamente en la consola de la plataforma, con el acceso controlado por los roles y permisos de tu organización.
Anunciamos que whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe y gpt-4o-transcribe-diarize quedan obsoletos. Estos modelos dejarán de funcionar el 26 de febrero de 2027. Migra a gpt-live-transcribe o gpt-transcribe. Consulta la guía de transcripción y la página de funciones obsoletas.
La API de asistentes dejó de funcionar el 26 de agosto de 2026. Migra a la API Responses y la API Conversations con la guía de migración.
Los clientes de la API ahora pueden seleccionar el procesamiento regional para una solicitud individual usando un dominio con prefijo y una clave de API de un proyecto cuya ubicación geográfica sea Global. Siguen vigentes los requisitos de elegibilidad, control de retención de datos y compatibilidad de puntos de acceso y modelos. Obtén más información en la guía de controles de datos.
GPT-5.6 Sol ahora cuesta $4 por millón de tokens de entrada y $20 por millón de tokens de salida, lo que representa una reducción del 20 % en el precio de entrada y del 33 % en el de salida. Los precios promocionales de GPT-5.6 Sol estarán disponibles al menos hasta el 21 de noviembre de 2026. Consulta los detalles de precios.
Lanzamos el panel de almacenamiento de prompts en caché en la Plataforma API de OpenAI. Monitorea la tasa de aciertos de caché a lo largo del tiempo, las lecturas de caché por escritura y el desglose de tokens leídos de la caché, escritos en ella y no almacenados en caché para comprender la eficiencia del almacenamiento en caché e identificar oportunidades de mejora. Filtra las métricas por modelo y nivel de servicio.
Los fondos transparentes ya están disponibles en versión preliminar para gpt-image-2 y gpt-image-2-2026-04-21 en la API de imágenes y la herramienta de generación de imágenes de la API Responses. Establece background en transparent y usa el formato de salida png o webp; jpeg no admite fondos transparentes. Obtén más información en la guía de generación de imágenes.
Anunciamos el modo ultrarrápido, un nuevo nivel de servicio de la API para GPT-5.6 Sol que funciona a una velocidad de hasta 14 veces la del procesamiento estándar. Está disponible en una versión preliminar limitada para clientes seleccionados. Regístrate aquí para recibir novedades sobre el modo ultrarrápido.
Daybreak ahora ofrece dos niveles de acceso para profesionales de defensa aprobados: Daybreak Blue y Daybreak Red. Úsalos para pasar de hallazgos de seguridad a correcciones validadas en trabajos expresamente autorizados.
Comienza con Daybreak Blue para la mayoría de las tareas de seguridad defensiva. Proporciona acceso a modelos de propósito general como GPT-5.6 Sol para descubrir vulnerabilidades, revisar la seguridad del código, desarrollar mecanismos de detección, responder a incidentes, analizar malware y validar parches. Obtén más información aquí.
Daybreak Red proporciona acceso, con aprobación independiente, a modelos entrenados para fines específicos como GPT-5.6 Cyber, para tareas autorizadas de reproducción de vulnerabilidades, validación de exploits, pruebas de penetración, red teaming y análisis de sistemas complejos.
Estos modelos requieren aprobación y aprovisionamiento por separado. Puedes solicitar unirte al programa Daybreak aquí. Consulta más detalles sobre los precios aquí.
Actualizamos la versión chat-latest , que apunta al modelo más reciente disponible en ChatGPT para usuarios de Plus y Pro. Recomendamos usar GPT-5.6 Sol para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.
El modo rápido ahora admite solicitudes de contexto largo para GPT-5.6 Sol, GPT-5.6 Terra y GPT-5.6 Luna. A partir de hoy, los prompts de contexto largo que superen los 272 000 tokens pueden ejecutarse en modo rápido, con velocidades de hasta 2,5 veces las del nivel estándar. Consulta los detalles de precios.
Los clientes ahora pueden filtrar y agrupar datos por clave de API en los paneles de uso y costos. La API de uso y la API de costos también admiten la dimensión de clave de API para generar informes y realizar análisis de forma programática.
julio de 2026
A partir del 30 de julio, GPT-5.6 Luna cuesta un 80 % menos y GPT-5.6 Terra, un 20 % menos. Consulta los detalles de precios.
También presentamos el modo rápido en la API, que reemplaza nuestra oferta de procesamiento prioritario. Para GPT-5.6 Sol, el modo rápido ahora ofrece velocidades de hasta 2,5 veces las del procesamiento estándar al doble de precio. Este cambio es compatible con versiones anteriores: las solicitudes etiquetadas como priority usarán automáticamente el modo rápido.
Lanzamos el proveedor de Terraform de OpenAI oficial para administrar los recursos de la Plataforma API de OpenAI como infraestructura como código.
Aprovisiona y administra proyectos, usuarios, grupos, roles, asignaciones de acceso, cuentas de servicio, certificados, invitaciones y límites de solicitudes por proyecto. Usa los flujos de trabajo estándar de Terraform para revisar y aplicar cambios, importar recursos existentes y detectar y corregir desviaciones de la configuración. Instala el proveedor desde Terraform Registry.
Lanzamos GPT Transcribe para transcribir archivos con precisión y obtener transcripciones finales de turnos confirmados de Realtime, junto con GPT Live Transcribe para la transcripción en transmisión continua de baja latencia.
Ambos modelos admiten contexto de transcripción en formato libre, pistas de palabras clave y varios idiomas de entrada esperados. Compara los resultados y flujos de trabajo compatibles en la guía de transcripción.
Agregamos límites estrictos de gasto para organizaciones y proyectos en la Plataforma API de OpenAI. Establece un tope mensual para que las solicitudes de API afectadas devuelvan un error 429 cuando el gasto registrado alcance el límite. Usa las alertas de gasto para recibir notificaciones antes de que se interrumpa el tráfico. Obtén más información en la guía de límites de gasto.
Lanzamos la familia de modelos GPT-5.6, que incluye GPT-5.6 Sol para capacidades de vanguardia, GPT-5.6 Terra para un equilibrio entre inteligencia y costo, y GPT-5.6 Luna para manejar cargas de trabajo de gran volumen con eficiencia. El alias gpt-5.6 dirige las solicitudes a gpt-5.6-sol.
GPT-5.6 incorpora llamada programática a herramientas, controles explícitos de almacenamiento de prompts en caché, razonamiento persistente, esfuerzo de razonamiento max y modo Pro, y orquestación multiagente en versión beta para la API Responses. GPT-5.6 también acepta imágenes en sus dimensiones originales con el nivel de detalle de imagen original o auto.
Lanzamos GPT-Realtime-2.1, un modelo de razonamiento en tiempo real actualizado con mejoras en el reconocimiento alfanumérico, el manejo del silencio y el ruido, y el comportamiento ante interrupciones. También lanzamos GPT-Realtime-2.1 mini, un modelo de razonamiento destilado más rápido y de menor costo para aplicaciones de voz en tiempo real.
junio de 2026
Actualizamos la versión chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.
Lanzamos el panel de uso de seguridad en la Plataforma API de OpenAI. El panel de seguridad muestra las solicitudes de Responses bloqueadas según los valores de safety_identifier enviados en las solicitudes para identificar a los usuarios finales. Visita el panel de seguridad.
La búsqueda web ahora puede devolver imágenes junto con los resultados de texto habituales. Usa la búsqueda de imágenes cuando tu aplicación necesite imágenes actuales o basadas en fuentes web, como fotos de productos, sitios emblemáticos, lugares, eventos o referencias visuales. Obtén más información en la guía de búsqueda web.
Lanzamos una navegación rediseñada para la Plataforma API de OpenAI. Visítala aquí.
Agregamos puntuaciones de moderación a la API Responses y la API para completar chats. Pasa un objeto moderation en una solicitud de generación para recibir, en la misma respuesta, los resultados de moderación tanto de la entrada del modelo como de la salida generada.
Obtén más información en la guía de moderación.
Anunciamos que los objetos de prompts reutilizables, la plataforma de evaluaciones y Agent Builder quedan obsoletos. Consulta la página de funciones obsoletas para conocer las fechas de cierre y obtener orientación sobre la migración.
A partir del 2 de junio de 2026, las sesiones de contenedores que cumplan los requisitos se facturarán por minuto, con un mínimo de 5 minutos, en lugar de cobrarse a la tarifa completa de una sesión de 20 minutos. La tarifa por minuto seguirá siendo la misma.
Esta actualización busca que la facturación se ajuste mejor a las sesiones más cortas y reducirá el costo efectivo para los clientes.
Puedes consultar los precios actuales de las herramientas integradas en nuestra documentación de precios de la API.
Los modelos de OpenAI ya están disponibles en Amazon Bedrock mediante un punto de acceso de la API Responses compatible con OpenAI. Los modelos y las funciones compatibles varían según la región de AWS. Obtén más información.
mayo de 2026
Para las organizaciones que no tienen ZDR habilitado, el valor predeterminado de prompt_cache_retention ahora es 24h en lugar de in_memory, lo que habilita de forma predeterminada el almacenamiento extendido de prompts en caché. Obtén más información.
Lanzamos la versión chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.
Lanzamos la federación de identidades de carga de trabajo. Las cargas de trabajo de confianza pueden intercambiar tokens de identidad emitidos externamente por tokens de acceso de OpenAI de corta duración, sin almacenar claves de API de larga duración.
Agregamos nuevas capacidades a la API de administración para gestionar alertas de gasto, listas de modelos permitidos, opciones de retención de datos y permisos de herramientas alojadas, además de consultar partidas detalladas de facturación.
Lanzamos el túnel MCP seguro para clientes empresariales. El túnel MCP seguro permite que los productos de OpenAI compatibles, incluidos ChatGPT web, Codex, la API Responses y AgentKit, se conecten a servidores MCP privados o locales mediante un tunnel-client alojado por el cliente, sin exponer esos servidores a la internet pública.
Ahora puedes administrar varias listas de direcciones IP permitidas y aplicar cada una a un proyecto o a toda la organización. Para configurarlas, ve a Configuración > Seguridad > Lista de direcciones IP permitidas.
Las versiones de los modelos DALL·E y la versión beta de la Realtime API quedaron obsoletas.
Las instantáneas de los modelos DALL·E dall-e-2 y dall-e-3 quedaron obsoletas y se retiraron de la API el 12 de mayo de 2026. Recomendamos usar gpt-image-2, gpt-image-1 o gpt-image-1-mini en su lugar.
La versión beta de Realtime API quedó obsoleta y se retiró de la API el 12 de mayo de 2026. Si todavía usas la interfaz beta, migra a la versión de disponibilidad general de Realtime API. Consulta la guía de migración y la página de funciones obsoletas completa.
Agregamos return_token_budget a la herramienta de búsqueda web de la API Responses. Úsalo para habilitar búsquedas web con razonamiento de mayor duración en GPT-5+ para cargas de trabajo de investigación y evaluación que requieren un esfuerzo elevado.
Lanzamos GPT-Realtime-2, un nuevo modelo de voz en tiempo real con razonamiento configurable para agentes de voz a voz, junto con GPT-Realtime-Translate para traducción de voz en transmisión continua y GPT-Realtime-Whisper para conversión de voz a texto en transmisión continua.
Actualizamos la guía de tiempo real y audio, agregamos una guía de traducción en tiempo real específica, renovamos Transcripción en tiempo real para las transcripciones en transmisión continua y trasladamos las recomendaciones de diseño de prompts en tiempo real a Uso de modelos en tiempo real.
Lanzamos el complemento de OpenAI Developers para Codex. Te ayuda a crear aplicaciones y agentes de IA en Codex con acceso a la plataforma de OpenAI y orientación para configurar la API de OpenAI.
El SDK de agentes actualizado ya está disponible en TypeScript, con compatibilidad con agentes en sandbox y un arnés de ejecución de código abierto integrado. Obtén más información aquí.
Lanzamos la instantánea chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar nuestras últimas mejoras para casos de uso de chat. La instantánea del modelo subyacente se actualizará periódicamente. Obtén más información aquí.
Los SDK de OpenAI para Node, Python, Go, Ruby y Java ahora son compatibles con las API de administración. Consulta la guía de las API de administración para ver instrucciones de configuración y ejemplos.
abril de 2026
Lanzamos GPT-5.5, un nuevo modelo de vanguardia para trabajo profesional complejo, en la API para completar chats y la API Responses. También lanzamos GPT-5.5 Pro para solicitudes de la API Responses que abordan problemas más difíciles que se benefician de una mayor capacidad de cómputo.
GPT-5.5 admite una ventana de contexto de 1 millón de tokens, imágenes de entrada, resultados estructurados, llamada a funciones, almacenamiento de prompts en caché, procesamiento por lotes, búsqueda de herramientas, uso de la computadora integrado, terminal alojada en la nube, aplicación de parches, habilidades, MCP y búsqueda web. Las principales novedades incluyen:
- El esfuerzo de razonamiento ahora tiene
mediumcomo valor predeterminado. - Cuando
image_detailno está definido o se establece enauto, el modelo ahora usa el comportamiento original. - El almacenamiento en caché de GPT-5.5 solo funciona con el almacenamiento extendido de prompts en caché. No se admite el almacenamiento de prompts en caché en memoria. Obtén más información aquí.
Lanzamos GPT Image 2, un modelo de última generación para generar y editar imágenes. GPT Image 2 admite tamaños de imagen flexibles, imágenes de entrada de alta fidelidad, precios de imágenes basados en tokens y compatibilidad con la API de procesamiento por lotes con un descuento del 50 %.
Actualizamos el SDK de agentes con nuevas capacidades, entre ellas:
- ejecutar agentes en sandboxes controlados;
- inspeccionar y personalizar el arnés de ejecución de código abierto; y
- controlar cuándo se crean las memorias y dónde se almacenan.
marzo de 2026
Lanzamos GPT-5.4 mini y GPT-5.4 nano en la API para completar chats y la API Responses. GPT-5.4 mini ofrece capacidades de la categoría de GPT-5.4 en un modelo más rápido y eficiente para cargas de trabajo de gran volumen, mientras que GPT-5.4 nano está optimizado para tareas sencillas de gran volumen en las que la velocidad y el costo son lo más importante.
GPT-5.4 mini admite búsqueda de herramientas, uso de la computadora integrado y compactación. GPT-5.4 nano admite compactación, pero no búsqueda de herramientas ni uso de la computadora.
Actualizamos el slug gpt-5.3-chat-latest para que apunte al modelo más reciente que se usa actualmente en ChatGPT.
Actualizamos nuestro codificador de imágenes para corregir un pequeño error con las entradas input_image en GPT-5.4. Algunos casos de uso de comprensión de imágenes podrían mostrar mejoras de calidad. No es necesario realizar ninguna acción.
Ampliamos la API de Sora con referencias de personajes reutilizables, generaciones más largas de hasta 20 segundos, salida en 1080p para sora-2-pro, extensiones de video y compatibilidad con la API de procesamiento por lotes para POST /v1/videos. Las generaciones en 1080p con sora-2-pro se facturan a $0.70 por segundo. Obtén más información aquí.
Agregamos POST /v1/videos/edits para editar videos existentes. Reemplazará a POST /v1/videos/{video_id}/remix, que quedará obsoleto en 6 meses. Obtén más información aquí.
Lanzamos GPT-5.4, nuestro modelo de vanguardia más reciente para trabajo profesional, en la API para completar chats y la API Responses. También lanzamos GPT-5.4 Pro en la API Responses para problemas más difíciles que se benefician de una mayor capacidad de cómputo.
También lanzamos:
- Búsqueda de herramientas en la API Responses, que permite a los modelos posponer la carga de grandes conjuntos de herramientas hasta el momento de la ejecución para reducir el uso de tokens, preservar el rendimiento de la caché y mejorar la latencia.
- Compatibilidad integrada con el uso de la computadora en GPT-5.4 a través de la herramienta
computerde la API Responses para interactuar con interfaces de usuario mediante capturas de pantalla. - Una ventana de contexto de 1 millón de tokens y compatibilidad nativa con la compactación para flujos de trabajo de agentes de mayor duración.
Lanzamos gpt-5.3-chat-latest en la API para completar chats y la API Responses. Este modelo apunta a la instantánea de GPT-5.3 Instant que se usa actualmente en ChatGPT. Obtén más información aquí.
febrero de 2026
Ampliamos la compatibilidad de input_file en la API Responses para admitir más tipos de archivos de documentos, presentaciones, hojas de cálculo, código y texto. Obtén más información aquí.
Lanzamos phase en la API Responses. Etiqueta un mensaje del asistente como comentario intermedio (commentary) o respuesta final (final_answer). Obtén más información aquí.
Lanzamos gpt-5.3-codex en la API Responses. Obtén más información aquí.
Lanzamos el modo WebSocket para la API Responses. Obtén más información aquí.
Lanzamos GPT-Realtime-1.5 en Realtime API.
Lanzamos gpt-audio-1.5 en la API para completar chats. Obtén más información aquí.
La API de procesamiento por lotes ahora es compatible con los modelos GPT Image: gpt-image-1.5, chatgpt-image-latest, gpt-image-1 y gpt-image-1-mini.
Actualizamos el slug gpt-5.2-chat-latest para que apunte al modelo más reciente que se usa actualmente en ChatGPT.
Lanzamos la compactación del lado del servidor en la API Responses.
Lanzamos la compatibilidad con habilidades en la API Responses. Las habilidades son compatibles tanto con la ejecución local como con la ejecución en contenedores alojados.
Lanzamos una nueva herramienta de terminal alojada en la nube, así como compatibilidad con conexiones de red en contenedores.
Agregamos compatibilidad con solicitudes application/json en /v1/images/edits para los modelos de imágenes GPT. Las solicitudes JSON usan images (y, opcionalmente, mask) con referencias image_url o file_id en lugar de cargas multiparte.
Optimizamos nuestra infraestructura de inferencia para los clientes de la API, y GPT-5.2 y GPT-5.2-Codex ahora se ejecutan aproximadamente un 40 % más rápido. El modelo y sus pesos no han cambiado.
enero de 2026
Anunciamos Open Responses: una especificación de código abierto para crear interfaces de LLM interoperables y compatibles con varios proveedores, basadas en la API Responses original de OpenAI.
Lanzamos gpt-5.2-codex en la API Responses. GPT-5.2-Codex es una versión de GPT-5.2 optimizada para tareas de codificación con agentes en Codex o entornos similares. Obtén más información aquí.
Agregamos rangos de IP dedicados a SIP para Realtime API. sip.api.openai.com realiza enrutamiento GeoIP y dirigirá el tráfico SIP a la región más cercana. Obtén más información.
Actualizamos los slugs gpt-realtime-mini y gpt-audio-mini para que apunten a las instantáneas del 2025-12-15. Si necesitas las instantáneas anteriores de los modelos, usa gpt-realtime-mini-2025-10-06 y gpt-audio-mini-2025-10-06.
Actualizamos el slug sora-2 para que apunte a sora-2-2025-12-08. Si necesitas la instantánea anterior del modelo, usa sora-2-2025-10-06.
Actualizamos los slugs gpt-4o-mini-tts y gpt-4o-mini-transcribe para que apunten a las instantáneas del 2025-12-15. Si necesitas las instantáneas anteriores de los modelos, usa gpt-4o-mini-tts-2025-03-20 y gpt-4o-mini-transcribe-2025-03-20. Actualmente recomendamos usar gpt-4o-mini-transcribe en lugar de gpt-4o-transcribe para obtener los mejores resultados.
Corregimos un problema por el que gpt-image-1.5 y chatgpt-image-latest usaban incorrectamente alta fidelidad para editar imágenes a través de /v1/images/edits, incluso cuando fidelity se establecía explícitamente en low (el valor predeterminado).
diciembre de 2025
Agregamos gpt-image-1.5 y chatgpt-image-latest a la herramienta de generación de imágenes de la API Responses.
Lanzamos gpt-image-1.5 y chatgpt-image-latest, nuestros modelos más recientes y avanzados para la generación de imágenes. Obtén más información aquí.
Lanzamos cuatro nuevas instantáneas de audio identificadas por fecha. Estas actualizaciones mejoran la confiabilidad, la calidad y la fidelidad de voz para aplicaciones de voz en tiempo real. Obtén más información aquí.
- gpt-realtime-mini-2025-12-15
- gpt-audio-mini-2025-12-15
- gpt-4o-mini-transcribe-2025-12-15
- gpt-4o-mini-tts-2025-12-15
Este lanzamiento también incluye compatibilidad con voces personalizadas para los clientes que cumplen los requisitos.
Lanzamos GPT-5.2, el modelo insignia más reciente de la familia de modelos GPT-5. GPT-5.2 presenta mejoras respecto a su predecesor, GPT-5.1, en:
- Inteligencia general
- Seguimiento de instrucciones
- Precisión y eficiencia en el uso de tokens
- Multimodalidad, especialmente visión
- Generación de código, especialmente la creación de interfaces de usuario de front-end
- Llamadas a herramientas y gestión del contexto en la API
- Comprensión y creación de hojas de cálculo.
Las novedades de 5.2 incluyen el nuevo nivel de esfuerzo de razonamiento xhigh, resúmenes de razonamiento concisos y una nueva forma de gestionar el contexto mediante compactación.
Lanzamos la compactación del lado del cliente. Para conversaciones de larga duración con la API Responses, puedes usar el punto de acceso /responses/compact para reducir el contexto que envías en cada turno.
Lanzamos gpt-5.1-codex-max en la API Responses. GPT-5.1-Codex es nuestro modelo de programación más inteligente, optimizado para tareas de codificación con agentes de larga duración. Lee más aquí.
noviembre de 2025
Agregamos compatibilidad con pulsaciones de teclas DTMF en la Realtime API. Ahora puedes recibir eventos DTMF mientras usas una conexión de canal lateral de Realtime. Consulta la documentación aquí para obtener más información.
Lanzamos GPT-5.1, el modelo insignia más reciente de la familia de modelos GPT-5. GPT-5.1 está entrenado para destacarse especialmente en:
- Capacidad de responder a indicaciones y ofrecer respuestas más rápidas cuando se requiere menos razonamiento
- Generación de código y casos de uso de programación
- Flujos de trabajo con agentes
Ten en cuenta que GPT-5.1 usa de forma predeterminada la nueva configuración de razonamiento none para responder más rápido cuando se requiere menos razonamiento, a diferencia de la configuración predeterminada anterior medium de GPT-5.
Lanzamos controles de acceso basados en roles (RBAC) mejorados. El control de acceso basado en roles (RBAC) te permite decidir quién puede hacer qué en tu organización y tus proyectos, tanto a través de la API como en el panel.
Lanzamos gpt-5.1-codex y gpt-5.1-codex-mini en la API Responses. GPT-5.1-Codex es una versión de GPT-5.1 optimizada para tareas de codificación con agentes en Codex o entornos similares. Lee más aquí.
Lanzamos la retención extendida de la caché de prompts. La retención extendida de la caché de prompts mantiene activos los prefijos almacenados en caché durante más tiempo, hasta un máximo de 24 horas. El almacenamiento extendido de prompts en caché transfiere los tensores de clave/valor al almacenamiento local de la GPU cuando la memoria está llena, lo que aumenta significativamente la capacidad de almacenamiento disponible para la caché.
octubre de 2025
gpt-oss-safeguard-120b y gpt-oss-safeguard-20b son modelos de razonamiento de seguridad basados en gpt-oss. Lee más aquí.
Lanzamos la gestión de claves empresariales (EKM). La gestión de claves empresariales (EKM) te permite cifrar tu contenido de cliente en OpenAI con claves administradas por tu propio sistema externo de gestión de claves (KMS).
Lanzamos la residencia de datos en el Reino Unido.
Lanzamos varias funciones nuevas en OpenAI DevDay:
Lanzamos GPT-5 Pro, una versión de GPT-5 que usa más recursos de cómputo para razonar con mayor profundidad y ofrecer mejores respuestas de forma constante.
Lanzamos GPT-Realtime mini y gpt-audio-mini para ofrecer un rendimiento de voz a voz más rentable.
Lanzamos gpt-image-1-mini para generar y editar imágenes a un menor costo.
Lanzamos v1/videos para generar y remezclar videos de gran riqueza visual, detallados y dinámicos con nuestros modelos más recientes, Sora 2 y Sora 2 Pro.
Lanzamos Agent Builder para crear visualmente flujos de trabajo multiagente personalizados.
Lanzamos ChatKit, una interfaz de chat integrable para implementar agentes.
Lanzamos herramientas de evaluación de trazas, conjuntos de datos y optimización de prompts.
Evaluaciones: agregamos compatibilidad con modelos de terceros.
Lanzamos el panel de estado del servicio.
Lanzamos la lista de direcciones IP permitidas. Esta lista restringe el acceso a la API a las direcciones o los rangos de IP que especifiques.
septiembre de 2025
Agregamos compatibilidad con imágenes y archivos como resultado de una llamada a herramientas en la API Responses.
Lanzamos el modelo especializado gpt-5-codex, creado y optimizado para usarse con Codex CLI.
agosto de 2025
La Realtime API de OpenAI ya está disponible de forma general. Obtén más información en nuestra guía de la Realtime API.
Agregamos compatibilidad con conectores en la API Responses. Los conectores son adaptadores MCP mantenidos por OpenAI para servicios populares como las aplicaciones de Google, Dropbox y otros, que permiten dar al modelo acceso de lectura a los datos almacenados en esos servicios.
Lanzamos la API Conversations, que te permite crear y gestionar conversaciones de larga duración con la API Responses. Consulta la guía de migración para ver una comparación en paralelo y aprender a migrar una integración de la API de asistentes a Responses y Conversations.
Lanzamos la familia de modelos GPT-5 en la API, que incluye gpt-5, gpt-5-mini y gpt-5-nano.
Introdujimos el valor minimal de esfuerzo de razonamiento para optimizar la rapidez de las respuestas en los modelos GPT-5 (que admiten razonamiento).
Introdujimos el tipo de llamada a herramientas custom, que permite entradas y salidas de formato libre del modelo al llamar a herramientas.
junio de 2025
Agregamos compatibilidad con el procesamiento prioritario. El procesamiento prioritario ofrece una latencia significativamente menor y más estable que el procesamiento estándar, y mantiene la flexibilidad del pago por uso.
Lanzamos o3-deep-research y o4-mini-deep-research, variantes de investigación profunda de nuestros modelos de razonamiento de la serie o, optimizadas para tareas de análisis e investigación en profundidad. Obtén más información en la guía de investigación profunda.
Agregamos compatibilidad con el manejo asíncrono de eventos mediante webhooks. Redujimos y simplificamos los precios de la herramienta de búsqueda web. Agregamos compatibilidad con la herramienta de búsqueda web.
Los nuevos prompts reutilizables ya están disponibles en el panel y en la API Responses. Ahora puedes hacer referencia desde la API a las plantillas creadas en el panel mediante el parámetro prompt (con un id de prompt y un version opcional) y proporcionar variables dinámicas que pueden incluir cadenas, imágenes o archivos de entrada. Los prompts reutilizables no están disponibles en Chat Completions. Obtén más información.
Lanzamos o3-pro, una versión del modelo de razonamiento o3 que usa más recursos de cómputo para resolver problemas difíciles con mejor razonamiento y mayor consistencia. También redujimos los precios del modelo o3 para todas las solicitudes a la API, incluidos el procesamiento por lotes y el procesamiento Flex.
Agregamos compatibilidad con el ajuste fino mediante optimización directa de preferencias para los modelos gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 y gpt-4.1-nano-2025-04-14.
Ya están disponibles nuevas versiones de gpt-4o-audio-preview y gpt-4o-realtime-preview. Lanzamos el SDK de agentes para TypeScript.
mayo de 2025
Agregamos compatibilidad con nuevas herramientas integradas en la API Responses, incluidos los servidores MCP remotos y el intérprete de código. Obtén más información sobre las herramientas.
Agregamos compatibilidad con el modo strict para los esquemas de herramientas al realizar llamadas a herramientas en paralelo con modelos sin ajuste fino.
Agregamos nuevas funciones de esquema, como la validación de cadenas para email y otros patrones, y la especificación de rangos para números y arreglos.
Lanzamos codex-mini-latest en la API, optimizado para usarse con Codex CLI.
Agregamos compatibilidad con el ajuste fino por refuerzo. Conoce los métodos de ajuste fino disponibles. Ahora puedes realizar ajuste fino en gpt-4.1-nano.
abril de 2025
Agregamos compatibilidad con alertas de presupuesto de la API mejoradas y límites de recarga automática.
Agregamos un nuevo modelo de generación de imágenes, gpt-image-1. Este modelo establece un nuevo estándar para la generación de imágenes, con mejoras en la calidad y el seguimiento de instrucciones.
Actualizamos los puntos de acceso de generación y edición de imágenes para admitir nuevos parámetros específicos del modelo gpt-image-1.
Agregamos dos nuevos modelos de razonamiento de la serie o, o3 y o4-mini. Establecen un nuevo estándar en matemáticas, ciencias, programación, tareas de razonamiento visual y redacción técnica.
Lanzamos Codex, nuestra herramienta CLI de generación de código.
Agregamos los modelos gpt-4.1, gpt-4.1-mini y gpt-4.1-nano a la API. Estos nuevos modelos ofrecen mejoras en el seguimiento de instrucciones y la programación, además de una ventana de contexto más grande (hasta 1 millón de tokens). gpt-4.1 y gpt-4.1-mini están disponibles para ajuste fino supervisado. Anunciamos la obsolescencia de gpt-4.5-preview.
marzo de 2025
Agregamos los modelos gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe y whisper-1 a la API de audio.
Lanzamos varios modelos y herramientas nuevos, además de una nueva API para flujos de trabajo con agentes:
- Lanzamos la API Responses, una nueva API para crear y usar agentes y herramientas.
- Lanzamos un conjunto de herramientas integradas para la API Responses: búsqueda web, búsqueda de archivos y uso de la computadora.
- Lanzamos el SDK de agentes, un framework de orquestación para diseñar, crear e implementar agentes.
- Anunciamos nuevos modelos:
gpt-4o-search-preview,gpt-4o-mini-search-preview,computer-use-preview. - Anunciamos planes para incorporar todas las funciones de la API de asistentes a la API Responses, que es más fácil de usar, con el cierre de Assistants previsto para 2026 (después de alcanzar la paridad completa de funciones).
Agregamos compatibilidad con el campo metadata en los trabajos de ajuste fino.
febrero de 2025
Lanzamos una versión preliminar de investigación de GPT-4.5, nuestro modelo de chat más grande y capaz hasta la fecha. El alto “coeficiente emocional” de GPT-4.5 y su comprensión de la intención del usuario mejoran su desempeño en tareas creativas y en la planificación con agentes.
Lanzamos la actualización del panel de uso de la API. Esta actualización responde a las solicitudes de filtros de datos adicionales, como la selección de proyectos, el selector de fechas y los intervalos más detallados. También mejora la visualización del uso en distintos productos y niveles de servicio.
Presentamos la residencia de datos en Europa. Obtén más información aquí.
enero de 2025
Lanzamos o3-mini, un nuevo modelo de razonamiento pequeño optimizado para tareas de ciencia, matemáticas y programación.
Ampliamos el acceso al modelo o1. Los modelos de la serie o1 se entrenan con aprendizaje por refuerzo para realizar razonamientos complejos.
diciembre de 2024
Lanzamos la rotación de claves de la API de administración, que permite a los clientes rotar sus claves de la API de administración de forma programática.
Actualizamos las invitaciones de la API de administración, lo que permite a los clientes invitar usuarios a proyectos de forma programática al mismo tiempo que los invitan a organizaciones.
Agregamos nuevos modelos para o1, gpt-4o-realtime, gpt-4o-audio y más.
Agregamos el método de conexión WebRTC para la Realtime API.
Agregamos el parámetro reasoning_effort para los modelos o1.
Agregamos el rol de mensaje developer para el modelo o1. Ten en cuenta que o1-preview y o1-mini no admiten mensajes de sistema ni de desarrollador.
Lanzamos el ajuste fino según preferencias mediante la optimización directa de preferencias (DPO).
Lanzamos los SDK para Go y Java en versión beta. Obtén más información.
Agregamos compatibilidad con la Realtime API en el SDK de Python.
Lanzamos la API de uso, que permite a los clientes consultar de forma programática la actividad y los gastos en las API de OpenAI.
noviembre de 2024
Lanzamos gpt-4o-2024-11-20, nuestro modelo más reciente de la serie gpt-4o.
Lanzamos los resultados predichos, que reducen considerablemente la latencia de las respuestas del modelo cuando gran parte de la respuesta se conoce de antemano. Esto ocurre con mayor frecuencia al regenerar el contenido de documentos y archivos de código con cambios menores.
octubre de 2024
Agregamos cinco nuevos tipos de voz en la Realtime API y la API para completar chats.
Lanzamos el nuevo modelo gpt-4o-audio-preview para completar chats, que admite tanto entradas como salidas de audio. Usa el mismo modelo subyacente que la Realtime API.
Lanzamos varias funciones nuevas en OpenAI DevDay en San Francisco:
Realtime API: incorpora experiencias rápidas de voz a voz en tus aplicaciones mediante una interfaz de WebSockets.
Destilación de modelos: plataforma para realizar el ajuste fino de modelos rentables con los resultados que obtengas de un modelo grande de vanguardia.
Ajuste fino con imágenes: realiza el ajuste fino de GPT-4o con imágenes y texto para mejorar sus capacidades de visión.
Evaluaciones: crea y ejecuta evaluaciones personalizadas para medir el rendimiento del modelo en tareas específicas.
Almacenamiento de prompts en caché: descuentos y tiempos de procesamiento más rápidos para tokens de entrada vistos recientemente.
Generar en Playground: genera fácilmente prompts, definiciones de funciones y esquemas de resultados estructurados en Playground con el botón Generar.
septiembre de 2024
Lanzamos el nuevo modelo de moderación omni-moderation-latest, que admite imágenes y texto (para algunas categorías), incorpora dos nuevas categorías de daño exclusivas para texto y ofrece puntuaciones más precisas.
Lanzamos o1-preview y o1-mini, nuevos modelos de lenguaje grandes entrenados con aprendizaje por refuerzo para realizar tareas de razonamiento complejo.
agosto de 2024
La API de asistentes ahora permite incluir los resultados de búsqueda de archivos que usa la herramienta de búsqueda de archivos y personalizar el comportamiento de clasificación.
El ajuste fino de gpt-4o-2024-08-06 ya está disponible de forma general. Todos los usuarios de la API ahora pueden realizar el ajuste fino del modelo GPT-4o más reciente.
Lanzamos un modelo dinámico para chatgpt-4o-latest. Este modelo apuntará al modelo GPT-4o más reciente que usa ChatGPT.
Lanzamos los resultados estructurados. Los resultados del modelo ahora se ajustan de forma confiable a los esquemas JSON proporcionados por los desarrolladores.
Lanzamos gpt-4o-2024-08-06, nuestro modelo más reciente de la serie gpt-4o.
Lanzamos las API de administración y registros de auditoría, que permiten a los clientes administrar su organización de forma programática y supervisar los cambios mediante los registros de auditoría. El registro de auditoría debe habilitarse en la configuración.
julio de 2024
Lanzamos la configuración de SSO de autoservicio, que permite a los clientes empresariales con facturación personalizada e ilimitada configurar la autenticación con el IDP que elijan.
Lanzamos el ajuste fino de GPT-4o mini, que permite lograr un rendimiento aún mayor en casos de uso específicos.
Lanzamos GPT-4o mini, nuestro modelo pequeño, económico e inteligente para tareas rápidas y ligeras.
Lanzamos Uploads para cargar archivos grandes en varias partes.
junio de 2024
La llamada a funciones en paralelo se puede deshabilitar en Chat Completions y en la API de asistentes pasando parallel_tool_calls=false.
Lanzamos el SDK de .NET en versión beta.
Agregamos compatibilidad con la personalización de la búsqueda de archivos.
mayo de 2024
Agregamos la posibilidad de archivar proyectos . Solo los propietarios de la organización pueden acceder a esta función.
Agregamos la posibilidad de establecer límites de costo por proyecto para los clientes de pago por uso.
Lanzamos GPT-4o en la API. GPT-4o es nuestro modelo insignia más rápido y económico.
Agregamos compatibilidad con imágenes de entrada en la API de asistentes.
Agregamos compatibilidad con modelos con ajuste fino en la API de procesamiento por lotes .
Agregamos el parámetro stream_options: {"include_usage": true} a las API de Chat Completions y Completions. Configurarlo permite a los desarrolladores acceder a las estadísticas de uso al utilizar la transmisión continua.
Agregamos un nuevo punto de acceso para eliminar un mensaje de un hilo en la API de asistentes.
abril de 2024
Agregamos una nueva opción de llamada a funciones, tool_choice: "required", a la API para completar chats y la API de asistentes.
Agregamos una guía de la API de procesamiento por lotes y compatibilidad con modelos de embeddings en esta API
Presentamos una serie de actualizaciones de la API de asistentes , que incluyen una nueva herramienta de búsqueda de archivos que permite hasta 10 000 archivos por asistente, nuevos controles de tokens y compatibilidad con la selección de herramientas.
Presentamos una jerarquía basada en proyectos para organizar el trabajo por proyectos, con la posibilidad de crear claves de API y administrar límites de solicitudes y de costo por proyecto (los límites de costo solo están disponibles para clientes empresariales).
Lanzamos la API de procesamiento por lotes
Lanzamos GPT-4 Turbo with Vision con disponibilidad general en la API
Agregamos compatibilidad con seed en la API de ajuste fino
Agregamos compatibilidad con puntos de control en la API de ajuste fino
Agregamos la posibilidad de agregar mensajes al crear una ejecución en la API de asistentes
Agregamos la posibilidad de filtrar mensajes por run_id en la API de asistentes
marzo de 2024
Agregamos compatibilidad con temperature y la creación de mensajes del asistente en la API de asistentes
Agregamos compatibilidad con la transmisión continua en la API de asistentes
febrero de 2024
Agregamos el parámetro timestamp_granularities a la API de audio
enero de 2024
Lanzamos los modelos de embeddings V3 y una versión preliminar actualizada de GPT-4 Turbo
Agregamos el parámetro dimensions a la API de embeddings
diciembre de 2023
Agregamos el parámetro additional_instructions a la creación de ejecuciones en la API de asistentes
Se agregaron los parámetros logprobs y top_logprobs a la API para completar chats
El argumento de parámetros de función en una llamada a herramientas ahora es opcional
noviembre de 2023
Se lanzó OpenAI Deno SDK
Se lanzaron GPT-4 Turbo Preview, una versión actualizada de GPT-3.5 Turbo, GPT-4 Turbo with Vision, la API de asistentes, DALL·E 3 en la API y la API de texto a voz
Se declaró obsoleto el parámetro functions de Chat Completions y se recomienda usar tools en su lugar
Se lanzó OpenAI Python SDK V1.0
octubre de 2023
Se agregó el parámetro encoding_format a la API de embeddings
Se agregó max_tokens a los modelos de moderación
Se agregó compatibilidad con la llamada a funciones a la API de ajuste fino