For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal

Registro de cambios

Puedes consultar las próximas funciones que quedarán obsoletas en la página de funciones obsoletas.

septiembre de 2026

15 sept
Función

Se agregaron controles de gobernanza para la creación de claves de API a nivel de organización y de proyecto. Los administradores pueden permitir únicamente claves de cuentas de servicio, permitir únicamente claves de proyecto propiedad de usuarios o deshabilitar por completo la creación de nuevas claves de API. Las restricciones de la organización tienen prioridad sobre la configuración del proyecto y no afectan a las claves de API existentes. Consulta las prácticas recomendadas para producción para obtener más detalles.

10 sept
Función

Ahora puedes establecer fechas de vencimiento al crear claves de API de proyecto. Los administradores también pueden imponer una vigencia máxima para las claves a nivel de organización o proyecto en la configuración de la plataforma, de modo que las claves nuevas deban vencer dentro del límite configurado. Consulta las prácticas recomendadas para producción para obtener orientación sobre el vencimiento y la rotación de claves.

10 sept
Función

Lanzamos la API de agentes en versión beta pública. Crea agentes con un arnés de ejecución administrado de Codex mientras OpenAI se encarga de la orquestación de sesiones, la compactación del contexto y la recuperación.

Usa sesiones duraderas para continuar el trabajo entre turnos, transmitir el progreso en tiempo real y conectar tus propias herramientas y servidores MCP. Ejecuta agentes en sandboxes alojados por OpenAI o conecta un sandbox de tu propia infraestructura o de un proveedor compatible.

Comienza con el inicio rápido de la API de agentes.

10 sept
Función
gpt-live-1
v1/live/sessions

GPT-Live 1 ya está disponible de forma general en la API. Crea conversaciones de voz de dúplex completo que puedan continuar mientras un modelo o agente en el backend se encarga del razonamiento y las herramientas.

Usa la delegación mediante Responses con un modelo de OpenAI, o la delegación al cliente para conectar tu propio backend. Las sesiones de voz cuestan $0,05 por minuto y se facturan por segundo; el uso del modelo del backend y de las herramientas se cobra por separado.

Comienza con GPT-Live, el diseño de prompts y la guía de migración. Consulta los precios para obtener más detalles.

8 sept
Función
v1/responses

El diagnóstico de la caché de prompts ya está disponible de forma general en la API Responses para GPT-5.6 y los modelos posteriores compatibles.

Compara la reutilización de la caché con la de una respuesta anterior, identifica las causas de las fallas de caché y sigue las recomendaciones de solución de problemas para mejorar su reutilización.

8 sept
Función
gpt-image-2.5-sunburst
gpt-image-2.5-flare
v1/images
v1/responses

Lanzamos GPT Image 2.5 Sunburst y GPT Image 2.5 Flare para generar y editar imágenes mediante la API de imágenes y la herramienta de generación de imágenes de la API Responses.

Usa Sunburst en flujos de trabajo donde la precisión de la edición sea lo más importante, o Flare para generar imágenes cotidianas de alta calidad con rapidez. Ambos modelos admiten las nuevas opciones de calidad xhigh y max y usan las tarifas por token de GPT Image 2. Consulta la guía de generación de imágenes y los precios.

8 sept
Función
gpt-rosalind-research

GPT-Rosalind (gpt-rosalind-research) ya está disponible de forma general a través del programa de acceso de confianza para investigaciones internas aprobadas en ciencias de la vida.

Las tarifas estándar son de $5 por cada millón de tokens de entrada, $0,50 por cada millón de tokens de entrada en caché y $25 por cada millón de tokens de salida. La facturación comienza el 5 de octubre de 2026. Consulta los precios para obtener más detalles.

3 sept
Función
gpt-6-astra
v1/responses
v1/chat/completions

Lanzamos GPT-6 Astra, nuestro modelo más capaz, diseñado para realizar de principio a fin los trabajos más difíciles.

Usa GPT-6 Astra para tareas de razonamiento, programación, uso de la computadora, investigación y creación de documentos. Combina estas capacidades para llevar tareas complejas desde una solicitud inicial hasta un resultado terminado, con el contexto y las herramientas que proporciones.

Cambios clave que debes considerar al migrar:

  • GPT-6 Astra no admite el nivel de esfuerzo de razonamiento none.
  • GPT-6 Astra no admite valores personalizados de temperature o top_p, ni probabilidades logarítmicas (logprobs).
  • Las llamadas a herramientas requieren la API Responses. Si usas herramientas con Chat Completions, sigue la guía de migración a Responses.
  • El monitoreo de desalineación comprueba de forma asíncrona si hay posibles problemas durante el trabajo de los agentes en solicitudes compatibles de la API Responses. Estas comprobaciones pueden activar alertas de seguridad o detener una conversación para su revisión.

Comienza con Uso de GPT-6 Astra para conocer sus capacidades y obtener orientación sobre diseño de prompts y migración. Explora el uso de la computadora para flujos de trabajo en el navegador y el escritorio, y consulta los precios para conocer los niveles de inferencia disponibles.

3 sept
Función
v1/responses

Agregamos nuevos controles para el trabajo de larga duración con GPT-6 Astra en la API Responses:

  • Llamada asíncrona a herramientas: permite que el modelo siga trabajando mientras tu aplicación ejecuta herramientas de función o personalizadas, y devuelve los resultados a medida que estén disponibles.
  • Orientación durante el turno: envía instrucciones adicionales mientras una respuesta está en curso a través de WebSockets, para que el modelo pueda incorporar correcciones o cambios en los requisitos.
  • Cambiar el esfuerzo de razonamiento durante la conversación: aumenta el esfuerzo para el trabajo difícil o redúcelo para solicitudes de seguimiento rutinarias, sin perder el prefijo del prompt almacenado en caché.
2 sept
Actualización

Actualizamos los errores de la API para que las aplicaciones puedan distinguir entre un aumento demasiado rápido del tráfico y una sobrecarga temporal del modelo.

Un aumento demasiado rápido del tráfico puede devolver un error 429 con el código slow_down. Una sobrecarga temporal del modelo devuelve un error 503 con el código server_is_overloaded. Ambas respuestas pueden incluir Retry-After. Si el encabezado está presente, espera al menos el tiempo que indica antes de volver a intentarlo. Si no está presente, usa una espera exponencial entre reintentos. Consulta la guía de códigos de error y la guía de límites de solicitudes.

1 sept
Actualización

Las conexiones a api.openai.com ahora pueden usar IPv6.

agosto de 2026

29 ago
Función

TLS mutuo (mTLS) y la federación de identidades de carga de trabajo X.509 ya están disponibles de forma general para la API de OpenAI. Configura certificados y proveedores de identidad X.509 directamente en la consola de la plataforma, con el acceso controlado por los roles y permisos de tu organización.

26 ago
Actualización
whisper-1
gpt-4o-transcribe
gpt-4o-mini-transcribe
gpt-4o-transcribe-diarize
v1/audio/transcriptions
v1/realtime

Anunciamos que whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe y gpt-4o-transcribe-diarize quedan obsoletos. Estos modelos dejarán de funcionar el 26 de febrero de 2027. Migra a gpt-live-transcribe o gpt-transcribe. Consulta la guía de transcripción y la página de funciones obsoletas.

La API de asistentes dejó de funcionar el 26 de agosto de 2026. Migra a la API Responses y la API Conversations con la guía de migración.

21 ago
Función

Los clientes de la API ahora pueden seleccionar el procesamiento regional para una solicitud individual usando un dominio con prefijo y una clave de API de un proyecto cuya ubicación geográfica sea Global. Siguen vigentes los requisitos de elegibilidad, control de retención de datos y compatibilidad de puntos de acceso y modelos. Obtén más información en la guía de controles de datos.

21 ago
Actualización
gpt-5.6-sol

GPT-5.6 Sol ahora cuesta $4 por millón de tokens de entrada y $20 por millón de tokens de salida, lo que representa una reducción del 20 % en el precio de entrada y del 33 % en el de salida. Los precios promocionales de GPT-5.6 Sol estarán disponibles al menos hasta el 21 de noviembre de 2026. Consulta los detalles de precios.

20 ago
Función

Lanzamos el panel de almacenamiento de prompts en caché en la Plataforma API de OpenAI. Monitorea la tasa de aciertos de caché a lo largo del tiempo, las lecturas de caché por escritura y el desglose de tokens leídos de la caché, escritos en ella y no almacenados en caché para comprender la eficiencia del almacenamiento en caché e identificar oportunidades de mejora. Filtra las métricas por modelo y nivel de servicio.

20 ago
Actualización
gpt-image-2
gpt-image-2-2026-04-21
v1/images/generations
v1/images/edits
v1/responses

Los fondos transparentes ya están disponibles en versión preliminar para gpt-image-2 y gpt-image-2-2026-04-21 en la API de imágenes y la herramienta de generación de imágenes de la API Responses. Establece background en transparent y usa el formato de salida png o webp; jpeg no admite fondos transparentes. Obtén más información en la guía de generación de imágenes.

13 ago
Anuncio

Anunciamos el modo ultrarrápido, un nuevo nivel de servicio de la API para GPT-5.6 Sol que funciona a una velocidad de hasta 14 veces la del procesamiento estándar. Está disponible en una versión preliminar limitada para clientes seleccionados. Regístrate aquí para recibir novedades sobre el modo ultrarrápido.

7 ago
Función
gpt-5.6-cyber
gpt-daybreak-red-latest
gpt-daybreak-blue-latest
v1/responses

Daybreak ahora ofrece dos niveles de acceso para profesionales de defensa aprobados: Daybreak Blue y Daybreak Red. Úsalos para pasar de hallazgos de seguridad a correcciones validadas en trabajos expresamente autorizados.

Comienza con Daybreak Blue para la mayoría de las tareas de seguridad defensiva. Proporciona acceso a modelos de propósito general como GPT-5.6 Sol para descubrir vulnerabilidades, revisar la seguridad del código, desarrollar mecanismos de detección, responder a incidentes, analizar malware y validar parches. Obtén más información aquí.

Daybreak Red proporciona acceso, con aprobación independiente, a modelos entrenados para fines específicos como GPT-5.6 Cyber, para tareas autorizadas de reproducción de vulnerabilidades, validación de exploits, pruebas de penetración, red teaming y análisis de sistemas complejos.

Estos modelos requieren aprobación y aprovisionamiento por separado. Puedes solicitar unirte al programa Daybreak aquí. Consulta más detalles sobre los precios aquí.

6 ago
Actualización
chat-latest

Actualizamos la versión chat-latest , que apunta al modelo más reciente disponible en ChatGPT para usuarios de Plus y Pro. Recomendamos usar GPT-5.6 Sol para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.

5 ago
Actualización
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna

El modo rápido ahora admite solicitudes de contexto largo para GPT-5.6 Sol, GPT-5.6 Terra y GPT-5.6 Luna. A partir de hoy, los prompts de contexto largo que superen los 272 000 tokens pueden ejecutarse en modo rápido, con velocidades de hasta 2,5 veces las del nivel estándar. Consulta los detalles de precios.

4 ago
Función

Los clientes ahora pueden filtrar y agrupar datos por clave de API en los paneles de uso y costos. La API de uso y la API de costos también admiten la dimensión de clave de API para generar informes y realizar análisis de forma programática.

julio de 2026

30 jul
Actualización
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions

A partir del 30 de julio, GPT-5.6 Luna cuesta un 80 % menos y GPT-5.6 Terra, un 20 % menos. Consulta los detalles de precios.

También presentamos el modo rápido en la API, que reemplaza nuestra oferta de procesamiento prioritario. Para GPT-5.6 Sol, el modo rápido ahora ofrece velocidades de hasta 2,5 veces las del procesamiento estándar al doble de precio. Este cambio es compatible con versiones anteriores: las solicitudes etiquetadas como priority usarán automáticamente el modo rápido.

29 jul
Función

Lanzamos el proveedor de Terraform de OpenAI oficial para administrar los recursos de la Plataforma API de OpenAI como infraestructura como código.

Aprovisiona y administra proyectos, usuarios, grupos, roles, asignaciones de acceso, cuentas de servicio, certificados, invitaciones y límites de solicitudes por proyecto. Usa los flujos de trabajo estándar de Terraform para revisar y aplicar cambios, importar recursos existentes y detectar y corregir desviaciones de la configuración. Instala el proveedor desde Terraform Registry.

28 jul
Función
gpt-transcribe
gpt-live-transcribe
v1/audio/transcriptions
v1/realtime

Lanzamos GPT Transcribe para transcribir archivos con precisión y obtener transcripciones finales de turnos confirmados de Realtime, junto con GPT Live Transcribe para la transcripción en transmisión continua de baja latencia.

Ambos modelos admiten contexto de transcripción en formato libre, pistas de palabras clave y varios idiomas de entrada esperados. Compara los resultados y flujos de trabajo compatibles en la guía de transcripción.

22 jul
Función

Agregamos límites estrictos de gasto para organizaciones y proyectos en la Plataforma API de OpenAI. Establece un tope mensual para que las solicitudes de API afectadas devuelvan un error 429 cuando el gasto registrado alcance el límite. Usa las alertas de gasto para recibir notificaciones antes de que se interrumpa el tráfico. Obtén más información en la guía de límites de gasto.

9 jul
Función
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions
v1/batch

Lanzamos la familia de modelos GPT-5.6, que incluye GPT-5.6 Sol para capacidades de vanguardia, GPT-5.6 Terra para un equilibrio entre inteligencia y costo, y GPT-5.6 Luna para manejar cargas de trabajo de gran volumen con eficiencia. El alias gpt-5.6 dirige las solicitudes a gpt-5.6-sol.

GPT-5.6 incorpora llamada programática a herramientas, controles explícitos de almacenamiento de prompts en caché, razonamiento persistente, esfuerzo de razonamiento max y modo Pro, y orquestación multiagente en versión beta para la API Responses. GPT-5.6 también acepta imágenes en sus dimensiones originales con el nivel de detalle de imagen original o auto.

6 jul
Función
gpt-realtime-2.1
gpt-realtime-2.1-mini
v1/realtime

Lanzamos GPT-Realtime-2.1, un modelo de razonamiento en tiempo real actualizado con mejoras en el reconocimiento alfanumérico, el manejo del silencio y el ruido, y el comportamiento ante interrupciones. También lanzamos GPT-Realtime-2.1 mini, un modelo de razonamiento destilado más rápido y de menor costo para aplicaciones de voz en tiempo real.

junio de 2026

24 jun
Actualización
chat-latest

Actualizamos la versión chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.

23 jun
Función

Lanzamos el panel de uso de seguridad en la Plataforma API de OpenAI. El panel de seguridad muestra las solicitudes de Responses bloqueadas según los valores de safety_identifier enviados en las solicitudes para identificar a los usuarios finales. Visita el panel de seguridad.

9 jun
Función
v1/responses

La búsqueda web ahora puede devolver imágenes junto con los resultados de texto habituales. Usa la búsqueda de imágenes cuando tu aplicación necesite imágenes actuales o basadas en fuentes web, como fotos de productos, sitios emblemáticos, lugares, eventos o referencias visuales. Obtén más información en la guía de búsqueda web.

5 jun
Actualización

Lanzamos una navegación rediseñada para la Plataforma API de OpenAI. Visítala aquí.

4 jun
Función
omni-moderation-latest
v1/responses
v1/chat/completions

Agregamos puntuaciones de moderación a la API Responses y la API para completar chats. Pasa un objeto moderation en una solicitud de generación para recibir, en la misma respuesta, los resultados de moderación tanto de la entrada del modelo como de la salida generada.

Obtén más información en la guía de moderación.

3 jun
Actualización

Anunciamos que los objetos de prompts reutilizables, la plataforma de evaluaciones y Agent Builder quedan obsoletos. Consulta la página de funciones obsoletas para conocer las fechas de cierre y obtener orientación sobre la migración.

2 jun
Actualización

A partir del 2 de junio de 2026, las sesiones de contenedores que cumplan los requisitos se facturarán por minuto, con un mínimo de 5 minutos, en lugar de cobrarse a la tarifa completa de una sesión de 20 minutos. La tarifa por minuto seguirá siendo la misma.

Esta actualización busca que la facturación se ajuste mejor a las sesiones más cortas y reducirá el costo efectivo para los clientes.

Puedes consultar los precios actuales de las herramientas integradas en nuestra documentación de precios de la API.

1 jun
Función
gpt-5.4
gpt-5.5
v1/responses

Los modelos de OpenAI ya están disponibles en Amazon Bedrock mediante un punto de acceso de la API Responses compatible con OpenAI. Los modelos y las funciones compatibles varían según la región de AWS. Obtén más información.

mayo de 2026

29 may
Actualización
v1/responses
v1/chat/completions
v1/batch

Para las organizaciones que no tienen ZDR habilitado, el valor predeterminado de prompt_cache_retention ahora es 24h en lugar de in_memory, lo que habilita de forma predeterminada el almacenamiento extendido de prompts en caché. Obtén más información.

28 may
Actualización
chat-latest

Lanzamos la versión chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar las últimas mejoras en casos de uso de chat. La versión subyacente del modelo se actualizará periódicamente. Obtén más información aquí.

26 may
Función

Lanzamos la federación de identidades de carga de trabajo. Las cargas de trabajo de confianza pueden intercambiar tokens de identidad emitidos externamente por tokens de acceso de OpenAI de corta duración, sin almacenar claves de API de larga duración.

26 may
Actualización

Agregamos nuevas capacidades a la API de administración para gestionar alertas de gasto, listas de modelos permitidos, opciones de retención de datos y permisos de herramientas alojadas, además de consultar partidas detalladas de facturación.

19 may
Función

Lanzamos el túnel MCP seguro para clientes empresariales. El túnel MCP seguro permite que los productos de OpenAI compatibles, incluidos ChatGPT web, Codex, la API Responses y AgentKit, se conecten a servidores MCP privados o locales mediante un tunnel-client alojado por el cliente, sin exponer esos servidores a la internet pública.

19 may
Actualización

Ahora puedes administrar varias listas de direcciones IP permitidas y aplicar cada una a un proyecto o a toda la organización. Para configurarlas, ve a Configuración > Seguridad > Lista de direcciones IP permitidas.

12 may
Actualización
dall-e-2
dall-e-3
v1/realtime

Las versiones de los modelos DALL·E y la versión beta de la Realtime API quedaron obsoletas.

Las instantáneas de los modelos DALL·E dall-e-2 y dall-e-3 quedaron obsoletas y se retiraron de la API el 12 de mayo de 2026. Recomendamos usar gpt-image-2, gpt-image-1 o gpt-image-1-mini en su lugar.

La versión beta de Realtime API quedó obsoleta y se retiró de la API el 12 de mayo de 2026. Si todavía usas la interfaz beta, migra a la versión de disponibilidad general de Realtime API. Consulta la guía de migración y la página de funciones obsoletas completa.

11 may
Función
v1/responses

Agregamos return_token_budget a la herramienta de búsqueda web de la API Responses. Úsalo para habilitar búsquedas web con razonamiento de mayor duración en GPT-5+ para cargas de trabajo de investigación y evaluación que requieren un esfuerzo elevado.

7 may
Función
gpt-realtime-2
gpt-realtime-translate
gpt-realtime-whisper
v1/realtime
v1/realtime/translations
v1/realtime/transcription_sessions

Lanzamos GPT-Realtime-2, un nuevo modelo de voz en tiempo real con razonamiento configurable para agentes de voz a voz, junto con GPT-Realtime-Translate para traducción de voz en transmisión continua y GPT-Realtime-Whisper para conversión de voz a texto en transmisión continua.

Actualizamos la guía de tiempo real y audio, agregamos una guía de traducción en tiempo real específica, renovamos Transcripción en tiempo real para las transcripciones en transmisión continua y trasladamos las recomendaciones de diseño de prompts en tiempo real a Uso de modelos en tiempo real.

7 may
Función

Lanzamos el complemento de OpenAI Developers para Codex. Te ayuda a crear aplicaciones y agentes de IA en Codex con acceso a la plataforma de OpenAI y orientación para configurar la API de OpenAI.

6 may
Actualización

El SDK de agentes actualizado ya está disponible en TypeScript, con compatibilidad con agentes en sandbox y un arnés de ejecución de código abierto integrado. Obtén más información aquí.

5 may
Actualización
chat-latest

Lanzamos la instantánea chat-latest, que apunta al modelo Instant más reciente que se usa actualmente en ChatGPT. Recomendamos usar GPT-5.5 para el uso de la API en producción, pero puedes usar este modelo para probar nuestras últimas mejoras para casos de uso de chat. La instantánea del modelo subyacente se actualizará periódicamente. Obtén más información aquí.

4 may
Actualización

Los SDK de OpenAI para Node, Python, Go, Ruby y Java ahora son compatibles con las API de administración. Consulta la guía de las API de administración para ver instrucciones de configuración y ejemplos.

abril de 2026

24 abr
Función
gpt-5.5
gpt-5.5-pro
v1/responses
v1/chat/completions
v1/batch

Lanzamos GPT-5.5, un nuevo modelo de vanguardia para trabajo profesional complejo, en la API para completar chats y la API Responses. También lanzamos GPT-5.5 Pro para solicitudes de la API Responses que abordan problemas más difíciles que se benefician de una mayor capacidad de cómputo.

GPT-5.5 admite una ventana de contexto de 1 millón de tokens, imágenes de entrada, resultados estructurados, llamada a funciones, almacenamiento de prompts en caché, procesamiento por lotes, búsqueda de herramientas, uso de la computadora integrado, terminal alojada en la nube, aplicación de parches, habilidades, MCP y búsqueda web. Las principales novedades incluyen:

  • El esfuerzo de razonamiento ahora tiene medium como valor predeterminado.
  • Cuando image_detail no está definido o se establece en auto, el modelo ahora usa el comportamiento original.
  • El almacenamiento en caché de GPT-5.5 solo funciona con el almacenamiento extendido de prompts en caché. No se admite el almacenamiento de prompts en caché en memoria. Obtén más información aquí.
21 abr
Función
gpt-image-2
v1/images/generations
v1/images/edits
v1/batch

Lanzamos GPT Image 2, un modelo de última generación para generar y editar imágenes. GPT Image 2 admite tamaños de imagen flexibles, imágenes de entrada de alta fidelidad, precios de imágenes basados en tokens y compatibilidad con la API de procesamiento por lotes con un descuento del 50 %.

15 abr
Actualización

Actualizamos el SDK de agentes con nuevas capacidades, entre ellas:

  • ejecutar agentes en sandboxes controlados;
  • inspeccionar y personalizar el arnés de ejecución de código abierto; y
  • controlar cuándo se crean las memorias y dónde se almacenan.

marzo de 2026

17 mar
Función
gpt-5.4-mini
gpt-5.4-nano
v1/responses
v1/chat/completions

Lanzamos GPT-5.4 mini y GPT-5.4 nano en la API para completar chats y la API Responses. GPT-5.4 mini ofrece capacidades de la categoría de GPT-5.4 en un modelo más rápido y eficiente para cargas de trabajo de gran volumen, mientras que GPT-5.4 nano está optimizado para tareas sencillas de gran volumen en las que la velocidad y el costo son lo más importante.

GPT-5.4 mini admite búsqueda de herramientas, uso de la computadora integrado y compactación. GPT-5.4 nano admite compactación, pero no búsqueda de herramientas ni uso de la computadora.

16 mar
Actualización
gpt-5.3-chat-latest

Actualizamos el slug gpt-5.3-chat-latest para que apunte al modelo más reciente que se usa actualmente en ChatGPT.

13 mar
Corrección
gpt-5.4
v1/responses
v1/chat/completions

Actualizamos nuestro codificador de imágenes para corregir un pequeño error con las entradas input_image en GPT-5.4. Algunos casos de uso de comprensión de imágenes podrían mostrar mejoras de calidad. No es necesario realizar ninguna acción.

12 mar
Función
sora-2
sora-2-pro
v1/videos
v1/videos/characters
v1/videos/extensions
v1/batch

Ampliamos la API de Sora con referencias de personajes reutilizables, generaciones más largas de hasta 20 segundos, salida en 1080p para sora-2-pro, extensiones de video y compatibilidad con la API de procesamiento por lotes para POST /v1/videos. Las generaciones en 1080p con sora-2-pro se facturan a $0.70 por segundo. Obtén más información aquí.

12 mar
Actualización
sora-2
sora-2-pro
v1/videos/edits
v1/videos/{video_id}/remix

Agregamos POST /v1/videos/edits para editar videos existentes. Reemplazará a POST /v1/videos/{video_id}/remix, que quedará obsoleto en 6 meses. Obtén más información aquí.

5 mar
Función
gpt-5.4
gpt-5.4-pro
v1/responses
v1/chat/completions

Lanzamos GPT-5.4, nuestro modelo de vanguardia más reciente para trabajo profesional, en la API para completar chats y la API Responses. También lanzamos GPT-5.4 Pro en la API Responses para problemas más difíciles que se benefician de una mayor capacidad de cómputo.

También lanzamos:

  • Búsqueda de herramientas en la API Responses, que permite a los modelos posponer la carga de grandes conjuntos de herramientas hasta el momento de la ejecución para reducir el uso de tokens, preservar el rendimiento de la caché y mejorar la latencia.
  • Compatibilidad integrada con el uso de la computadora en GPT-5.4 a través de la herramienta computer de la API Responses para interactuar con interfaces de usuario mediante capturas de pantalla.
  • Una ventana de contexto de 1 millón de tokens y compatibilidad nativa con la compactación para flujos de trabajo de agentes de mayor duración.
3 mar
Función
gpt-5.3-chat-latest
v1/chat/completions
v1/responses

Lanzamos gpt-5.3-chat-latest en la API para completar chats y la API Responses. Este modelo apunta a la instantánea de GPT-5.3 Instant que se usa actualmente en ChatGPT. Obtén más información aquí.

febrero de 2026

24 feb
Función
v1/responses

Ampliamos la compatibilidad de input_file en la API Responses para admitir más tipos de archivos de documentos, presentaciones, hojas de cálculo, código y texto. Obtén más información aquí.

24 feb
Función
v1/responses

Lanzamos phase en la API Responses. Etiqueta un mensaje del asistente como comentario intermedio (commentary) o respuesta final (final_answer). Obtén más información aquí.

24 feb
Función
gpt-5.3-codex
v1/responses

Lanzamos gpt-5.3-codex en la API Responses. Obtén más información aquí.

23 feb
Función
v1/responses

Lanzamos el modo WebSocket para la API Responses. Obtén más información aquí.

23 feb
Función
gpt-realtime-1.5
gpt-audio-1.5
v1/realtime
v1/chat/completions

Lanzamos GPT-Realtime-1.5 en Realtime API.

Lanzamos gpt-audio-1.5 en la API para completar chats. Obtén más información aquí.

10 feb
Función
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/batch

La API de procesamiento por lotes ahora es compatible con los modelos GPT Image: gpt-image-1.5, chatgpt-image-latest, gpt-image-1 y gpt-image-1-mini.

10 feb
Actualización
gpt-5.2-chat-latest

Actualizamos el slug gpt-5.2-chat-latest para que apunte al modelo más reciente que se usa actualmente en ChatGPT.

10 feb
Función
v1/responses

Lanzamos la compactación del lado del servidor en la API Responses.

10 feb
Función
v1/responses

Lanzamos la compatibilidad con habilidades en la API Responses. Las habilidades son compatibles tanto con la ejecución local como con la ejecución en contenedores alojados.

10 feb
Función
v1/responses

Lanzamos una nueva herramienta de terminal alojada en la nube, así como compatibilidad con conexiones de red en contenedores.

9 feb
Función
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/images/edits

Agregamos compatibilidad con solicitudes application/json en /v1/images/edits para los modelos de imágenes GPT. Las solicitudes JSON usan images (y, opcionalmente, mask) con referencias image_url o file_id en lugar de cargas multiparte.

3 feb
Actualización
gpt-5.2
gpt-5.2-codex

Optimizamos nuestra infraestructura de inferencia para los clientes de la API, y GPT-5.2 y GPT-5.2-Codex ahora se ejecutan aproximadamente un 40 % más rápido. El modelo y sus pesos no han cambiado.

enero de 2026

15 ene
Anuncio

Anunciamos Open Responses: una especificación de código abierto para crear interfaces de LLM interoperables y compatibles con varios proveedores, basadas en la API Responses original de OpenAI.

14 ene
Función
gpt-5.2-codex
v1/responses

Lanzamos gpt-5.2-codex en la API Responses. GPT-5.2-Codex es una versión de GPT-5.2 optimizada para tareas de codificación con agentes en Codex o entornos similares. Obtén más información aquí.

13 ene
Función
v1/realtime

Agregamos rangos de IP dedicados a SIP para Realtime API. sip.api.openai.com realiza enrutamiento GeoIP y dirigirá el tráfico SIP a la región más cercana. Obtén más información.

13 ene
Actualización
gpt-realtime-mini
gpt-audio-mini

Actualizamos los slugs gpt-realtime-mini y gpt-audio-mini para que apunten a las instantáneas del 2025-12-15. Si necesitas las instantáneas anteriores de los modelos, usa gpt-realtime-mini-2025-10-06 y gpt-audio-mini-2025-10-06.

13 ene
Actualización
sora-2

Actualizamos el slug sora-2 para que apunte a sora-2-2025-12-08. Si necesitas la instantánea anterior del modelo, usa sora-2-2025-10-06.

13 ene
Actualización
gpt-4o-mini-tts
gpt-4o-mini-transcribe

Actualizamos los slugs gpt-4o-mini-tts y gpt-4o-mini-transcribe para que apunten a las instantáneas del 2025-12-15. Si necesitas las instantáneas anteriores de los modelos, usa gpt-4o-mini-tts-2025-03-20 y gpt-4o-mini-transcribe-2025-03-20. Actualmente recomendamos usar gpt-4o-mini-transcribe en lugar de gpt-4o-transcribe para obtener los mejores resultados.

9 ene
Corrección
gpt-image-1.5
chatgpt-image-latest

Corregimos un problema por el que gpt-image-1.5 y chatgpt-image-latest usaban incorrectamente alta fidelidad para editar imágenes a través de /v1/images/edits, incluso cuando fidelity se establecía explícitamente en low (el valor predeterminado).

diciembre de 2025

19 dic
Actualización
gpt-image-1.5
chatgpt-image-latest

Agregamos gpt-image-1.5 y chatgpt-image-latest a la herramienta de generación de imágenes de la API Responses.

16 dic
Función
gpt-image-1.5
chatgpt-image-latest

Lanzamos gpt-image-1.5 y chatgpt-image-latest, nuestros modelos más recientes y avanzados para la generación de imágenes. Obtén más información aquí.

15 dic
Función
gpt-realtime-mini
gpt-audio-mini
gpt-4o-mini-transcribe
gpt-4o-mini-tts

Lanzamos cuatro nuevas instantáneas de audio identificadas por fecha. Estas actualizaciones mejoran la confiabilidad, la calidad y la fidelidad de voz para aplicaciones de voz en tiempo real. Obtén más información aquí.

  • gpt-realtime-mini-2025-12-15
  • gpt-audio-mini-2025-12-15
  • gpt-4o-mini-transcribe-2025-12-15
  • gpt-4o-mini-tts-2025-12-15

Este lanzamiento también incluye compatibilidad con voces personalizadas para los clientes que cumplen los requisitos.

11 dic
Función
gpt-5.2
gpt-5.2-chat-latest
v1/responses
v1/chat/completions

Lanzamos GPT-5.2, el modelo insignia más reciente de la familia de modelos GPT-5. GPT-5.2 presenta mejoras respecto a su predecesor, GPT-5.1, en:

  • Inteligencia general
  • Seguimiento de instrucciones
  • Precisión y eficiencia en el uso de tokens
  • Multimodalidad, especialmente visión
  • Generación de código, especialmente la creación de interfaces de usuario de front-end
  • Llamadas a herramientas y gestión del contexto en la API
  • Comprensión y creación de hojas de cálculo.

Las novedades de 5.2 incluyen el nuevo nivel de esfuerzo de razonamiento xhigh, resúmenes de razonamiento concisos y una nueva forma de gestionar el contexto mediante compactación.

11 dic
Función
v1/responses/compact

Lanzamos la compactación del lado del cliente. Para conversaciones de larga duración con la API Responses, puedes usar el punto de acceso /responses/compact para reducir el contexto que envías en cada turno.

4 dic
Función
gpt-5.1-codex-max
v1/responses

Lanzamos gpt-5.1-codex-max en la API Responses. GPT-5.1-Codex es nuestro modelo de programación más inteligente, optimizado para tareas de codificación con agentes de larga duración. Lee más aquí.

noviembre de 2025

20 nov
Función
v1/realtime

Agregamos compatibilidad con pulsaciones de teclas DTMF en la Realtime API. Ahora puedes recibir eventos DTMF mientras usas una conexión de canal lateral de Realtime. Consulta la documentación aquí para obtener más información.

13 nov
Función
gpt-5.1
gpt-5.1-codex
gpt-5.1-chat-latest
gpt-5.1-codex-mini
v1/responses
v1/chat/completions

Lanzamos GPT-5.1, el modelo insignia más reciente de la familia de modelos GPT-5. GPT-5.1 está entrenado para destacarse especialmente en:

  • Capacidad de responder a indicaciones y ofrecer respuestas más rápidas cuando se requiere menos razonamiento
  • Generación de código y casos de uso de programación
  • Flujos de trabajo con agentes

Ten en cuenta que GPT-5.1 usa de forma predeterminada la nueva configuración de razonamiento none para responder más rápido cuando se requiere menos razonamiento, a diferencia de la configuración predeterminada anterior medium de GPT-5.

13 nov
Función

Lanzamos controles de acceso basados en roles (RBAC) mejorados. El control de acceso basado en roles (RBAC) te permite decidir quién puede hacer qué en tu organización y tus proyectos, tanto a través de la API como en el panel.

13 nov
Función
gpt-5.1-codex
gpt-5.1-codex-mini
v1/responses

Lanzamos gpt-5.1-codex y gpt-5.1-codex-mini en la API Responses. GPT-5.1-Codex es una versión de GPT-5.1 optimizada para tareas de codificación con agentes en Codex o entornos similares. Lee más aquí.

13 nov
Función

Lanzamos la retención extendida de la caché de prompts. La retención extendida de la caché de prompts mantiene activos los prefijos almacenados en caché durante más tiempo, hasta un máximo de 24 horas. El almacenamiento extendido de prompts en caché transfiere los tensores de clave/valor al almacenamiento local de la GPU cuando la memoria está llena, lo que aumenta significativamente la capacidad de almacenamiento disponible para la caché.

octubre de 2025

29 oct
Función
gpt-oss-safeguard-120b
gpt-oss-safeguard-20b

gpt-oss-safeguard-120b y gpt-oss-safeguard-20b son modelos de razonamiento de seguridad basados en gpt-oss. Lee más aquí.

24 oct
Función

Lanzamos la gestión de claves empresariales (EKM). La gestión de claves empresariales (EKM) te permite cifrar tu contenido de cliente en OpenAI con claves administradas por tu propio sistema externo de gestión de claves (KMS).

24 oct
6 oct
Función
gpt-5-pro
gpt-realtime-mini
gpt-audio-mini
gpt-image-1-mini
sora-2
sora-2-pro
v1/responses
v1/batch
v1/chat/completions
v1/videos
v1/realtime
v1/images/generations

Lanzamos varias funciones nuevas en OpenAI DevDay:

Lanzamos GPT-5 Pro, una versión de GPT-5 que usa más recursos de cómputo para razonar con mayor profundidad y ofrecer mejores respuestas de forma constante.

Lanzamos GPT-Realtime mini y gpt-audio-mini para ofrecer un rendimiento de voz a voz más rentable.

Lanzamos gpt-image-1-mini para generar y editar imágenes a un menor costo.

Lanzamos v1/videos para generar y remezclar videos de gran riqueza visual, detallados y dinámicos con nuestros modelos más recientes, Sora 2 y Sora 2 Pro.

Lanzamos Agent Builder para crear visualmente flujos de trabajo multiagente personalizados.

Lanzamos ChatKit, una interfaz de chat integrable para implementar agentes.

Lanzamos herramientas de evaluación de trazas, conjuntos de datos y optimización de prompts.

Evaluaciones: agregamos compatibilidad con modelos de terceros.

Lanzamos el panel de estado del servicio.

1 oct
Función

Lanzamos la lista de direcciones IP permitidas. Esta lista restringe el acceso a la API a las direcciones o los rangos de IP que especifiques.

septiembre de 2025

26 sept
Función
v1/responses

Agregamos compatibilidad con imágenes y archivos como resultado de una llamada a herramientas en la API Responses.

23 sept
Función
gpt-5-codex
v1/responses

Lanzamos el modelo especializado gpt-5-codex, creado y optimizado para usarse con Codex CLI.

agosto de 2025

28 ago
Función
v1/realtime

La Realtime API de OpenAI ya está disponible de forma general. Obtén más información en nuestra guía de la Realtime API.

21 ago
Función
v1/responses

Agregamos compatibilidad con conectores en la API Responses. Los conectores son adaptadores MCP mantenidos por OpenAI para servicios populares como las aplicaciones de Google, Dropbox y otros, que permiten dar al modelo acceso de lectura a los datos almacenados en esos servicios.

20 ago
Función
v1/conversations
v1/responses
v1/assistants

Lanzamos la API Conversations, que te permite crear y gestionar conversaciones de larga duración con la API Responses. Consulta la guía de migración para ver una comparación en paralelo y aprender a migrar una integración de la API de asistentes a Responses y Conversations.

7 ago
Función
v1/chat/completions
v1/responses

Lanzamos la familia de modelos GPT-5 en la API, que incluye gpt-5, gpt-5-mini y gpt-5-nano.

Introdujimos el valor minimal de esfuerzo de razonamiento para optimizar la rapidez de las respuestas en los modelos GPT-5 (que admiten razonamiento).

Introdujimos el tipo de llamada a herramientas custom, que permite entradas y salidas de formato libre del modelo al llamar a herramientas.

junio de 2025

27 jun
Función

Agregamos compatibilidad con el procesamiento prioritario. El procesamiento prioritario ofrece una latencia significativamente menor y más estable que el procesamiento estándar, y mantiene la flexibilidad del pago por uso.

24 jun
Función
o3-deep-research
o3-deep-research-2025-06-26
o4-mini-deep-research
o4-mini-deep-research-2025-06-26
v1/responses

Lanzamos o3-deep-research y o4-mini-deep-research, variantes de investigación profunda de nuestros modelos de razonamiento de la serie o, optimizadas para tareas de análisis e investigación en profundidad. Obtén más información en la guía de investigación profunda.

Agregamos compatibilidad con el manejo asíncrono de eventos mediante webhooks. Redujimos y simplificamos los precios de la herramienta de búsqueda web. Agregamos compatibilidad con la herramienta de búsqueda web.

13 jun
Función
v1/responses

Los nuevos prompts reutilizables ya están disponibles en el panel y en la API Responses. Ahora puedes hacer referencia desde la API a las plantillas creadas en el panel mediante el parámetro prompt (con un id de prompt y un version opcional) y proporcionar variables dinámicas que pueden incluir cadenas, imágenes o archivos de entrada. Los prompts reutilizables no están disponibles en Chat Completions. Obtén más información.

10 jun
Función
o3-pro
v1/responses
v1/batch

Lanzamos o3-pro, una versión del modelo de razonamiento o3 que usa más recursos de cómputo para resolver problemas difíciles con mejor razonamiento y mayor consistencia. También redujimos los precios del modelo o3 para todas las solicitudes a la API, incluidos el procesamiento por lotes y el procesamiento Flex.

4 jun
Función
v1/fine_tuning

Agregamos compatibilidad con el ajuste fino mediante optimización directa de preferencias para los modelos gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 y gpt-4.1-nano-2025-04-14.

3 jun
Función
v1/chat/completions
v1/realtime

Ya están disponibles nuevas versiones de gpt-4o-audio-preview y gpt-4o-realtime-preview. Lanzamos el SDK de agentes para TypeScript.

mayo de 2025

20 may
Función
v1/responses

Agregamos compatibilidad con nuevas herramientas integradas en la API Responses, incluidos los servidores MCP remotos y el intérprete de código. Obtén más información sobre las herramientas.

20 may
Función
v1/responses
v1/chat/completions

Agregamos compatibilidad con el modo strict para los esquemas de herramientas al realizar llamadas a herramientas en paralelo con modelos sin ajuste fino. Agregamos nuevas funciones de esquema, como la validación de cadenas para email y otros patrones, y la especificación de rangos para números y arreglos.

15 may
Función
codex-mini-latest
v1/responses
v1/chat/completions

Lanzamos codex-mini-latest en la API, optimizado para usarse con Codex CLI.

7 may
Función
v1/fine-tuning
v1/responses
v1/chat/completions

Agregamos compatibilidad con el ajuste fino por refuerzo. Conoce los métodos de ajuste fino disponibles. Ahora puedes realizar ajuste fino en gpt-4.1-nano.

abril de 2025

23 abr
Función
v1/images/generations
v1/images/edits

Agregamos un nuevo modelo de generación de imágenes, gpt-image-1. Este modelo establece un nuevo estándar para la generación de imágenes, con mejoras en la calidad y el seguimiento de instrucciones.

Actualizamos los puntos de acceso de generación y edición de imágenes para admitir nuevos parámetros específicos del modelo gpt-image-1.

16 abr
Función
v1/chat/completions
v1/responses

Agregamos dos nuevos modelos de razonamiento de la serie o, o3 y o4-mini. Establecen un nuevo estándar en matemáticas, ciencias, programación, tareas de razonamiento visual y redacción técnica.

Lanzamos Codex, nuestra herramienta CLI de generación de código.

14 abr
Función
gpt-4.1
gpt-4.1-mini
gpt-4.1-nano
v1/responses
v1/chat/completions
v1/fine_tuning

Agregamos los modelos gpt-4.1, gpt-4.1-mini y gpt-4.1-nano a la API. Estos nuevos modelos ofrecen mejoras en el seguimiento de instrucciones y la programación, además de una ventana de contexto más grande (hasta 1 millón de tokens). gpt-4.1 y gpt-4.1-mini están disponibles para ajuste fino supervisado. Anunciamos la obsolescencia de gpt-4.5-preview.

marzo de 2025

20 mar
Actualización
v1/audio

Agregamos los modelos gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe y whisper-1 a la API de audio.

19 mar
Función
o1-pro
v1/responses
v1/batch

Lanzamos o1-pro, una versión del modelo de razonamiento o1 que usa más recursos de cómputo para resolver problemas difíciles con mejor razonamiento y mayor consistencia.

11 mar
Función
gpt-4o-search-preview
gpt-4o-mini-search-preview
computer-use-preview
v1/chat/completions
v1/assistants
v1/responses

Lanzamos varios modelos y herramientas nuevos, además de una nueva API para flujos de trabajo con agentes:

  • Lanzamos la API Responses, una nueva API para crear y usar agentes y herramientas.
  • Lanzamos un conjunto de herramientas integradas para la API Responses: búsqueda web, búsqueda de archivos y uso de la computadora.
  • Lanzamos el SDK de agentes, un framework de orquestación para diseñar, crear e implementar agentes.
  • Anunciamos nuevos modelos: gpt-4o-search-preview, gpt-4o-mini-search-preview, computer-use-preview.
  • Anunciamos planes para incorporar todas las funciones de la API de asistentes a la API Responses, que es más fácil de usar, con el cierre de Assistants previsto para 2026 (después de alcanzar la paridad completa de funciones).
3 mar
Función
v1/fine_tuning/jobs

Agregamos compatibilidad con el campo metadata en los trabajos de ajuste fino.

febrero de 2025

27 feb
Función
GPT-4.5
v1/chat/completions
v1/assistants
v1/batch

Lanzamos una versión preliminar de investigación de GPT-4.5, nuestro modelo de chat más grande y capaz hasta la fecha. El alto “coeficiente emocional” de GPT-4.5 y su comprensión de la intención del usuario mejoran su desempeño en tareas creativas y en la planificación con agentes.

25 feb
Función

Lanzamos la actualización del panel de uso de la API. Esta actualización responde a las solicitudes de filtros de datos adicionales, como la selección de proyectos, el selector de fechas y los intervalos más detallados. También mejora la visualización del uso en distintos productos y niveles de servicio.

5 feb
Función

Presentamos la residencia de datos en Europa. Obtén más información aquí.

enero de 2025

31 ene
Función
o3-mini
o3-mini-2025-01-31
v1/chat/completions

Lanzamos o3-mini, un nuevo modelo de razonamiento pequeño optimizado para tareas de ciencia, matemáticas y programación.

21 ene
Función
o1

Ampliamos el acceso al modelo o1. Los modelos de la serie o1 se entrenan con aprendizaje por refuerzo para realizar razonamientos complejos.

diciembre de 2024

18 dic
Función

Lanzamos la rotación de claves de la API de administración, que permite a los clientes rotar sus claves de la API de administración de forma programática.

Actualizamos las invitaciones de la API de administración, lo que permite a los clientes invitar usuarios a proyectos de forma programática al mismo tiempo que los invitan a organizaciones.

17 dic
Función
o1
gpt-4o
gpt-4o-mini
v1/fine_tuning
v1/chat/completions
v1/realtime

Agregamos nuevos modelos para o1, gpt-4o-realtime, gpt-4o-audio y más.

Agregamos el método de conexión WebRTC para la Realtime API.

Agregamos el parámetro reasoning_effort para los modelos o1.

Agregamos el rol de mensaje developer para el modelo o1. Ten en cuenta que o1-preview y o1-mini no admiten mensajes de sistema ni de desarrollador.

Lanzamos el ajuste fino según preferencias mediante la optimización directa de preferencias (DPO).

Lanzamos los SDK para Go y Java en versión beta. Obtén más información.

Agregamos compatibilidad con la Realtime API en el SDK de Python.

4 dic
Función

Lanzamos la API de uso, que permite a los clientes consultar de forma programática la actividad y los gastos en las API de OpenAI.

noviembre de 2024

20 nov
Actualización
v1/chat/completions

Lanzamos gpt-4o-2024-11-20, nuestro modelo más reciente de la serie gpt-4o.

4 nov
Función
v1/chat/completions

Lanzamos los resultados predichos, que reducen considerablemente la latencia de las respuestas del modelo cuando gran parte de la respuesta se conoce de antemano. Esto ocurre con mayor frecuencia al regenerar el contenido de documentos y archivos de código con cambios menores.

octubre de 2024

30 oct
Función
gpt-4o-realtime-preview
gpt-4o-audio-preview
v1/chat/completions

Agregamos cinco nuevos tipos de voz en la Realtime API y la API para completar chats.

17 oct
Función
gpt-4o-audio-preview
v1/chat/completions

Lanzamos el nuevo modelo gpt-4o-audio-preview para completar chats, que admite tanto entradas como salidas de audio. Usa el mismo modelo subyacente que la Realtime API.

1 oct
Función
v1/realtime
v1/chat/completions
v1/fine_tuning

Lanzamos varias funciones nuevas en OpenAI DevDay en San Francisco:

Realtime API: incorpora experiencias rápidas de voz a voz en tus aplicaciones mediante una interfaz de WebSockets.

Destilación de modelos: plataforma para realizar el ajuste fino de modelos rentables con los resultados que obtengas de un modelo grande de vanguardia.

Ajuste fino con imágenes: realiza el ajuste fino de GPT-4o con imágenes y texto para mejorar sus capacidades de visión.

Evaluaciones: crea y ejecuta evaluaciones personalizadas para medir el rendimiento del modelo en tareas específicas.

Almacenamiento de prompts en caché: descuentos y tiempos de procesamiento más rápidos para tokens de entrada vistos recientemente.

Generar en Playground: genera fácilmente prompts, definiciones de funciones y esquemas de resultados estructurados en Playground con el botón Generar.

septiembre de 2024

26 sept
Función
omni-moderation-latest
v1/moderations

Lanzamos el nuevo modelo de moderación omni-moderation-latest, que admite imágenes y texto (para algunas categorías), incorpora dos nuevas categorías de daño exclusivas para texto y ofrece puntuaciones más precisas.

12 sept
Función
o1-preview
o1-mini
v1/chat/completions

Lanzamos o1-preview y o1-mini, nuevos modelos de lenguaje grandes entrenados con aprendizaje por refuerzo para realizar tareas de razonamiento complejo.

agosto de 2024

20 ago
Función
gpt-4o
v1/fine_tuning

El ajuste fino de gpt-4o-2024-08-06 ya está disponible de forma general. Todos los usuarios de la API ahora pueden realizar el ajuste fino del modelo GPT-4o más reciente.

15 ago
Actualización
gpt-4o
v1/chat/completions

Lanzamos un modelo dinámico para chatgpt-4o-latest. Este modelo apuntará al modelo GPT-4o más reciente que usa ChatGPT.

6 ago
Actualización

Lanzamos los resultados estructurados. Los resultados del modelo ahora se ajustan de forma confiable a los esquemas JSON proporcionados por los desarrolladores.

Lanzamos gpt-4o-2024-08-06, nuestro modelo más reciente de la serie gpt-4o.

1 ago
Actualización

Lanzamos las API de administración y registros de auditoría, que permiten a los clientes administrar su organización de forma programática y supervisar los cambios mediante los registros de auditoría. El registro de auditoría debe habilitarse en la configuración.

julio de 2024

24 jul
Actualización

Lanzamos la configuración de SSO de autoservicio, que permite a los clientes empresariales con facturación personalizada e ilimitada configurar la autenticación con el IDP que elijan.

23 jul
Actualización

Lanzamos el ajuste fino de GPT-4o mini, que permite lograr un rendimiento aún mayor en casos de uso específicos.

18 jul
Actualización

Lanzamos GPT-4o mini, nuestro modelo pequeño, económico e inteligente para tareas rápidas y ligeras.

17 jul
Actualización

Lanzamos Uploads para cargar archivos grandes en varias partes.

junio de 2024

6 jun
Actualización

La llamada a funciones en paralelo se puede deshabilitar en Chat Completions y en la API de asistentes pasando parallel_tool_calls=false.

Lanzamos el SDK de .NET en versión beta.

3 jun
Actualización

Agregamos compatibilidad con la personalización de la búsqueda de archivos.

mayo de 2024

15 may
Actualización

Agregamos la posibilidad de archivar proyectos . Solo los propietarios de la organización pueden acceder a esta función.

Agregamos la posibilidad de establecer límites de costo por proyecto para los clientes de pago por uso.

13 may
Actualización

Lanzamos GPT-4o en la API. GPT-4o es nuestro modelo insignia más rápido y económico.

9 may
Actualización
7 may
Actualización
6 may
Actualización

Agregamos el parámetro stream_options: {"include_usage": true} a las API de Chat Completions y Completions. Configurarlo permite a los desarrolladores acceder a las estadísticas de uso al utilizar la transmisión continua.

2 may
Actualización

Agregamos un nuevo punto de acceso para eliminar un mensaje de un hilo en la API de asistentes.

abril de 2024

29 abr
Actualización

Agregamos una nueva opción de llamada a funciones, tool_choice: "required", a la API para completar chats y la API de asistentes.

Agregamos una guía de la API de procesamiento por lotes y compatibilidad con modelos de embeddings en esta API

17 abr
Actualización

Presentamos una serie de actualizaciones de la API de asistentes , que incluyen una nueva herramienta de búsqueda de archivos que permite hasta 10 000 archivos por asistente, nuevos controles de tokens y compatibilidad con la selección de herramientas.

16 abr
Actualización

Presentamos una jerarquía basada en proyectos para organizar el trabajo por proyectos, con la posibilidad de crear claves de API y administrar límites de solicitudes y de costo por proyecto (los límites de costo solo están disponibles para clientes empresariales).

15 abr
Actualización
9 abr
Actualización

Lanzamos GPT-4 Turbo with Vision con disponibilidad general en la API

4 abr
Actualización

Agregamos compatibilidad con seed en la API de ajuste fino

Agregamos compatibilidad con puntos de control en la API de ajuste fino

Agregamos la posibilidad de agregar mensajes al crear una ejecución en la API de asistentes

1 abr
Actualización

Agregamos la posibilidad de filtrar mensajes por run_id en la API de asistentes

marzo de 2024

29 mar
Actualización

Agregamos compatibilidad con temperature y la creación de mensajes del asistente en la API de asistentes

14 mar
Actualización

Agregamos compatibilidad con la transmisión continua en la API de asistentes

febrero de 2024

9 feb
Actualización

Agregamos el parámetro timestamp_granularities a la API de audio

enero de 2024

25 ene
Actualización

Lanzamos los modelos de embeddings V3 y una versión preliminar actualizada de GPT-4 Turbo

Agregamos el parámetro dimensions a la API de embeddings

diciembre de 2023

20 dic
Actualización

Agregamos el parámetro additional_instructions a la creación de ejecuciones en la API de asistentes

15 dic
Actualización

Se agregaron los parámetros logprobs y top_logprobs a la API para completar chats

14 dic
Actualización

El argumento de parámetros de función en una llamada a herramientas ahora es opcional

noviembre de 2023

30 nov
Actualización

Se lanzó OpenAI Deno SDK

octubre de 2023

16 oct
Actualización

Se agregó el parámetro encoding_format a la API de embeddings

Se agregó max_tokens a los modelos de moderación

6 oct
Actualización

Se agregó compatibilidad con la llamada a funciones a la API de ajuste fino