Registro de alterações
setembro de 2026
Foram adicionados controles de governança para a criação de chaves de API nos níveis da organização e do projeto. Os administradores podem permitir apenas chaves de contas de serviço, permitir apenas chaves de projeto pertencentes a usuários ou desativar por completo a criação de novas chaves de API. As restrições da organização prevalecem sobre as configurações do projeto, e as chaves de API existentes não são afetadas. Consulte as práticas recomendadas para produção para obter detalhes.
Agora você pode definir datas de expiração ao criar chaves de API de projeto. Os administradores também podem impor um prazo máximo de validade para as chaves no nível da organização ou do projeto nas configurações da plataforma, exigindo que as novas chaves expirem dentro do limite configurado. Consulte as práticas recomendadas para produção para obter orientações sobre expiração e rotação de chaves.
Lançamos a API de Agentes em beta público. Crie agentes com um harness gerenciado do Codex enquanto a OpenAI cuida da orquestração de sessões, da compactação de contexto e da recuperação.
Use sessões duráveis para dar continuidade ao trabalho entre turnos, transmitir o progresso em tempo real e conectar suas próprias ferramentas e servidores MCP. Execute agentes em sandboxes hospedados pela OpenAI ou conecte um sandbox da sua própria infraestrutura ou de um provedor compatível.
Comece pelo início rápido da API de Agentes.
O GPT-Live 1 agora está disponível para uso geral na API. Crie conversas por voz que permitem falar e ouvir ao mesmo tempo e que podem continuar enquanto um modelo ou agente no backend cuida do raciocínio e das ferramentas.
Use a delegação via Responses com um modelo da OpenAI ou a delegação ao cliente para conectar seu próprio backend. As sessões de voz custam US$ 0,05 por minuto, com cobrança por segundo; o uso do modelo no backend e das ferramentas é cobrado separadamente.
Comece pelo GPT-Live, pela criação de prompts e pelas orientações de migração. Consulte os preços para obter detalhes.
O Diagnóstico do cache de prompts agora está disponível para uso geral na API Responses para o GPT-5.6 e modelos posteriores compatíveis.
Compare a reutilização do cache com a de uma resposta anterior, identifique os motivos das falhas de cache e siga as orientações de solução de problemas para melhorar a reutilização do cache.
Lançamos o GPT Image 2.5 Sunburst e o GPT Image 2.5 Flare para geração e edição de imagens pela API Image e pela ferramenta de geração de imagens da API Responses.
Use o Sunburst em fluxos de trabalho nos quais a precisão da edição é a prioridade, ou o Flare para gerar imagens rapidamente e com alta qualidade no dia a dia. Ambos os modelos oferecem suporte às novas configurações de qualidade xhigh e max e usam as tarifas por token do GPT Image 2. Consulte o guia de geração de imagens e os preços.
O GPT-Rosalind (gpt-rosalind-research) agora está disponível para uso geral por meio do programa de acesso confiável para pesquisas internas aprovadas na área de ciências da vida.
Os preços padrão são US$ 5 por 1 milhão de tokens de entrada, US$ 0,50 por 1 milhão de tokens de entrada em cache e US$ 25 por 1 milhão de tokens de saída. A cobrança começa em 5 de outubro de 2026. Consulte os preços para obter detalhes.
Lançamos o GPT-6 Astra, nosso modelo mais capaz, desenvolvido para realizar os trabalhos mais difíceis do início ao fim.
Use o GPT-6 Astra para raciocínio, programação, uso do computador, pesquisa e criação de documentos. Ele combina essas capacidades para conduzir tarefas complexas da solicitação inicial ao resultado final, usando o contexto e as ferramentas que você fornece.
Principais mudanças a considerar na migração:
- O GPT-6 Astra não oferece suporte ao nível de esforço de raciocínio
none. - O GPT-6 Astra não oferece suporte a valores personalizados de
temperatureoutop_p, nem a probabilidades logarítmicas (logprobs). - A chamada de ferramentas exige a API Responses. Se você usa ferramentas com Chat Completions, siga o guia de migração para a API Responses.
- O monitoramento de desalinhamento verifica de forma assíncrona se há possíveis problemas durante o trabalho do agente em solicitações compatíveis da API Responses. As verificações podem acionar alertas de segurança ou interromper uma conversa para revisão.
Comece por Como usar o GPT-6 Astra para conhecer suas capacidades e obter orientações sobre criação de prompts e migração. Explore o uso do computador para fluxos de trabalho no navegador e no desktop, e consulte os preços para conhecer os níveis de inferência disponíveis.
Adicionamos novos controles para trabalhos de longa duração com o GPT-6 Astra na API Responses:
- Chamada assíncrona de ferramentas: permita que o modelo continue trabalhando enquanto seu aplicativo executa ferramentas de função ou personalizadas e retorne os resultados à medida que ficarem disponíveis.
- Orientação durante o turno: envie instruções adicionais enquanto uma resposta estiver em andamento via WebSockets, para que o modelo possa incorporar correções ou mudanças nos requisitos.
- Alterar o esforço de raciocínio durante a conversa: aumente o esforço para trabalhos difíceis ou reduza-o para solicitações de acompanhamento rotineiras, preservando o prefixo do prompt armazenado em cache.
Atualizamos os erros da API para que os aplicativos possam distinguir um aumento rápido demais no tráfego de uma sobrecarga temporária do modelo.
Um aumento rápido demais no tráfego pode retornar um erro 429 com o código slow_down. A sobrecarga temporária do modelo retorna um erro 503 com o código server_is_overloaded. Ambas as respostas podem incluir Retry-After. Quando esse cabeçalho estiver presente, aguarde pelo menos o tempo que ele especifica antes de tentar novamente. Se estiver ausente, use espera exponencial entre as tentativas. Consulte o guia de códigos de erro e o guia de limites de taxa.
As conexões com api.openai.com agora podem usar IPv6.
agosto de 2026
O TLS mútuo (mTLS) e a federação de identidades de cargas de trabalho X.509 agora estão disponíveis para uso geral na API da OpenAI. Configure certificados e provedores de identidade X.509 diretamente no console da plataforma, com acesso controlado pelas funções e permissões da sua organização.
Anunciamos a descontinuação de whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe e gpt-4o-transcribe-diarize. Esses modelos serão desativados em 26 de fevereiro de 2027. Migre para gpt-live-transcribe ou gpt-transcribe. Consulte o guia de transcrição e a página de descontinuações.
A API Assistants foi desativada em 26 de agosto de 2026. Migre para a API Responses e a API Conversations usando o guia de migração.
Os clientes da API agora podem selecionar o processamento regional para uma solicitação individual usando um domínio com prefixo e uma chave de API de um projeto com região geográfica Global. Os requisitos existentes de elegibilidade, controle de retenção de dados, endpoint e suporte a modelos continuam se aplicando. Saiba mais no guia de controles de dados.
O GPT-5.6 Sol agora custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, uma redução de 20% no preço de entrada e de 33% no preço de saída. Os preços promocionais do GPT-5.6 Sol estão disponíveis pelo menos até 21 de novembro de 2026. Veja os detalhes dos preços.
Lançamos o painel de cache de prompts na Plataforma de API da OpenAI. Acompanhe a taxa de acertos do cache ao longo do tempo, as leituras de cache por gravação e a distribuição dos tokens lidos do cache, gravados no cache e não armazenados em cache para entender a eficiência do cache e identificar oportunidades de melhoria. Filtre as métricas por modelo e nível de serviço.
Fundos transparentes agora estão disponíveis em versão prévia para gpt-image-2 e gpt-image-2-2026-04-21 na API Images e na ferramenta de geração de imagens da API Responses. Defina background como transparent e use o formato de saída png ou webp; jpeg não oferece suporte a fundos transparentes. Saiba mais no guia de geração de imagens.
Anunciamos o modo ultrarrápido, um novo nível de serviço da API para o GPT-5.6 Sol que executa até 14 vezes mais rápido que o processamento padrão. Disponível em versão prévia limitada para clientes selecionados. Inscreva-se aqui para receber atualizações sobre o modo ultrarrápido.
O Daybreak agora oferece dois níveis de acesso para profissionais de defesa aprovados: Daybreak Blue e Daybreak Red. Use-os para avançar dos problemas de segurança identificados às correções validadas em trabalhos explicitamente autorizados.
Comece com o Daybreak Blue para a maioria dos trabalhos de segurança defensiva. Ele oferece acesso a modelos de uso geral, como o GPT-5.6 Sol, para descoberta de vulnerabilidades, revisão de segurança do código, engenharia de detecção, resposta a incidentes, análise de malware e validação de patches. Leia mais aqui.
O Daybreak Red oferece acesso, sujeito a aprovação separada, a modelos treinados especificamente para esse fim, como o GPT-5.6 Cyber, para atividades autorizadas de reprodução de vulnerabilidades, validação de exploits, testes de penetração, red teaming e análise de sistemas complexos.
Esses modelos exigem aprovação e provisionamento separados. Você pode solicitar a participação no programa Daybreak aqui. Veja mais detalhes sobre os preços aqui.
Atualizamos o snapshot chat-latest , que aponta para o modelo mais recente disponível no ChatGPT para usuários Plus e Pro. Recomendamos usar o GPT-5.6 Sol para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.
O modo Fast agora oferece suporte a solicitações de contexto longo para GPT-5.6 Sol, GPT-5.6 Terra e GPT-5.6 Luna. A partir de hoje, prompts de contexto longo com mais de 272 mil tokens podem ser executados no modo Fast, com velocidades até 2,5 vezes maiores que as do nível padrão. Veja os detalhes dos preços.
Os clientes agora podem filtrar e agrupar dados por chave de API nos painéis de uso e custos. A API de uso e a API de custos também oferecem suporte à dimensão de chave de API para geração programática de relatórios e análises.
julho de 2026
A partir de 30 de julho, o GPT-5.6 Luna custa 80% menos, enquanto o GPT-5.6 Terra custa 20% menos. Veja os detalhes dos preços.
Também estamos lançando o modo Fast na API, que substitui nossa oferta de processamento prioritário. Para o GPT-5.6 Sol, o modo Fast agora oferece velocidades até 2,5 vezes maiores que as do processamento padrão pelo dobro do preço. Essa mudança mantém a compatibilidade com versões anteriores: solicitações marcadas como priority usarão automaticamente o modo Fast.
Lançamos o provedor Terraform da OpenAI oficial para gerenciar recursos da Plataforma de API da OpenAI como infraestrutura como código.
Provisione e gerencie projetos, usuários, grupos, funções, atribuições de acesso, contas de serviço, certificados, convites e limites de taxa por projeto. Use os fluxos de trabalho padrão do Terraform para revisar e aplicar alterações, importar recursos existentes e detectar e corrigir divergências de configuração. Instale o provedor pelo Terraform Registry.
Lançamos o GPT Transcribe para transcrição precisa de arquivos e transcrições finais de turnos confirmados do Realtime, junto com o GPT Live Transcribe para transcrição em streaming com baixa latência.
Ambos os modelos oferecem suporte a contexto de transcrição em formato livre, dicas de palavras-chave e múltiplos idiomas de entrada esperados. Compare as saídas e os fluxos de trabalho compatíveis no guia de transcrição.
Adicionamos limites rígidos de gastos para organizações e projetos na Plataforma de API da OpenAI. Defina um teto mensal que faça as solicitações de API afetadas retornarem um erro 429 quando os gastos contabilizados atingirem o limite. Use alertas de gastos para receber notificações antes que o tráfego seja interrompido. Leia mais no guia de limites de gastos.
Lançamos a família de modelos GPT-5.6, que inclui o GPT-5.6 Sol para capacidades de fronteira, o GPT-5.6 Terra para equilibrar inteligência e custo, e o GPT-5.6 Luna para processar com eficiência cargas de trabalho de alto volume. O alias gpt-5.6 encaminha as solicitações para gpt-5.6-sol.
O GPT-5.6 adiciona chamada programática de ferramentas, controles explícitos de cache de prompts, raciocínio persistido, esforço de raciocínio max e modo Pro, além de orquestração de múltiplos agentes em versão beta para a API Responses. O GPT-5.6 também aceita imagens nas dimensões originais com o nível de detalhe de imagem original ou auto.
Lançamos o GPT-Realtime-2.1, um modelo de raciocínio em tempo real atualizado, com melhorias no reconhecimento alfanumérico, no tratamento de silêncio e ruído e no comportamento diante de interrupções. Também lançamos o GPT-Realtime-2.1 mini, um modelo de raciocínio destilado, mais rápido e de menor custo, para aplicativos de voz em tempo real.
junho de 2026
Atualizamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.
Lançamos o painel de uso de segurança na Plataforma de API da OpenAI. O painel de segurança mostra solicitações bloqueadas da API Responses com base nos valores de safety_identifier enviados nas solicitações para identificar os usuários finais. Acesse o painel de segurança.
A pesquisa na Web agora pode retornar resultados de imagens junto com os resultados de texto habituais. Use a pesquisa de imagens quando seu aplicativo precisar de imagens atuais ou obtidas na Web, como fotos de produtos, pontos de referência, lugares, eventos ou referências visuais. Leia mais no guia de pesquisa na Web.
Lançamos uma navegação reformulada para a Plataforma de API da OpenAI. Acesse aqui.
Adicionamos pontuações de moderação à API Responses e à API Chat Completions. Passe um objeto moderation em uma solicitação de geração para receber, na mesma resposta, os resultados de moderação tanto da entrada do modelo quanto da saída gerada.
Saiba mais no guia de moderação.
Anunciamos a descontinuação dos objetos de prompt reutilizáveis, da plataforma de avaliações e do Criador de agentes. Consulte a página de descontinuações para ver os prazos de desativação e as orientações de migração.
A partir de 2 de junho de 2026, as sessões de contêiner elegíveis serão cobradas por minuto, com um mínimo de 5 minutos, em vez de serem cobradas pelo valor integral de uma sessão de 20 minutos. A tarifa por minuto permanecerá a mesma.
Essa atualização busca tornar a cobrança mais granular para sessões mais curtas e reduzirá o custo efetivo para os clientes.
Você pode consultar os preços atuais das ferramentas integradas na nossa documentação de preços da API.
Os modelos da OpenAI agora estão disponíveis no Amazon Bedrock por meio de um endpoint da API Responses compatível com a OpenAI. Os modelos e recursos compatíveis variam conforme a região da AWS. Saiba mais.
maio de 2026
Para organizações sem ZDR habilitado, prompt_cache_retention agora usa 24h como padrão em vez de in_memory, habilitando o cache estendido de prompts por padrão. Saiba mais.
Lançamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.
Lançamos a federação de identidades de cargas de trabalho. Cargas de trabalho confiáveis podem trocar tokens de identidade emitidos externamente por tokens de acesso da OpenAI de curta duração, sem armazenar chaves de API de longa duração.
Adicionamos novos recursos à API de administração para gerenciar alertas de gastos, listas de modelos permitidos, configurações de retenção de dados e permissões de ferramentas hospedadas, além de consultar itens detalhados de cobrança.
Lançamos o Túnel MCP seguro para clientes empresariais. O Túnel MCP seguro permite que produtos compatíveis da OpenAI, incluindo ChatGPT na Web, Codex, API Responses e AgentKit, se conectem a servidores MCP privados ou locais por meio de um tunnel-client hospedado pelo cliente, sem expor esses servidores à internet pública.
Agora você pode gerenciar várias listas de IPs permitidos e aplicar cada uma a um projeto ou à organização inteira. Para configurá-las, acesse Configurações > Segurança > Lista de IPs permitidos.
Descontinuamos os snapshots dos modelos DALL·E e a versão beta da Realtime API.
Os snapshots dos modelos DALL·E dall-e-2 e dall-e-3 foram descontinuados e removidos da API em 12 de maio de 2026. Recomendamos usar gpt-image-2, gpt-image-1 ou gpt-image-1-mini como alternativa.
A versão beta da Realtime API foi descontinuada e removida da API em 12 de maio de 2026. Se você ainda usa a interface beta, migre para a versão estável da Realtime API. Consulte o guia de migração e a página de descontinuações completa.
Adicionamos return_token_budget à ferramenta de pesquisa na Web da API Responses. Use esse parâmetro para habilitar pesquisas na Web mais longas com raciocínio do GPT-5+ em cargas de trabalho de pesquisa e avaliação que exigem alto esforço.
Lançamos o GPT-Realtime-2, um novo modelo de voz em tempo real com raciocínio configurável para agentes de fala para fala, junto com o GPT-Realtime-Translate para tradução de fala em streaming e o GPT-Realtime-Whisper para conversão de fala em texto em streaming.
Atualizamos o guia de tempo real e áudio, adicionamos um guia de tradução em tempo real dedicado, revisamos a documentação de transcrição em tempo real para transcrições em streaming e movemos as orientações de criação de prompts em tempo real para Como usar modelos em tempo real.
Lançamos o plug-in OpenAI Developers para Codex. Ele ajuda você a criar aplicativos de IA e agentes no Codex, com acesso à plataforma OpenAI e orientações de configuração da API da OpenAI.
O SDK de Agentes atualizado já está disponível em TypeScript, com suporte a agentes em sandbox e um harness de código aberto integrado. Saiba mais aqui.
Lançamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 na API em produção, mas você pode usar este modelo para testar nossas melhorias mais recentes para casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.
As APIs de administração agora têm suporte nos SDKs da OpenAI para Node, Python, Go, Ruby e Java. Consulte o guia das APIs de administração para ver instruções de configuração e exemplos.
abril de 2026
Lançamos o GPT-5.5, um novo modelo de fronteira para trabalhos profissionais complexos, nas APIs chat completions e Responses. Também lançamos o GPT-5.5 Pro para solicitações à API Responses voltadas a problemas mais difíceis que se beneficiam de mais recursos computacionais.
O GPT-5.5 oferece suporte a uma janela de contexto de 1 milhão de tokens, entrada de imagem, saídas estruturadas, chamada de função, cache de prompts, processamento em lote, pesquisa de ferramentas, uso do computador integrado, shell hospedado, aplicação de patches, Habilidades, MCP e pesquisa na Web. As principais atualizações incluem:
- O esforço de raciocínio agora usa
mediumpor padrão. - Quando
image_detailnão está definido ou está definido comoauto, o modelo agora usa o comportamento original. - O cache do GPT-5.5 funciona apenas com cache estendido de prompts. O cache de prompts em memória não é compatível. Saiba mais aqui.
Lançamos o GPT Image 2, um modelo de última geração para gerar e editar imagens. O GPT Image 2 oferece suporte a tamanhos de imagem flexíveis, entradas de imagem de alta fidelidade, preços de imagem baseados em tokens e uso da API Batch com desconto de 50%.
Atualizamos o SDK de Agentes com novas capacidades, incluindo:
- executar agentes em sandboxes controlados;
- inspecionar e personalizar o harness de código aberto; e
- controlar quando as memórias são criadas e onde são armazenadas.
março de 2026
Lançamos o GPT-5.4 mini e o GPT-5.4 nano nas APIs chat completions e Responses. O GPT-5.4 mini traz capacidades do nível do GPT-5.4 em um modelo mais rápido e eficiente para cargas de trabalho de alto volume, enquanto o GPT-5.4 nano é otimizado para tarefas simples de alto volume em que velocidade e custo são as principais prioridades.
O GPT-5.4 mini oferece suporte a pesquisa de ferramentas, uso do computador integrado e compactação. O GPT-5.4 nano oferece suporte a compactação, mas não a pesquisa de ferramentas ou uso do computador.
Atualizamos o slug gpt-5.3-chat-latest para apontar para o modelo mais recente usado atualmente no ChatGPT.
Atualizamos nosso codificador de imagens para corrigir um pequeno bug nas entradas input_image do GPT-5.4. Alguns casos de uso de compreensão de imagens podem agora apresentar melhor qualidade. Nenhuma ação é necessária.
Ampliamos a API do Sora com referências reutilizáveis de personagens, gerações mais longas de até 20 segundos, saída em 1080p para sora-2-pro, extensões de vídeo e suporte da API Batch para POST /v1/videos. As gerações em 1080p no sora-2-pro são cobradas a $0.70 por segundo. Saiba mais aqui.
Adicionamos POST /v1/videos/edits para editar vídeos existentes. Esse endpoint substituirá POST /v1/videos/{video_id}/remix, que será descontinuado em 6 meses. Saiba mais aqui.
Lançamos o GPT-5.4, nosso mais novo modelo de fronteira para trabalhos profissionais, nas APIs chat completions e Responses. Também lançamos o GPT-5.4 Pro na API Responses para problemas mais difíceis que se beneficiam de mais recursos computacionais.
Também lançamos:
- Pesquisa de ferramentas na API Responses, que permite aos modelos adiar o carregamento de grandes conjuntos de ferramentas até o momento da execução para reduzir o uso de tokens, preservar o desempenho do cache e melhorar a latência.
- Suporte integrado a Uso do computador no GPT-5.4 por meio da ferramenta
computerda API Responses, para interação com interfaces com base em capturas de tela. - Uma janela de contexto de 1 milhão de tokens e suporte nativo a Compactação para fluxos de trabalho de agentes de maior duração.
Lançamos gpt-5.3-chat-latest nas APIs chat completions e Responses. Esse modelo aponta para o snapshot do GPT-5.3 Instant usado atualmente no ChatGPT. Leia mais aqui.
fevereiro de 2026
Ampliamos o suporte a input_file na API Responses para aceitar mais tipos de arquivos de documentos, apresentações, planilhas, código e texto. Saiba mais aqui.
Lançamos phase na API Responses. Esse campo identifica uma mensagem do assistente como comentário intermediário (commentary) ou resposta final (final_answer). Leia mais aqui.
Lançamos gpt-5.3-codex na API Responses. Leia mais aqui.
Lançamos o modo WebSocket para a API Responses. Saiba mais aqui.
Lançamos o GPT-Realtime-1.5 na Realtime API.
Lançamos gpt-audio-1.5 na API chat completions. Leia mais aqui.
A API Batch agora oferece suporte aos modelos GPT Image: gpt-image-1.5, chatgpt-image-latest, gpt-image-1 e gpt-image-1-mini.
Atualizamos o slug gpt-5.2-chat-latest para apontar para o modelo mais recente usado atualmente no ChatGPT.
Lançamos a compactação no servidor na API Responses.
Lançamos o suporte a Habilidades na API Responses. Oferecemos suporte a Habilidades tanto na execução local quanto na execução em contêineres hospedados.
Lançamos uma nova ferramenta de Shell hospedado, além de suporte a conexões de rede em contêineres.
Adicionamos suporte a solicitações application/json em /v1/images/edits para modelos de imagem GPT. As solicitações JSON usam images (e, opcionalmente, mask) com referências image_url ou file_id em vez de uploads multipart.
Otimizamos nossa pilha de inferência para clientes da API, e o GPT-5.2 e o GPT-5.2-Codex agora são cerca de 40% mais rápidos. Os modelos e seus pesos permanecem inalterados.
janeiro de 2026
Anunciamos o Open Responses: uma especificação de código aberto para criar interfaces de LLM interoperáveis e compatíveis com vários provedores, com base na API Responses original da OpenAI.
Lançamos gpt-5.2-codex na API Responses. O GPT-5.2-Codex é uma versão do GPT-5.2 otimizada para tarefas de programação agêntica no Codex ou em ambientes semelhantes. Leia mais aqui.
Adicionamos faixas de IP dedicadas ao SIP para a Realtime API. sip.api.openai.com faz o roteamento por GeoIP e direcionará o tráfego SIP para a região mais próxima. Saiba mais.
Atualizamos os slugs gpt-realtime-mini e gpt-audio-mini para apontar para os snapshots de 2025-12-15. Se você precisar dos snapshots anteriores dos modelos, use gpt-realtime-mini-2025-10-06 e gpt-audio-mini-2025-10-06.
Atualizamos o slug sora-2 para apontar para sora-2-2025-12-08. Se você precisar do snapshot anterior do modelo, use sora-2-2025-10-06.
Atualizamos os slugs gpt-4o-mini-tts e gpt-4o-mini-transcribe para apontar para os snapshots de 2025-12-15. Se você precisar dos snapshots anteriores dos modelos, use gpt-4o-mini-tts-2025-03-20 e gpt-4o-mini-transcribe-2025-03-20. Atualmente, recomendamos usar gpt-4o-mini-transcribe em vez de gpt-4o-transcribe para obter os melhores resultados.
Corrigimos um problema que fazia gpt-image-1.5 e chatgpt-image-latest usarem incorretamente alta fidelidade nas edições de imagem por meio de /v1/images/edits, mesmo quando fidelity estava explicitamente definido como low (o padrão).
dezembro de 2025
Adicionamos gpt-image-1.5 e chatgpt-image-latest à ferramenta de geração de imagens da API Responses.
Lançamos o gpt-image-1.5 e o chatgpt-image-latest, nossos modelos mais recentes e avançados para geração de imagens. Leia mais aqui.
Lançamos quatro novos snapshots de áudio com data. Essas atualizações trazem melhorias de confiabilidade, qualidade e fidelidade de voz para aplicativos de voz em tempo real. Leia mais aqui.
- gpt-realtime-mini-2025-12-15
- gpt-audio-mini-2025-12-15
- gpt-4o-mini-transcribe-2025-12-15
- gpt-4o-mini-tts-2025-12-15
Esse lançamento também inclui suporte a Vozes personalizadas para clientes elegíveis.
Lançamos o GPT-5.2, o mais novo modelo principal da família GPT-5. O GPT-5.2 apresenta melhorias em relação ao GPT-5.1 anterior em:
- Inteligência geral
- Seguimento de instruções
- Precisão e eficiência no uso de tokens
- Multimodalidade, especialmente visão
- Geração de código, especialmente criação de interfaces de usuário para front-end
- Chamadas de ferramentas e gerenciamento de contexto na API
- Compreensão e criação de planilhas.
As novidades da versão 5.2 incluem o nível de esforço de raciocínio xhigh, resumos concisos de raciocínio e um novo gerenciamento de contexto com compactação.
Lançamos a compactação no lado do cliente. Para conversas de longa duração com a API Responses, você pode usar o endpoint /responses/compact para reduzir o contexto enviado a cada turno.
Lançamos gpt-5.1-codex-max na API Responses. GPT-5.1-Codex é nosso modelo de programação mais inteligente, otimizado para tarefas de programação agêntica de longa duração. Saiba mais aqui.
novembro de 2025
Adicionamos suporte a pressionamentos de teclas DTMF na Realtime API. Agora você pode receber eventos DTMF ao usar uma conexão de canal lateral do Realtime. Consulte a documentação aqui para saber mais.
Lançamos GPT-5.1, o mais novo modelo principal da família GPT-5. GPT-5.1 foi treinado para se destacar especialmente em:
- Capacidade de seguir direcionamentos e respostas mais rápidas quando é necessário menos raciocínio
- Geração de código e casos de uso de programação
- Fluxos de trabalho agênticos
Observe que GPT-5.1 usa por padrão a nova configuração de raciocínio none para responder mais rápido quando é necessário menos raciocínio, diferentemente da configuração padrão anterior, medium, do GPT-5.
Lançamos controles de acesso baseados em funções (RBAC) aprimorados. O controle de acesso baseado em funções (RBAC) permite definir quem pode fazer o quê na sua organização e nos seus projetos, tanto pela API quanto no painel.
Lançamos gpt-5.1-codex e gpt-5.1-codex-mini na API Responses. GPT-5.1-Codex é uma versão do GPT-5.1 otimizada para tarefas de programação agêntica no Codex ou em ambientes semelhantes. Saiba mais aqui.
Lançamos a retenção estendida do cache de prompts. A retenção estendida mantém os prefixos em cache ativos por mais tempo, até o máximo de 24 horas. O cache estendido de prompts transfere os tensores de chave/valor para o armazenamento local da GPU quando a memória está cheia, aumentando significativamente a capacidade de armazenamento disponível para cache.
outubro de 2025
gpt-oss-safeguard-120b e gpt-oss-safeguard-20b são modelos de raciocínio voltados à segurança, desenvolvidos com base no gpt-oss. Saiba mais aqui.
Lançamos o gerenciamento de chaves empresariais (EKM). O gerenciamento de chaves empresariais (EKM) permite criptografar seu conteúdo de cliente na OpenAI usando chaves gerenciadas pelo seu próprio sistema externo de gerenciamento de chaves (KMS).
Lançamos a residência de dados no Reino Unido.
Lançamos vários recursos novos no OpenAI DevDay:
Lançamos GPT-5 Pro, uma versão do GPT-5 que usa mais recursos computacionais para raciocinar de forma mais aprofundada e fornecer respostas consistentemente melhores.
Lançamos GPT-Realtime mini e gpt-audio-mini para oferecer melhor custo-benefício no processamento de fala para fala.
Lançamos gpt-image-1-mini para geração e edição de imagens com melhor custo-benefício.
Lançamos v1/videos para gerar e remixar vídeos ricos, detalhados e dinâmicos com nossos modelos mais recentes, Sora 2 e Sora 2 Pro.
Lançamos o Criador de agentes para criar visualmente fluxos de trabalho personalizados com múltiplos agentes.
Lançamos ChatKit, uma interface de chat incorporável para implantar agentes.
Lançamos ferramentas de avaliação de rastros, conjuntos de dados e otimização de prompts.
Avaliações: lançamos suporte a modelos de terceiros.
Lançamos o painel de integridade do serviço.
Lançamos a lista de IPs permitidos. Essa lista restringe o acesso à API aos endereços ou intervalos de IP que você especificar.
setembro de 2025
Adicionamos suporte a imagens e arquivos como saída de chamadas de ferramentas na API Responses.
Lançamos o modelo especializado gpt-5-codex, desenvolvido e otimizado para uso com o Codex CLI.
agosto de 2025
A Realtime API da OpenAI agora está disponível para uso geral. Saiba mais no nosso guia da Realtime API.
Adicionamos suporte a conectores na API Responses. Conectores são camadas de integração MCP mantidas pela OpenAI para serviços populares, como aplicativos do Google, Dropbox e outros. Eles podem ser usados para dar ao modelo acesso de leitura aos dados armazenados nesses serviços.
Lançamos a API Conversations, que permite criar e gerenciar conversas de longa duração com a API Responses. Consulte o guia de migração para ver uma comparação lado a lado e aprender a migrar uma integração com a API Assistants para Responses e Conversations.
Lançamos a família de modelos GPT-5 na API, incluindo gpt-5, gpt-5-mini e gpt-5-nano.
Introduzimos o valor minimal de esforço de raciocínio para priorizar respostas rápidas nos modelos GPT-5 (que oferecem suporte a raciocínio).
Introduzimos o tipo custom de chamada de ferramenta, que permite entradas e saídas em formato livre para o modelo ao chamar ferramentas.
junho de 2025
Lançamos suporte ao processamento prioritário. O processamento prioritário oferece latência significativamente menor e mais consistente em comparação com o processamento padrão, mantendo a flexibilidade do pagamento conforme o uso.
Lançamos o3-deep-research e o4-mini-deep-research, variantes de pesquisa aprofundada dos nossos modelos de raciocínio da série o, otimizadas para tarefas de análise e pesquisa aprofundadas. Saiba mais no guia de pesquisa aprofundada.
Adicionamos suporte ao tratamento assíncrono de eventos com webhooks. Reduzimos e simplificamos os preços da ferramenta de pesquisa na Web. Adicionamos suporte à ferramenta de pesquisa na Web.
Novos prompts reutilizáveis agora estão disponíveis no painel e na API Responses. Pela API, agora você pode referenciar modelos de prompt criados no painel usando o parâmetro prompt (com um id de prompt e, opcionalmente, version) e fornecer valores dinâmicos em variables, que podem incluir strings, imagens ou arquivos de entrada. Os prompts reutilizáveis não estão disponíveis no Chat Completions. Saiba mais.
Lançamos o3-pro, uma versão do modelo de raciocínio o3 que usa mais recursos computacionais para resolver problemas difíceis com melhor raciocínio e consistência. Os preços do modelo o3 também foram reduzidos para todas as solicitações à API, incluindo processamento em lote e processamento Flex.
Adicionamos suporte a ajuste fino com otimização direta de preferências para os modelos gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 e gpt-4.1-nano-2025-04-14.
Novos snapshots dos modelos gpt-4o-audio-preview e gpt-4o-realtime-preview estão disponíveis. Lançamos o SDK de Agentes para TypeScript.
maio de 2025
Adicionamos suporte a novas ferramentas integradas na API Responses, incluindo servidores MCP remotos e Code Interpreter. Saiba mais sobre as ferramentas.
Adicionamos suporte ao modo strict para esquemas de ferramentas ao usar chamadas paralelas de ferramentas com modelos que não passaram por ajuste fino.
Adicionamos novos recursos de esquemas, incluindo validação de strings para email e outros padrões, além da especificação de intervalos para números e arrays.
Lançamos codex-mini-latest na API, otimizado para uso com o Codex CLI.
Lançamos suporte a ajuste fino por reforço. Conheça os métodos de ajuste fino disponíveis. gpt-4.1-nano agora está disponível para ajuste fino.
abril de 2025
Lançamos suporte a alertas aprimorados de orçamento da API e limites de recarga automática.
Adicionamos um novo modelo de geração de imagens, gpt-image-1. Esse modelo estabelece um novo padrão para geração de imagens, com melhor qualidade e maior capacidade de seguir instruções.
Atualizamos os endpoints de geração e edição de imagens para oferecer suporte a novos parâmetros específicos do modelo gpt-image-1.
Adicionamos dois novos modelos de raciocínio da série o, o3 e o4-mini. Eles estabelecem um novo padrão para matemática, ciência, programação, tarefas de raciocínio visual e redação técnica.
Lançamos o Codex, nossa ferramenta CLI de geração de código.
Adicionamos os modelos gpt-4.1, gpt-4.1-mini e gpt-4.1-nano à API. Esses novos modelos trazem melhorias na capacidade de seguir instruções e programar, além de uma janela de contexto maior (até 1 milhão de tokens). gpt-4.1 e gpt-4.1-mini estão disponíveis para ajuste fino supervisionado. Anunciamos a descontinuação de gpt-4.5-preview.
março de 2025
Adicionamos os modelos gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe e whisper-1 à API de áudio.
Lançamos vários modelos e ferramentas novos, além de uma nova API para fluxos de trabalho agênticos:
- Lançamos a API Responses, uma nova API para criar e usar agentes e ferramentas.
- Lançamos um conjunto de ferramentas integradas para a API Responses: pesquisa na Web, pesquisa de arquivos e uso do computador.
- Lançamos o SDK de Agentes, um framework de orquestração para projetar, desenvolver e implantar agentes.
- Anunciamos novos modelos:
gpt-4o-search-preview,gpt-4o-mini-search-preview,computer-use-preview. - Anunciamos planos para levar todos os recursos da API Assistants para a API Responses, que é mais fácil de usar, com previsão de encerramento do Assistants em 2026 (após alcançar paridade completa de recursos).
Adicionamos suporte ao campo metadata nos jobs de ajuste fino.
fevereiro de 2025
Lançamos uma prévia de pesquisa do GPT-4.5, nosso maior e mais capaz modelo de chat até então. O alto "EQ" do GPT-4.5 e sua compreensão da intenção do usuário o tornam melhor em tarefas criativas e planejamento agêntico.
Lançamos a atualização do painel de uso da API. Esta atualização atende a solicitações de filtros de dados adicionais, como seleção de projetos, seletor de datas e intervalos mais detalhados. Também melhoramos o suporte à visualização do uso em diferentes produtos e níveis de serviço.
Apresentamos a residência de dados na Europa. Leia mais aqui.
janeiro de 2025
Lançamos o o3-mini, um novo modelo de raciocínio pequeno, otimizado para tarefas de ciência, matemática e programação.
Ampliamos o acesso ao modelo o1. Os modelos da série o1 são treinados com aprendizado por reforço para realizar raciocínio complexo.
dezembro de 2024
Lançamos a rotação de chaves da API de administração, permitindo que os clientes façam a rotação dessas chaves programaticamente.
Atualizamos os convites da API de administração, permitindo que os clientes convidem usuários programaticamente para projetos ao mesmo tempo que os convidam para organizações.
Adicionamos novos modelos para o1, gpt-4o-realtime, gpt-4o-audio e mais.
Adicionamos o método de conexão via WebRTC à Realtime API.
Adicionamos o parâmetro reasoning_effort para os modelos o1.
Adicionamos o papel de mensagem developer para o modelo o1. Observe que o1-preview e o1-mini não oferecem suporte a mensagens de sistema ou de desenvolvedor.
Lançamos o ajuste fino por preferências usando otimização direta de preferências (DPO).
Lançamos SDKs em versão beta para Go e Java. Saiba mais.
Adicionamos suporte à Realtime API no SDK para Python.
Lançamos a API de uso, permitindo que os clientes consultem programaticamente atividades e gastos nas APIs da OpenAI.
novembro de 2024
Lançamos o gpt-4o-2024-11-20, nosso modelo mais recente da série gpt-4o.
Lançamos as saídas previstas, que reduzem significativamente a latência das respostas do modelo quando grande parte da resposta já é conhecida de antemão. Isso é mais comum ao gerar novamente o conteúdo de documentos e arquivos de código com apenas pequenas alterações.
outubro de 2024
Adicionamos cinco novos tipos de voz à Realtime API e à API chat completions.
Lançamos o novo modelo gpt-4o-audio-preview para chat completions, com suporte a entradas e saídas de áudio. Ele usa o mesmo modelo subjacente da Realtime API.
Lançamos vários novos recursos no OpenAI DevDay em São Francisco:
Realtime API: Crie experiências rápidas de fala para fala nos seus aplicativos usando uma interface WebSockets.
Destilação de modelos: Plataforma para fazer o ajuste fino de modelos econômicos com as saídas que você obtém de um grande modelo de fronteira.
Ajuste fino com imagens: Faça o ajuste fino do GPT-4o com imagens e texto para melhorar suas capacidades de visão.
Avaliações: Crie e execute avaliações personalizadas para medir o desempenho do modelo em tarefas específicas.
Cache de prompts: Descontos e processamento mais rápido de tokens de entrada vistos recentemente.
Gerar no playground: Gere facilmente prompts, definições de funções e esquemas de saída estruturada no playground usando o botão Gerar.
setembro de 2024
Lançamos o novo modelo de moderação omni-moderation-latest, que oferece suporte a imagens e texto (em algumas categorias), inclui duas novas categorias de danos exclusivas para texto e apresenta pontuações mais precisas.
Lançamos o o1-preview e o1-mini, novos modelos de linguagem de grande porte treinados com aprendizado por reforço para realizar tarefas de raciocínio complexo.
agosto de 2024
O ajuste fino do gpt-4o-2024-08-06 está disponível para todos. Todos os usuários da API agora podem fazer o ajuste fino do modelo GPT-4o mais recente.
Lançamos um modelo dinâmico para chatgpt-4o-latest. Esse modelo apontará para o modelo GPT-4o mais recente usado pelo ChatGPT.
Lançamos as saídas estruturadas. As saídas dos modelos agora seguem de forma confiável os esquemas JSON fornecidos pelos desenvolvedores.
Lançamos o gpt-4o-2024-08-06, nosso modelo mais recente da série gpt-4o.
Lançamos as APIs de administração e de logs de auditoria, permitindo que os clientes administrem sua organização programaticamente e monitorem alterações usando os logs de auditoria. O registro de auditoria precisa ser ativado nas configurações.
julho de 2024
Lançamos a configuração de SSO por autoatendimento, permitindo que clientes empresariais com faturamento personalizado e ilimitado configurem a autenticação com o IDP de sua preferência.
Lançamos o ajuste fino do GPT-4o mini, permitindo um desempenho ainda melhor em casos de uso específicos.
Lançamos o GPT-4o mini, nosso modelo pequeno, econômico e inteligente para tarefas rápidas e leves.
Lançamos o Uploads para enviar arquivos grandes em várias partes.
junho de 2024
A chamada de função em paralelo pode ser desativada em Chat Completions e na API Assistants passando parallel_tool_calls=false.
Lançamos o SDK para .NET em versão beta.
Adicionamos suporte a personalizações da pesquisa de arquivos.
maio de 2024
Adicionamos suporte ao arquivamento de projetos. Somente proprietários da organização podem acessar essa funcionalidade.
Adicionamos suporte à definição de limites de custo por projeto para clientes que pagam conforme o uso.
Lançamos o GPT-4o na API. O GPT-4o é nosso modelo principal mais rápido e econômico.
Adicionamos suporte a entradas de imagem na API Assistants.
Adicionamos suporte a modelos com ajuste fino na API de processamento em lote.
Adicionamos o parâmetro stream_options: {"include_usage": true} às APIs Chat Completions e Completions. Essa configuração permite que os desenvolvedores acessem estatísticas de uso durante o streaming.
Adicionamos um novo endpoint para excluir uma mensagem de uma thread na API Assistants.
abril de 2024
Adicionamos uma nova opção de chamada de função, tool_choice: "required", às APIs Chat Completions e Assistants.
Adicionamos um guia da API de processamento em lote e suporte a modelos de embeddings nessa API
Introduzimos uma série de atualizações na API Assistants, incluindo uma nova ferramenta de pesquisa de arquivos que permite até 10.000 arquivos por assistente, novos controles de tokens e suporte à escolha de ferramentas.
Introduzimos uma hierarquia baseada em projetos para organizar o trabalho por projeto, incluindo a possibilidade de criar chaves de API e gerenciar limites de taxa e de custo por projeto (limites de custo disponíveis apenas para clientes empresariais).
Lançamos a API de processamento em lote
Disponibilizamos o GPT-4 Turbo com visão para uso geral na API
Adicionamos suporte a seed na API de ajuste fino
Adicionamos suporte a checkpoints na API de ajuste fino
Adicionamos suporte à adição de Messages ao criar um Run na API Assistants
Adicionamos suporte à filtragem de Messages por run_id na API Assistants
março de 2024
Adicionamos suporte a temperature e à criação de mensagens do assistente na API Assistants
Adicionamos suporte a streaming na API Assistants
fevereiro de 2024
Adicionamos o parâmetro timestamp_granularities à API de áudio
janeiro de 2024
Lançamos os modelos de embeddings V3 e uma prévia atualizada do GPT-4 Turbo
Adicionamos o parâmetro dimensions à API de embeddings
dezembro de 2023
Adicionamos o parâmetro additional_instructions à criação de execuções na API Assistants
Adicionados os parâmetros logprobs e top_logprobs à API Chat Completions
O argumento de parâmetros da função em uma chamada de ferramenta passou a ser opcional
novembro de 2023
Lançado o OpenAI Deno SDK
Lançados o GPT-4 Turbo Preview, o GPT-3.5 Turbo atualizado, o GPT-4 Turbo with Vision, a API Assistants, o DALL·E 3 na API e a API de conversão de texto em fala
Descontinuado o parâmetro functions do Chat Completions em favor de tools
Lançado o OpenAI Python SDK V1.0
outubro de 2023
Adicionado o parâmetro encoding_format à API Embeddings
Adicionado max_tokens aos modelos de moderação
Adicionado suporte à chamada de função à API de ajuste fino