For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal

Registro de alterações

Confira as próximas descontinuações na página de descontinuações.

setembro de 2026

15 de set.
Recurso

Foram adicionados controles de governança para a criação de chaves de API nos níveis da organização e do projeto. Os administradores podem permitir apenas chaves de contas de serviço, permitir apenas chaves de projeto pertencentes a usuários ou desativar por completo a criação de novas chaves de API. As restrições da organização prevalecem sobre as configurações do projeto, e as chaves de API existentes não são afetadas. Consulte as práticas recomendadas para produção para obter detalhes.

10 de set.
Recurso

Agora você pode definir datas de expiração ao criar chaves de API de projeto. Os administradores também podem impor um prazo máximo de validade para as chaves no nível da organização ou do projeto nas configurações da plataforma, exigindo que as novas chaves expirem dentro do limite configurado. Consulte as práticas recomendadas para produção para obter orientações sobre expiração e rotação de chaves.

10 de set.
Recurso

Lançamos a API de Agentes em beta público. Crie agentes com um harness gerenciado do Codex enquanto a OpenAI cuida da orquestração de sessões, da compactação de contexto e da recuperação.

Use sessões duráveis para dar continuidade ao trabalho entre turnos, transmitir o progresso em tempo real e conectar suas próprias ferramentas e servidores MCP. Execute agentes em sandboxes hospedados pela OpenAI ou conecte um sandbox da sua própria infraestrutura ou de um provedor compatível.

Comece pelo início rápido da API de Agentes.

10 de set.
Recurso
gpt-live-1
v1/live/sessions

O GPT-Live 1 agora está disponível para uso geral na API. Crie conversas por voz que permitem falar e ouvir ao mesmo tempo e que podem continuar enquanto um modelo ou agente no backend cuida do raciocínio e das ferramentas.

Use a delegação via Responses com um modelo da OpenAI ou a delegação ao cliente para conectar seu próprio backend. As sessões de voz custam US$ 0,05 por minuto, com cobrança por segundo; o uso do modelo no backend e das ferramentas é cobrado separadamente.

Comece pelo GPT-Live, pela criação de prompts e pelas orientações de migração. Consulte os preços para obter detalhes.

8 de set.
Recurso
v1/responses

O Diagnóstico do cache de prompts agora está disponível para uso geral na API Responses para o GPT-5.6 e modelos posteriores compatíveis.

Compare a reutilização do cache com a de uma resposta anterior, identifique os motivos das falhas de cache e siga as orientações de solução de problemas para melhorar a reutilização do cache.

8 de set.
Recurso
gpt-image-2.5-sunburst
gpt-image-2.5-flare
v1/images
v1/responses

Lançamos o GPT Image 2.5 Sunburst e o GPT Image 2.5 Flare para geração e edição de imagens pela API Image e pela ferramenta de geração de imagens da API Responses.

Use o Sunburst em fluxos de trabalho nos quais a precisão da edição é a prioridade, ou o Flare para gerar imagens rapidamente e com alta qualidade no dia a dia. Ambos os modelos oferecem suporte às novas configurações de qualidade xhigh e max e usam as tarifas por token do GPT Image 2. Consulte o guia de geração de imagens e os preços.

8 de set.
Recurso
gpt-rosalind-research

O GPT-Rosalind (gpt-rosalind-research) agora está disponível para uso geral por meio do programa de acesso confiável para pesquisas internas aprovadas na área de ciências da vida.

Os preços padrão são US$ 5 por 1 milhão de tokens de entrada, US$ 0,50 por 1 milhão de tokens de entrada em cache e US$ 25 por 1 milhão de tokens de saída. A cobrança começa em 5 de outubro de 2026. Consulte os preços para obter detalhes.

3 de set.
Recurso
gpt-6-astra
v1/responses
v1/chat/completions

Lançamos o GPT-6 Astra, nosso modelo mais capaz, desenvolvido para realizar os trabalhos mais difíceis do início ao fim.

Use o GPT-6 Astra para raciocínio, programação, uso do computador, pesquisa e criação de documentos. Ele combina essas capacidades para conduzir tarefas complexas da solicitação inicial ao resultado final, usando o contexto e as ferramentas que você fornece.

Principais mudanças a considerar na migração:

  • O GPT-6 Astra não oferece suporte ao nível de esforço de raciocínio none.
  • O GPT-6 Astra não oferece suporte a valores personalizados de temperature ou top_p, nem a probabilidades logarítmicas (logprobs).
  • A chamada de ferramentas exige a API Responses. Se você usa ferramentas com Chat Completions, siga o guia de migração para a API Responses.
  • O monitoramento de desalinhamento verifica de forma assíncrona se há possíveis problemas durante o trabalho do agente em solicitações compatíveis da API Responses. As verificações podem acionar alertas de segurança ou interromper uma conversa para revisão.

Comece por Como usar o GPT-6 Astra para conhecer suas capacidades e obter orientações sobre criação de prompts e migração. Explore o uso do computador para fluxos de trabalho no navegador e no desktop, e consulte os preços para conhecer os níveis de inferência disponíveis.

3 de set.
Recurso
v1/responses

Adicionamos novos controles para trabalhos de longa duração com o GPT-6 Astra na API Responses:

  • Chamada assíncrona de ferramentas: permita que o modelo continue trabalhando enquanto seu aplicativo executa ferramentas de função ou personalizadas e retorne os resultados à medida que ficarem disponíveis.
  • Orientação durante o turno: envie instruções adicionais enquanto uma resposta estiver em andamento via WebSockets, para que o modelo possa incorporar correções ou mudanças nos requisitos.
  • Alterar o esforço de raciocínio durante a conversa: aumente o esforço para trabalhos difíceis ou reduza-o para solicitações de acompanhamento rotineiras, preservando o prefixo do prompt armazenado em cache.
2 de set.
Atualização

Atualizamos os erros da API para que os aplicativos possam distinguir um aumento rápido demais no tráfego de uma sobrecarga temporária do modelo.

Um aumento rápido demais no tráfego pode retornar um erro 429 com o código slow_down. A sobrecarga temporária do modelo retorna um erro 503 com o código server_is_overloaded. Ambas as respostas podem incluir Retry-After. Quando esse cabeçalho estiver presente, aguarde pelo menos o tempo que ele especifica antes de tentar novamente. Se estiver ausente, use espera exponencial entre as tentativas. Consulte o guia de códigos de erro e o guia de limites de taxa.

1 de set.
Atualização

As conexões com api.openai.com agora podem usar IPv6.

agosto de 2026

29 de ago.
Recurso

O TLS mútuo (mTLS) e a federação de identidades de cargas de trabalho X.509 agora estão disponíveis para uso geral na API da OpenAI. Configure certificados e provedores de identidade X.509 diretamente no console da plataforma, com acesso controlado pelas funções e permissões da sua organização.

26 de ago.
Atualização
whisper-1
gpt-4o-transcribe
gpt-4o-mini-transcribe
gpt-4o-transcribe-diarize
v1/audio/transcriptions
v1/realtime

Anunciamos a descontinuação de whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe e gpt-4o-transcribe-diarize. Esses modelos serão desativados em 26 de fevereiro de 2027. Migre para gpt-live-transcribe ou gpt-transcribe. Consulte o guia de transcrição e a página de descontinuações.

A API Assistants foi desativada em 26 de agosto de 2026. Migre para a API Responses e a API Conversations usando o guia de migração.

21 de ago.
Recurso

Os clientes da API agora podem selecionar o processamento regional para uma solicitação individual usando um domínio com prefixo e uma chave de API de um projeto com região geográfica Global. Os requisitos existentes de elegibilidade, controle de retenção de dados, endpoint e suporte a modelos continuam se aplicando. Saiba mais no guia de controles de dados.

21 de ago.
Atualização
gpt-5.6-sol

O GPT-5.6 Sol agora custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, uma redução de 20% no preço de entrada e de 33% no preço de saída. Os preços promocionais do GPT-5.6 Sol estão disponíveis pelo menos até 21 de novembro de 2026. Veja os detalhes dos preços.

20 de ago.
Recurso

Lançamos o painel de cache de prompts na Plataforma de API da OpenAI. Acompanhe a taxa de acertos do cache ao longo do tempo, as leituras de cache por gravação e a distribuição dos tokens lidos do cache, gravados no cache e não armazenados em cache para entender a eficiência do cache e identificar oportunidades de melhoria. Filtre as métricas por modelo e nível de serviço.

20 de ago.
Atualização
gpt-image-2
gpt-image-2-2026-04-21
v1/images/generations
v1/images/edits
v1/responses

Fundos transparentes agora estão disponíveis em versão prévia para gpt-image-2 e gpt-image-2-2026-04-21 na API Images e na ferramenta de geração de imagens da API Responses. Defina background como transparent e use o formato de saída png ou webp; jpeg não oferece suporte a fundos transparentes. Saiba mais no guia de geração de imagens.

13 de ago.
Anúncio

Anunciamos o modo ultrarrápido, um novo nível de serviço da API para o GPT-5.6 Sol que executa até 14 vezes mais rápido que o processamento padrão. Disponível em versão prévia limitada para clientes selecionados. Inscreva-se aqui para receber atualizações sobre o modo ultrarrápido.

7 de ago.
Recurso
gpt-5.6-cyber
gpt-daybreak-red-latest
gpt-daybreak-blue-latest
v1/responses

O Daybreak agora oferece dois níveis de acesso para profissionais de defesa aprovados: Daybreak Blue e Daybreak Red. Use-os para avançar dos problemas de segurança identificados às correções validadas em trabalhos explicitamente autorizados.

Comece com o Daybreak Blue para a maioria dos trabalhos de segurança defensiva. Ele oferece acesso a modelos de uso geral, como o GPT-5.6 Sol, para descoberta de vulnerabilidades, revisão de segurança do código, engenharia de detecção, resposta a incidentes, análise de malware e validação de patches. Leia mais aqui.

O Daybreak Red oferece acesso, sujeito a aprovação separada, a modelos treinados especificamente para esse fim, como o GPT-5.6 Cyber, para atividades autorizadas de reprodução de vulnerabilidades, validação de exploits, testes de penetração, red teaming e análise de sistemas complexos.

Esses modelos exigem aprovação e provisionamento separados. Você pode solicitar a participação no programa Daybreak aqui. Veja mais detalhes sobre os preços aqui.

6 de ago.
Atualização
chat-latest

Atualizamos o snapshot chat-latest , que aponta para o modelo mais recente disponível no ChatGPT para usuários Plus e Pro. Recomendamos usar o GPT-5.6 Sol para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.

5 de ago.
Atualização
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna

O modo Fast agora oferece suporte a solicitações de contexto longo para GPT-5.6 Sol, GPT-5.6 Terra e GPT-5.6 Luna. A partir de hoje, prompts de contexto longo com mais de 272 mil tokens podem ser executados no modo Fast, com velocidades até 2,5 vezes maiores que as do nível padrão. Veja os detalhes dos preços.

4 de ago.
Recurso

Os clientes agora podem filtrar e agrupar dados por chave de API nos painéis de uso e custos. A API de uso e a API de custos também oferecem suporte à dimensão de chave de API para geração programática de relatórios e análises.

julho de 2026

30 de jul.
Atualização
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions

A partir de 30 de julho, o GPT-5.6 Luna custa 80% menos, enquanto o GPT-5.6 Terra custa 20% menos. Veja os detalhes dos preços.

Também estamos lançando o modo Fast na API, que substitui nossa oferta de processamento prioritário. Para o GPT-5.6 Sol, o modo Fast agora oferece velocidades até 2,5 vezes maiores que as do processamento padrão pelo dobro do preço. Essa mudança mantém a compatibilidade com versões anteriores: solicitações marcadas como priority usarão automaticamente o modo Fast.

29 de jul.
Recurso

Lançamos o provedor Terraform da OpenAI oficial para gerenciar recursos da Plataforma de API da OpenAI como infraestrutura como código.

Provisione e gerencie projetos, usuários, grupos, funções, atribuições de acesso, contas de serviço, certificados, convites e limites de taxa por projeto. Use os fluxos de trabalho padrão do Terraform para revisar e aplicar alterações, importar recursos existentes e detectar e corrigir divergências de configuração. Instale o provedor pelo Terraform Registry.

28 de jul.
Recurso
gpt-transcribe
gpt-live-transcribe
v1/audio/transcriptions
v1/realtime

Lançamos o GPT Transcribe para transcrição precisa de arquivos e transcrições finais de turnos confirmados do Realtime, junto com o GPT Live Transcribe para transcrição em streaming com baixa latência.

Ambos os modelos oferecem suporte a contexto de transcrição em formato livre, dicas de palavras-chave e múltiplos idiomas de entrada esperados. Compare as saídas e os fluxos de trabalho compatíveis no guia de transcrição.

22 de jul.
Recurso

Adicionamos limites rígidos de gastos para organizações e projetos na Plataforma de API da OpenAI. Defina um teto mensal que faça as solicitações de API afetadas retornarem um erro 429 quando os gastos contabilizados atingirem o limite. Use alertas de gastos para receber notificações antes que o tráfego seja interrompido. Leia mais no guia de limites de gastos.

9 de jul.
Recurso
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions
v1/batch

Lançamos a família de modelos GPT-5.6, que inclui o GPT-5.6 Sol para capacidades de fronteira, o GPT-5.6 Terra para equilibrar inteligência e custo, e o GPT-5.6 Luna para processar com eficiência cargas de trabalho de alto volume. O alias gpt-5.6 encaminha as solicitações para gpt-5.6-sol.

O GPT-5.6 adiciona chamada programática de ferramentas, controles explícitos de cache de prompts, raciocínio persistido, esforço de raciocínio max e modo Pro, além de orquestração de múltiplos agentes em versão beta para a API Responses. O GPT-5.6 também aceita imagens nas dimensões originais com o nível de detalhe de imagem original ou auto.

6 de jul.
Recurso
gpt-realtime-2.1
gpt-realtime-2.1-mini
v1/realtime

Lançamos o GPT-Realtime-2.1, um modelo de raciocínio em tempo real atualizado, com melhorias no reconhecimento alfanumérico, no tratamento de silêncio e ruído e no comportamento diante de interrupções. Também lançamos o GPT-Realtime-2.1 mini, um modelo de raciocínio destilado, mais rápido e de menor custo, para aplicativos de voz em tempo real.

junho de 2026

24 de jun.
Atualização
chat-latest

Atualizamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.

23 de jun.
Recurso

Lançamos o painel de uso de segurança na Plataforma de API da OpenAI. O painel de segurança mostra solicitações bloqueadas da API Responses com base nos valores de safety_identifier enviados nas solicitações para identificar os usuários finais. Acesse o painel de segurança.

9 de jun.
Recurso
v1/responses

A pesquisa na Web agora pode retornar resultados de imagens junto com os resultados de texto habituais. Use a pesquisa de imagens quando seu aplicativo precisar de imagens atuais ou obtidas na Web, como fotos de produtos, pontos de referência, lugares, eventos ou referências visuais. Leia mais no guia de pesquisa na Web.

5 de jun.
Atualização

Lançamos uma navegação reformulada para a Plataforma de API da OpenAI. Acesse aqui.

4 de jun.
Recurso
omni-moderation-latest
v1/responses
v1/chat/completions

Adicionamos pontuações de moderação à API Responses e à API Chat Completions. Passe um objeto moderation em uma solicitação de geração para receber, na mesma resposta, os resultados de moderação tanto da entrada do modelo quanto da saída gerada.

Saiba mais no guia de moderação.

3 de jun.
Atualização

Anunciamos a descontinuação dos objetos de prompt reutilizáveis, da plataforma de avaliações e do Criador de agentes. Consulte a página de descontinuações para ver os prazos de desativação e as orientações de migração.

2 de jun.
Atualização

A partir de 2 de junho de 2026, as sessões de contêiner elegíveis serão cobradas por minuto, com um mínimo de 5 minutos, em vez de serem cobradas pelo valor integral de uma sessão de 20 minutos. A tarifa por minuto permanecerá a mesma.

Essa atualização busca tornar a cobrança mais granular para sessões mais curtas e reduzirá o custo efetivo para os clientes.

Você pode consultar os preços atuais das ferramentas integradas na nossa documentação de preços da API.

1 de jun.
Recurso
gpt-5.4
gpt-5.5
v1/responses

Os modelos da OpenAI agora estão disponíveis no Amazon Bedrock por meio de um endpoint da API Responses compatível com a OpenAI. Os modelos e recursos compatíveis variam conforme a região da AWS. Saiba mais.

maio de 2026

29 de mai.
Atualização
v1/responses
v1/chat/completions
v1/batch

Para organizações sem ZDR habilitado, prompt_cache_retention agora usa 24h como padrão em vez de in_memory, habilitando o cache estendido de prompts por padrão. Saiba mais.

28 de mai.
Atualização
chat-latest

Lançamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 para uso da API em produção, mas você pode usar este modelo para testar as melhorias mais recentes em casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.

26 de mai.
Recurso

Lançamos a federação de identidades de cargas de trabalho. Cargas de trabalho confiáveis podem trocar tokens de identidade emitidos externamente por tokens de acesso da OpenAI de curta duração, sem armazenar chaves de API de longa duração.

26 de mai.
Atualização

Adicionamos novos recursos à API de administração para gerenciar alertas de gastos, listas de modelos permitidos, configurações de retenção de dados e permissões de ferramentas hospedadas, além de consultar itens detalhados de cobrança.

19 de mai.
Recurso

Lançamos o Túnel MCP seguro para clientes empresariais. O Túnel MCP seguro permite que produtos compatíveis da OpenAI, incluindo ChatGPT na Web, Codex, API Responses e AgentKit, se conectem a servidores MCP privados ou locais por meio de um tunnel-client hospedado pelo cliente, sem expor esses servidores à internet pública.

19 de mai.
Atualização

Agora você pode gerenciar várias listas de IPs permitidos e aplicar cada uma a um projeto ou à organização inteira. Para configurá-las, acesse Configurações > Segurança > Lista de IPs permitidos.

12 de mai.
Atualização
dall-e-2
dall-e-3
v1/realtime

Descontinuamos os snapshots dos modelos DALL·E e a versão beta da Realtime API.

Os snapshots dos modelos DALL·E dall-e-2 e dall-e-3 foram descontinuados e removidos da API em 12 de maio de 2026. Recomendamos usar gpt-image-2, gpt-image-1 ou gpt-image-1-mini como alternativa.

A versão beta da Realtime API foi descontinuada e removida da API em 12 de maio de 2026. Se você ainda usa a interface beta, migre para a versão estável da Realtime API. Consulte o guia de migração e a página de descontinuações completa.

11 de mai.
Recurso
v1/responses

Adicionamos return_token_budget à ferramenta de pesquisa na Web da API Responses. Use esse parâmetro para habilitar pesquisas na Web mais longas com raciocínio do GPT-5+ em cargas de trabalho de pesquisa e avaliação que exigem alto esforço.

7 de mai.
Recurso
gpt-realtime-2
gpt-realtime-translate
gpt-realtime-whisper
v1/realtime
v1/realtime/translations
v1/realtime/transcription_sessions

Lançamos o GPT-Realtime-2, um novo modelo de voz em tempo real com raciocínio configurável para agentes de fala para fala, junto com o GPT-Realtime-Translate para tradução de fala em streaming e o GPT-Realtime-Whisper para conversão de fala em texto em streaming.

Atualizamos o guia de tempo real e áudio, adicionamos um guia de tradução em tempo real dedicado, revisamos a documentação de transcrição em tempo real para transcrições em streaming e movemos as orientações de criação de prompts em tempo real para Como usar modelos em tempo real.

7 de mai.
Recurso

Lançamos o plug-in OpenAI Developers para Codex. Ele ajuda você a criar aplicativos de IA e agentes no Codex, com acesso à plataforma OpenAI e orientações de configuração da API da OpenAI.

6 de mai.
Atualização

O SDK de Agentes atualizado já está disponível em TypeScript, com suporte a agentes em sandbox e um harness de código aberto integrado. Saiba mais aqui.

5 de mai.
Atualização
chat-latest

Lançamos o snapshot chat-latest, que aponta para o modelo Instantâneo mais recente usado atualmente no ChatGPT. Recomendamos usar o GPT-5.5 na API em produção, mas você pode usar este modelo para testar nossas melhorias mais recentes para casos de uso de chat. O snapshot do modelo subjacente será atualizado regularmente. Leia mais aqui.

4 de mai.
Atualização

As APIs de administração agora têm suporte nos SDKs da OpenAI para Node, Python, Go, Ruby e Java. Consulte o guia das APIs de administração para ver instruções de configuração e exemplos.

abril de 2026

24 de abr.
Recurso
gpt-5.5
gpt-5.5-pro
v1/responses
v1/chat/completions
v1/batch

Lançamos o GPT-5.5, um novo modelo de fronteira para trabalhos profissionais complexos, nas APIs chat completions e Responses. Também lançamos o GPT-5.5 Pro para solicitações à API Responses voltadas a problemas mais difíceis que se beneficiam de mais recursos computacionais.

O GPT-5.5 oferece suporte a uma janela de contexto de 1 milhão de tokens, entrada de imagem, saídas estruturadas, chamada de função, cache de prompts, processamento em lote, pesquisa de ferramentas, uso do computador integrado, shell hospedado, aplicação de patches, Habilidades, MCP e pesquisa na Web. As principais atualizações incluem:

  • O esforço de raciocínio agora usa medium por padrão.
  • Quando image_detail não está definido ou está definido como auto, o modelo agora usa o comportamento original.
  • O cache do GPT-5.5 funciona apenas com cache estendido de prompts. O cache de prompts em memória não é compatível. Saiba mais aqui.
21 de abr.
Recurso
gpt-image-2
v1/images/generations
v1/images/edits
v1/batch

Lançamos o GPT Image 2, um modelo de última geração para gerar e editar imagens. O GPT Image 2 oferece suporte a tamanhos de imagem flexíveis, entradas de imagem de alta fidelidade, preços de imagem baseados em tokens e uso da API Batch com desconto de 50%.

15 de abr.
Atualização

Atualizamos o SDK de Agentes com novas capacidades, incluindo:

  • executar agentes em sandboxes controlados;
  • inspecionar e personalizar o harness de código aberto; e
  • controlar quando as memórias são criadas e onde são armazenadas.

março de 2026

17 de mar.
Recurso
gpt-5.4-mini
gpt-5.4-nano
v1/responses
v1/chat/completions

Lançamos o GPT-5.4 mini e o GPT-5.4 nano nas APIs chat completions e Responses. O GPT-5.4 mini traz capacidades do nível do GPT-5.4 em um modelo mais rápido e eficiente para cargas de trabalho de alto volume, enquanto o GPT-5.4 nano é otimizado para tarefas simples de alto volume em que velocidade e custo são as principais prioridades.

O GPT-5.4 mini oferece suporte a pesquisa de ferramentas, uso do computador integrado e compactação. O GPT-5.4 nano oferece suporte a compactação, mas não a pesquisa de ferramentas ou uso do computador.

16 de mar.
Atualização
gpt-5.3-chat-latest

Atualizamos o slug gpt-5.3-chat-latest para apontar para o modelo mais recente usado atualmente no ChatGPT.

13 de mar.
Correção
gpt-5.4
v1/responses
v1/chat/completions

Atualizamos nosso codificador de imagens para corrigir um pequeno bug nas entradas input_image do GPT-5.4. Alguns casos de uso de compreensão de imagens podem agora apresentar melhor qualidade. Nenhuma ação é necessária.

12 de mar.
Recurso
sora-2
sora-2-pro
v1/videos
v1/videos/characters
v1/videos/extensions
v1/batch

Ampliamos a API do Sora com referências reutilizáveis de personagens, gerações mais longas de até 20 segundos, saída em 1080p para sora-2-pro, extensões de vídeo e suporte da API Batch para POST /v1/videos. As gerações em 1080p no sora-2-pro são cobradas a $0.70 por segundo. Saiba mais aqui.

12 de mar.
Atualização
sora-2
sora-2-pro
v1/videos/edits
v1/videos/{video_id}/remix

Adicionamos POST /v1/videos/edits para editar vídeos existentes. Esse endpoint substituirá POST /v1/videos/{video_id}/remix, que será descontinuado em 6 meses. Saiba mais aqui.

5 de mar.
Recurso
gpt-5.4
gpt-5.4-pro
v1/responses
v1/chat/completions

Lançamos o GPT-5.4, nosso mais novo modelo de fronteira para trabalhos profissionais, nas APIs chat completions e Responses. Também lançamos o GPT-5.4 Pro na API Responses para problemas mais difíceis que se beneficiam de mais recursos computacionais.

Também lançamos:

  • Pesquisa de ferramentas na API Responses, que permite aos modelos adiar o carregamento de grandes conjuntos de ferramentas até o momento da execução para reduzir o uso de tokens, preservar o desempenho do cache e melhorar a latência.
  • Suporte integrado a Uso do computador no GPT-5.4 por meio da ferramenta computer da API Responses, para interação com interfaces com base em capturas de tela.
  • Uma janela de contexto de 1 milhão de tokens e suporte nativo a Compactação para fluxos de trabalho de agentes de maior duração.
3 de mar.
Recurso
gpt-5.3-chat-latest
v1/chat/completions
v1/responses

Lançamos gpt-5.3-chat-latest nas APIs chat completions e Responses. Esse modelo aponta para o snapshot do GPT-5.3 Instant usado atualmente no ChatGPT. Leia mais aqui.

fevereiro de 2026

24 de fev.
Recurso
v1/responses

Ampliamos o suporte a input_file na API Responses para aceitar mais tipos de arquivos de documentos, apresentações, planilhas, código e texto. Saiba mais aqui.

24 de fev.
Recurso
v1/responses

Lançamos phase na API Responses. Esse campo identifica uma mensagem do assistente como comentário intermediário (commentary) ou resposta final (final_answer). Leia mais aqui.

24 de fev.
Recurso
gpt-5.3-codex
v1/responses

Lançamos gpt-5.3-codex na API Responses. Leia mais aqui.

23 de fev.
Recurso
v1/responses

Lançamos o modo WebSocket para a API Responses. Saiba mais aqui.

23 de fev.
Recurso
gpt-realtime-1.5
gpt-audio-1.5
v1/realtime
v1/chat/completions

Lançamos o GPT-Realtime-1.5 na Realtime API.

Lançamos gpt-audio-1.5 na API chat completions. Leia mais aqui.

10 de fev.
Recurso
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/batch

A API Batch agora oferece suporte aos modelos GPT Image: gpt-image-1.5, chatgpt-image-latest, gpt-image-1 e gpt-image-1-mini.

10 de fev.
Atualização
gpt-5.2-chat-latest

Atualizamos o slug gpt-5.2-chat-latest para apontar para o modelo mais recente usado atualmente no ChatGPT.

10 de fev.
Recurso
v1/responses

Lançamos a compactação no servidor na API Responses.

10 de fev.
Recurso
v1/responses

Lançamos o suporte a Habilidades na API Responses. Oferecemos suporte a Habilidades tanto na execução local quanto na execução em contêineres hospedados.

10 de fev.
Recurso
v1/responses

Lançamos uma nova ferramenta de Shell hospedado, além de suporte a conexões de rede em contêineres.

9 de fev.
Recurso
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/images/edits

Adicionamos suporte a solicitações application/json em /v1/images/edits para modelos de imagem GPT. As solicitações JSON usam images (e, opcionalmente, mask) com referências image_url ou file_id em vez de uploads multipart.

3 de fev.
Atualização
gpt-5.2
gpt-5.2-codex

Otimizamos nossa pilha de inferência para clientes da API, e o GPT-5.2 e o GPT-5.2-Codex agora são cerca de 40% mais rápidos. Os modelos e seus pesos permanecem inalterados.

janeiro de 2026

15 de jan.
Anúncio

Anunciamos o Open Responses: uma especificação de código aberto para criar interfaces de LLM interoperáveis e compatíveis com vários provedores, com base na API Responses original da OpenAI.

14 de jan.
Recurso
gpt-5.2-codex
v1/responses

Lançamos gpt-5.2-codex na API Responses. O GPT-5.2-Codex é uma versão do GPT-5.2 otimizada para tarefas de programação agêntica no Codex ou em ambientes semelhantes. Leia mais aqui.

13 de jan.
Recurso
v1/realtime

Adicionamos faixas de IP dedicadas ao SIP para a Realtime API. sip.api.openai.com faz o roteamento por GeoIP e direcionará o tráfego SIP para a região mais próxima. Saiba mais.

13 de jan.
Atualização
gpt-realtime-mini
gpt-audio-mini

Atualizamos os slugs gpt-realtime-mini e gpt-audio-mini para apontar para os snapshots de 2025-12-15. Se você precisar dos snapshots anteriores dos modelos, use gpt-realtime-mini-2025-10-06 e gpt-audio-mini-2025-10-06.

13 de jan.
Atualização
sora-2

Atualizamos o slug sora-2 para apontar para sora-2-2025-12-08. Se você precisar do snapshot anterior do modelo, use sora-2-2025-10-06.

13 de jan.
Atualização
gpt-4o-mini-tts
gpt-4o-mini-transcribe

Atualizamos os slugs gpt-4o-mini-tts e gpt-4o-mini-transcribe para apontar para os snapshots de 2025-12-15. Se você precisar dos snapshots anteriores dos modelos, use gpt-4o-mini-tts-2025-03-20 e gpt-4o-mini-transcribe-2025-03-20. Atualmente, recomendamos usar gpt-4o-mini-transcribe em vez de gpt-4o-transcribe para obter os melhores resultados.

9 de jan.
Correção
gpt-image-1.5
chatgpt-image-latest

Corrigimos um problema que fazia gpt-image-1.5 e chatgpt-image-latest usarem incorretamente alta fidelidade nas edições de imagem por meio de /v1/images/edits, mesmo quando fidelity estava explicitamente definido como low (o padrão).

dezembro de 2025

19 de dez.
Atualização
gpt-image-1.5
chatgpt-image-latest

Adicionamos gpt-image-1.5 e chatgpt-image-latest à ferramenta de geração de imagens da API Responses.

16 de dez.
Recurso
gpt-image-1.5
chatgpt-image-latest

Lançamos o gpt-image-1.5 e o chatgpt-image-latest, nossos modelos mais recentes e avançados para geração de imagens. Leia mais aqui.

15 de dez.
Recurso
gpt-realtime-mini
gpt-audio-mini
gpt-4o-mini-transcribe
gpt-4o-mini-tts

Lançamos quatro novos snapshots de áudio com data. Essas atualizações trazem melhorias de confiabilidade, qualidade e fidelidade de voz para aplicativos de voz em tempo real. Leia mais aqui.

  • gpt-realtime-mini-2025-12-15
  • gpt-audio-mini-2025-12-15
  • gpt-4o-mini-transcribe-2025-12-15
  • gpt-4o-mini-tts-2025-12-15

Esse lançamento também inclui suporte a Vozes personalizadas para clientes elegíveis.

11 de dez.
Recurso
gpt-5.2
gpt-5.2-chat-latest
v1/responses
v1/chat/completions

Lançamos o GPT-5.2, o mais novo modelo principal da família GPT-5. O GPT-5.2 apresenta melhorias em relação ao GPT-5.1 anterior em:

  • Inteligência geral
  • Seguimento de instruções
  • Precisão e eficiência no uso de tokens
  • Multimodalidade, especialmente visão
  • Geração de código, especialmente criação de interfaces de usuário para front-end
  • Chamadas de ferramentas e gerenciamento de contexto na API
  • Compreensão e criação de planilhas.

As novidades da versão 5.2 incluem o nível de esforço de raciocínio xhigh, resumos concisos de raciocínio e um novo gerenciamento de contexto com compactação.

11 de dez.
Recurso
v1/responses/compact

Lançamos a compactação no lado do cliente. Para conversas de longa duração com a API Responses, você pode usar o endpoint /responses/compact para reduzir o contexto enviado a cada turno.

4 de dez.
Recurso
gpt-5.1-codex-max
v1/responses

Lançamos gpt-5.1-codex-max na API Responses. GPT-5.1-Codex é nosso modelo de programação mais inteligente, otimizado para tarefas de programação agêntica de longa duração. Saiba mais aqui.

novembro de 2025

20 de nov.
Recurso
v1/realtime

Adicionamos suporte a pressionamentos de teclas DTMF na Realtime API. Agora você pode receber eventos DTMF ao usar uma conexão de canal lateral do Realtime. Consulte a documentação aqui para saber mais.

13 de nov.
Recurso
gpt-5.1
gpt-5.1-codex
gpt-5.1-chat-latest
gpt-5.1-codex-mini
v1/responses
v1/chat/completions

Lançamos GPT-5.1, o mais novo modelo principal da família GPT-5. GPT-5.1 foi treinado para se destacar especialmente em:

  • Capacidade de seguir direcionamentos e respostas mais rápidas quando é necessário menos raciocínio
  • Geração de código e casos de uso de programação
  • Fluxos de trabalho agênticos

Observe que GPT-5.1 usa por padrão a nova configuração de raciocínio none para responder mais rápido quando é necessário menos raciocínio, diferentemente da configuração padrão anterior, medium, do GPT-5.

13 de nov.
Recurso

Lançamos controles de acesso baseados em funções (RBAC) aprimorados. O controle de acesso baseado em funções (RBAC) permite definir quem pode fazer o quê na sua organização e nos seus projetos, tanto pela API quanto no painel.

13 de nov.
Recurso
gpt-5.1-codex
gpt-5.1-codex-mini
v1/responses

Lançamos gpt-5.1-codex e gpt-5.1-codex-mini na API Responses. GPT-5.1-Codex é uma versão do GPT-5.1 otimizada para tarefas de programação agêntica no Codex ou em ambientes semelhantes. Saiba mais aqui.

13 de nov.
Recurso

Lançamos a retenção estendida do cache de prompts. A retenção estendida mantém os prefixos em cache ativos por mais tempo, até o máximo de 24 horas. O cache estendido de prompts transfere os tensores de chave/valor para o armazenamento local da GPU quando a memória está cheia, aumentando significativamente a capacidade de armazenamento disponível para cache.

outubro de 2025

29 de out.
Recurso
gpt-oss-safeguard-120b
gpt-oss-safeguard-20b

gpt-oss-safeguard-120b e gpt-oss-safeguard-20b são modelos de raciocínio voltados à segurança, desenvolvidos com base no gpt-oss. Saiba mais aqui.

24 de out.
Recurso

Lançamos o gerenciamento de chaves empresariais (EKM). O gerenciamento de chaves empresariais (EKM) permite criptografar seu conteúdo de cliente na OpenAI usando chaves gerenciadas pelo seu próprio sistema externo de gerenciamento de chaves (KMS).

24 de out.
6 de out.
Recurso
gpt-5-pro
gpt-realtime-mini
gpt-audio-mini
gpt-image-1-mini
sora-2
sora-2-pro
v1/responses
v1/batch
v1/chat/completions
v1/videos
v1/realtime
v1/images/generations

Lançamos vários recursos novos no OpenAI DevDay:

Lançamos GPT-5 Pro, uma versão do GPT-5 que usa mais recursos computacionais para raciocinar de forma mais aprofundada e fornecer respostas consistentemente melhores.

Lançamos GPT-Realtime mini e gpt-audio-mini para oferecer melhor custo-benefício no processamento de fala para fala.

Lançamos gpt-image-1-mini para geração e edição de imagens com melhor custo-benefício.

Lançamos v1/videos para gerar e remixar vídeos ricos, detalhados e dinâmicos com nossos modelos mais recentes, Sora 2 e Sora 2 Pro.

Lançamos o Criador de agentes para criar visualmente fluxos de trabalho personalizados com múltiplos agentes.

Lançamos ChatKit, uma interface de chat incorporável para implantar agentes.

Lançamos ferramentas de avaliação de rastros, conjuntos de dados e otimização de prompts.

Avaliações: lançamos suporte a modelos de terceiros.

Lançamos o painel de integridade do serviço.

1 de out.
Recurso

Lançamos a lista de IPs permitidos. Essa lista restringe o acesso à API aos endereços ou intervalos de IP que você especificar.

setembro de 2025

26 de set.
Recurso
v1/responses

Adicionamos suporte a imagens e arquivos como saída de chamadas de ferramentas na API Responses.

23 de set.
Recurso
gpt-5-codex
v1/responses

Lançamos o modelo especializado gpt-5-codex, desenvolvido e otimizado para uso com o Codex CLI.

agosto de 2025

28 de ago.
Recurso
v1/realtime

A Realtime API da OpenAI agora está disponível para uso geral. Saiba mais no nosso guia da Realtime API.

21 de ago.
Recurso
v1/responses

Adicionamos suporte a conectores na API Responses. Conectores são camadas de integração MCP mantidas pela OpenAI para serviços populares, como aplicativos do Google, Dropbox e outros. Eles podem ser usados para dar ao modelo acesso de leitura aos dados armazenados nesses serviços.

20 de ago.
Recurso
v1/conversations
v1/responses
v1/assistants

Lançamos a API Conversations, que permite criar e gerenciar conversas de longa duração com a API Responses. Consulte o guia de migração para ver uma comparação lado a lado e aprender a migrar uma integração com a API Assistants para Responses e Conversations.

7 de ago.
Recurso
v1/chat/completions
v1/responses

Lançamos a família de modelos GPT-5 na API, incluindo gpt-5, gpt-5-mini e gpt-5-nano.

Introduzimos o valor minimal de esforço de raciocínio para priorizar respostas rápidas nos modelos GPT-5 (que oferecem suporte a raciocínio).

Introduzimos o tipo custom de chamada de ferramenta, que permite entradas e saídas em formato livre para o modelo ao chamar ferramentas.

junho de 2025

27 de jun.
Recurso

Lançamos suporte ao processamento prioritário. O processamento prioritário oferece latência significativamente menor e mais consistente em comparação com o processamento padrão, mantendo a flexibilidade do pagamento conforme o uso.

24 de jun.
Recurso
o3-deep-research
o3-deep-research-2025-06-26
o4-mini-deep-research
o4-mini-deep-research-2025-06-26
v1/responses

Lançamos o3-deep-research e o4-mini-deep-research, variantes de pesquisa aprofundada dos nossos modelos de raciocínio da série o, otimizadas para tarefas de análise e pesquisa aprofundadas. Saiba mais no guia de pesquisa aprofundada.

Adicionamos suporte ao tratamento assíncrono de eventos com webhooks. Reduzimos e simplificamos os preços da ferramenta de pesquisa na Web. Adicionamos suporte à ferramenta de pesquisa na Web.

13 de jun.
Recurso
v1/responses

Novos prompts reutilizáveis agora estão disponíveis no painel e na API Responses. Pela API, agora você pode referenciar modelos de prompt criados no painel usando o parâmetro prompt (com um id de prompt e, opcionalmente, version) e fornecer valores dinâmicos em variables, que podem incluir strings, imagens ou arquivos de entrada. Os prompts reutilizáveis não estão disponíveis no Chat Completions. Saiba mais.

10 de jun.
Recurso
o3-pro
v1/responses
v1/batch

Lançamos o3-pro, uma versão do modelo de raciocínio o3 que usa mais recursos computacionais para resolver problemas difíceis com melhor raciocínio e consistência. Os preços do modelo o3 também foram reduzidos para todas as solicitações à API, incluindo processamento em lote e processamento Flex.

4 de jun.
Recurso
v1/fine_tuning

Adicionamos suporte a ajuste fino com otimização direta de preferências para os modelos gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 e gpt-4.1-nano-2025-04-14.

3 de jun.
Recurso
v1/chat/completions
v1/realtime

Novos snapshots dos modelos gpt-4o-audio-preview e gpt-4o-realtime-preview estão disponíveis. Lançamos o SDK de Agentes para TypeScript.

maio de 2025

20 de mai.
Recurso
v1/responses

Adicionamos suporte a novas ferramentas integradas na API Responses, incluindo servidores MCP remotos e Code Interpreter. Saiba mais sobre as ferramentas.

20 de mai.
Recurso
v1/responses
v1/chat/completions

Adicionamos suporte ao modo strict para esquemas de ferramentas ao usar chamadas paralelas de ferramentas com modelos que não passaram por ajuste fino. Adicionamos novos recursos de esquemas, incluindo validação de strings para email e outros padrões, além da especificação de intervalos para números e arrays.

15 de mai.
Recurso
codex-mini-latest
v1/responses
v1/chat/completions

Lançamos codex-mini-latest na API, otimizado para uso com o Codex CLI.

7 de mai.
Recurso
v1/fine-tuning
v1/responses
v1/chat/completions

Lançamos suporte a ajuste fino por reforço. Conheça os métodos de ajuste fino disponíveis. gpt-4.1-nano agora está disponível para ajuste fino.

abril de 2025

23 de abr.
Recurso
v1/images/generations
v1/images/edits

Adicionamos um novo modelo de geração de imagens, gpt-image-1. Esse modelo estabelece um novo padrão para geração de imagens, com melhor qualidade e maior capacidade de seguir instruções.

Atualizamos os endpoints de geração e edição de imagens para oferecer suporte a novos parâmetros específicos do modelo gpt-image-1.

16 de abr.
Recurso
v1/chat/completions
v1/responses

Adicionamos dois novos modelos de raciocínio da série o, o3 e o4-mini. Eles estabelecem um novo padrão para matemática, ciência, programação, tarefas de raciocínio visual e redação técnica.

Lançamos o Codex, nossa ferramenta CLI de geração de código.

14 de abr.
Recurso
gpt-4.1
gpt-4.1-mini
gpt-4.1-nano
v1/responses
v1/chat/completions
v1/fine_tuning

Adicionamos os modelos gpt-4.1, gpt-4.1-mini e gpt-4.1-nano à API. Esses novos modelos trazem melhorias na capacidade de seguir instruções e programar, além de uma janela de contexto maior (até 1 milhão de tokens). gpt-4.1 e gpt-4.1-mini estão disponíveis para ajuste fino supervisionado. Anunciamos a descontinuação de gpt-4.5-preview.

março de 2025

20 de mar.
Atualização
v1/audio

Adicionamos os modelos gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe e whisper-1 à API de áudio.

19 de mar.
Recurso
o1-pro
v1/responses
v1/batch

Lançamos o1-pro, uma versão do modelo de raciocínio o1 que usa mais recursos computacionais para resolver problemas difíceis com melhor raciocínio e consistência.

11 de mar.
Recurso
gpt-4o-search-preview
gpt-4o-mini-search-preview
computer-use-preview
v1/chat/completions
v1/assistants
v1/responses

Lançamos vários modelos e ferramentas novos, além de uma nova API para fluxos de trabalho agênticos:

  • Lançamos a API Responses, uma nova API para criar e usar agentes e ferramentas.
  • Lançamos um conjunto de ferramentas integradas para a API Responses: pesquisa na Web, pesquisa de arquivos e uso do computador.
  • Lançamos o SDK de Agentes, um framework de orquestração para projetar, desenvolver e implantar agentes.
  • Anunciamos novos modelos: gpt-4o-search-preview, gpt-4o-mini-search-preview, computer-use-preview.
  • Anunciamos planos para levar todos os recursos da API Assistants para a API Responses, que é mais fácil de usar, com previsão de encerramento do Assistants em 2026 (após alcançar paridade completa de recursos).
3 de mar.
Recurso
v1/fine_tuning/jobs

Adicionamos suporte ao campo metadata nos jobs de ajuste fino.

fevereiro de 2025

27 de fev.
Recurso
GPT-4.5
v1/chat/completions
v1/assistants
v1/batch

Lançamos uma prévia de pesquisa do GPT-4.5, nosso maior e mais capaz modelo de chat até então. O alto "EQ" do GPT-4.5 e sua compreensão da intenção do usuário o tornam melhor em tarefas criativas e planejamento agêntico.

25 de fev.
Recurso

Lançamos a atualização do painel de uso da API. Esta atualização atende a solicitações de filtros de dados adicionais, como seleção de projetos, seletor de datas e intervalos mais detalhados. Também melhoramos o suporte à visualização do uso em diferentes produtos e níveis de serviço.

5 de fev.
Recurso

Apresentamos a residência de dados na Europa. Leia mais aqui.

janeiro de 2025

31 de jan.
Recurso
o3-mini
o3-mini-2025-01-31
v1/chat/completions

Lançamos o o3-mini, um novo modelo de raciocínio pequeno, otimizado para tarefas de ciência, matemática e programação.

21 de jan.
Recurso
o1

Ampliamos o acesso ao modelo o1. Os modelos da série o1 são treinados com aprendizado por reforço para realizar raciocínio complexo.

dezembro de 2024

18 de dez.
Recurso

Lançamos a rotação de chaves da API de administração, permitindo que os clientes façam a rotação dessas chaves programaticamente.

Atualizamos os convites da API de administração, permitindo que os clientes convidem usuários programaticamente para projetos ao mesmo tempo que os convidam para organizações.

17 de dez.
Recurso
o1
gpt-4o
gpt-4o-mini
v1/fine_tuning
v1/chat/completions
v1/realtime

Adicionamos novos modelos para o1, gpt-4o-realtime, gpt-4o-audio e mais.

Adicionamos o método de conexão via WebRTC à Realtime API.

Adicionamos o parâmetro reasoning_effort para os modelos o1.

Adicionamos o papel de mensagem developer para o modelo o1. Observe que o1-preview e o1-mini não oferecem suporte a mensagens de sistema ou de desenvolvedor.

Lançamos o ajuste fino por preferências usando otimização direta de preferências (DPO).

Lançamos SDKs em versão beta para Go e Java. Saiba mais.

Adicionamos suporte à Realtime API no SDK para Python.

4 de dez.
Recurso

Lançamos a API de uso, permitindo que os clientes consultem programaticamente atividades e gastos nas APIs da OpenAI.

novembro de 2024

20 de nov.
Atualização
v1/chat/completions

Lançamos o gpt-4o-2024-11-20, nosso modelo mais recente da série gpt-4o.

4 de nov.
Recurso
v1/chat/completions

Lançamos as saídas previstas, que reduzem significativamente a latência das respostas do modelo quando grande parte da resposta já é conhecida de antemão. Isso é mais comum ao gerar novamente o conteúdo de documentos e arquivos de código com apenas pequenas alterações.

outubro de 2024

30 de out.
Recurso
gpt-4o-realtime-preview
gpt-4o-audio-preview
v1/chat/completions

Adicionamos cinco novos tipos de voz à Realtime API e à API chat completions.

17 de out.
Recurso
gpt-4o-audio-preview
v1/chat/completions

Lançamos o novo modelo gpt-4o-audio-preview para chat completions, com suporte a entradas e saídas de áudio. Ele usa o mesmo modelo subjacente da Realtime API.

1 de out.
Recurso
v1/realtime
v1/chat/completions
v1/fine_tuning

Lançamos vários novos recursos no OpenAI DevDay em São Francisco:

Realtime API: Crie experiências rápidas de fala para fala nos seus aplicativos usando uma interface WebSockets.

Destilação de modelos: Plataforma para fazer o ajuste fino de modelos econômicos com as saídas que você obtém de um grande modelo de fronteira.

Ajuste fino com imagens: Faça o ajuste fino do GPT-4o com imagens e texto para melhorar suas capacidades de visão.

Avaliações: Crie e execute avaliações personalizadas para medir o desempenho do modelo em tarefas específicas.

Cache de prompts: Descontos e processamento mais rápido de tokens de entrada vistos recentemente.

Gerar no playground: Gere facilmente prompts, definições de funções e esquemas de saída estruturada no playground usando o botão Gerar.

setembro de 2024

26 de set.
Recurso
omni-moderation-latest
v1/moderations

Lançamos o novo modelo de moderação omni-moderation-latest, que oferece suporte a imagens e texto (em algumas categorias), inclui duas novas categorias de danos exclusivas para texto e apresenta pontuações mais precisas.

12 de set.
Recurso
o1-preview
o1-mini
v1/chat/completions

Lançamos o o1-preview e o1-mini, novos modelos de linguagem de grande porte treinados com aprendizado por reforço para realizar tarefas de raciocínio complexo.

agosto de 2024

20 de ago.
Recurso
gpt-4o
v1/fine_tuning

O ajuste fino do gpt-4o-2024-08-06 está disponível para todos. Todos os usuários da API agora podem fazer o ajuste fino do modelo GPT-4o mais recente.

15 de ago.
Atualização
gpt-4o
v1/chat/completions

Lançamos um modelo dinâmico para chatgpt-4o-latest. Esse modelo apontará para o modelo GPT-4o mais recente usado pelo ChatGPT.

6 de ago.
Atualização

Lançamos as saídas estruturadas. As saídas dos modelos agora seguem de forma confiável os esquemas JSON fornecidos pelos desenvolvedores.

Lançamos o gpt-4o-2024-08-06, nosso modelo mais recente da série gpt-4o.

1 de ago.
Atualização

Lançamos as APIs de administração e de logs de auditoria, permitindo que os clientes administrem sua organização programaticamente e monitorem alterações usando os logs de auditoria. O registro de auditoria precisa ser ativado nas configurações.

julho de 2024

24 de jul.
Atualização

Lançamos a configuração de SSO por autoatendimento, permitindo que clientes empresariais com faturamento personalizado e ilimitado configurem a autenticação com o IDP de sua preferência.

23 de jul.
Atualização

Lançamos o ajuste fino do GPT-4o mini, permitindo um desempenho ainda melhor em casos de uso específicos.

18 de jul.
Atualização

Lançamos o GPT-4o mini, nosso modelo pequeno, econômico e inteligente para tarefas rápidas e leves.

17 de jul.
Atualização

Lançamos o Uploads para enviar arquivos grandes em várias partes.

junho de 2024

6 de jun.
Atualização

A chamada de função em paralelo pode ser desativada em Chat Completions e na API Assistants passando parallel_tool_calls=false.

Lançamos o SDK para .NET em versão beta.

3 de jun.
Atualização

maio de 2024

15 de mai.
Atualização

Adicionamos suporte ao arquivamento de projetos. Somente proprietários da organização podem acessar essa funcionalidade.

Adicionamos suporte à definição de limites de custo por projeto para clientes que pagam conforme o uso.

13 de mai.
Atualização

Lançamos o GPT-4o na API. O GPT-4o é nosso modelo principal mais rápido e econômico.

9 de mai.
Atualização
7 de mai.
6 de mai.
Atualização

Adicionamos o parâmetro stream_options: {"include_usage": true} às APIs Chat Completions e Completions. Essa configuração permite que os desenvolvedores acessem estatísticas de uso durante o streaming.

2 de mai.
Atualização

Adicionamos um novo endpoint para excluir uma mensagem de uma thread na API Assistants.

abril de 2024

29 de abr.
Atualização

Adicionamos uma nova opção de chamada de função, tool_choice: "required", às APIs Chat Completions e Assistants.

Adicionamos um guia da API de processamento em lote e suporte a modelos de embeddings nessa API

17 de abr.
Atualização

Introduzimos uma série de atualizações na API Assistants, incluindo uma nova ferramenta de pesquisa de arquivos que permite até 10.000 arquivos por assistente, novos controles de tokens e suporte à escolha de ferramentas.

16 de abr.
Atualização

Introduzimos uma hierarquia baseada em projetos para organizar o trabalho por projeto, incluindo a possibilidade de criar chaves de API e gerenciar limites de taxa e de custo por projeto (limites de custo disponíveis apenas para clientes empresariais).

15 de abr.
Atualização
9 de abr.
Atualização

Disponibilizamos o GPT-4 Turbo com visão para uso geral na API

4 de abr.
Atualização

Adicionamos suporte a seed na API de ajuste fino

Adicionamos suporte a checkpoints na API de ajuste fino

Adicionamos suporte à adição de Messages ao criar um Run na API Assistants

1 de abr.
Atualização

Adicionamos suporte à filtragem de Messages por run_id na API Assistants

março de 2024

29 de mar.
Atualização

Adicionamos suporte a temperature e à criação de mensagens do assistente na API Assistants

14 de mar.
Atualização

Adicionamos suporte a streaming na API Assistants

fevereiro de 2024

9 de fev.
Atualização

Adicionamos o parâmetro timestamp_granularities à API de áudio

janeiro de 2024

25 de jan.
Atualização

Lançamos os modelos de embeddings V3 e uma prévia atualizada do GPT-4 Turbo

Adicionamos o parâmetro dimensions à API de embeddings

dezembro de 2023

20 de dez.
Atualização

Adicionamos o parâmetro additional_instructions à criação de execuções na API Assistants

15 de dez.
Atualização

Adicionados os parâmetros logprobs e top_logprobs à API Chat Completions

14 de dez.
Atualização

O argumento de parâmetros da função em uma chamada de ferramenta passou a ser opcional

novembro de 2023

30 de nov.
Atualização

Lançado o OpenAI Deno SDK

6 de nov.
Atualização

outubro de 2023

16 de out.
Atualização

Adicionado o parâmetro encoding_format à API Embeddings

Adicionado max_tokens aos modelos de moderação

6 de out.
Atualização

Adicionado suporte à chamada de função à API de ajuste fino