For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal
gpt-5.4-pro
GPT-5.4 Pro
Versão do GPT-5.4 que produz respostas mais inteligentes e precisas.
Raciocínio
Velocidade
Preço
$30$180
Entrada
Saída

O GPT-5.4 Pro usa mais recursos computacionais para raciocinar com mais profundidade e fornecer respostas consistentemente melhores.

O GPT-5.4 Pro está disponível apenas na Responses API para permitir interações com o modelo em múltiplos turnos antes de responder às solicitações da API, além de outros recursos avançados da API no futuro. Como o GPT-5.4 Pro foi projetado para resolver problemas difíceis, algumas solicitações podem levar vários minutos para serem concluídas. Para evitar que o tempo limite seja excedido, experimente usar o modo em segundo plano. Reasoning.effort aceita: medium (padrão), high e xhigh.

Janela de contexto de 1,050,000
Máximo de 128,000 tokens de saída
Data de corte do conhecimento: Aug 31, 2025
Suporte a tokens de raciocínio
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Tokens de texto
Por 1M tokens
Preço da API Batch
Entrada
$30.00
Saída
$180.00
Comparação rápida
Entrada
Saída
GPT-5.4 Pro
$30.00
o3-pro
$20.00
GPT-5.4
$2.50

Para modelos com uma janela de contexto de 1.05M (GPT-5.4 e GPT-5.4 Pro), prompts com >272K tokens de entrada são cobrados a 2x o preço de entrada e 1.5x o preço de saída durante toda a sessão, nas modalidades padrão, processamento em lote e flex.

Os endpoints de processamento regional (residência de dados) têm um acréscimo de 10% no preço para o GPT-5.4 e o GPT-5.4 Pro.

Modalidades
Texto
Entrada e saída
Imagem
Somente entrada
Áudio
Sem suporte
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Com suporte
Chamada de função
Com suporte
Saídas estruturadas
Sem suporte
Ajuste fino
Sem suporte
Ferramentas
Ferramentas compatíveis com este modelo ao usar a API Responses.
Pesquisa na Web
Com suporte
Pesquisa de arquivos
Com suporte
Geração de imagens
Com suporte
Code Interpreter
Sem suporte
Shell hospedado
Sem suporte
Aplicar patch
Com suporte
Habilidades
Sem suporte
Uso do computador
Com suporte
MCP
Com suporte
Pesquisa de ferramentas
Com suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para GPT-5.4 Pro.
gpt-5.4-pro
gpt-5.4-pro
gpt-5.4-pro-2026-03-05
gpt-5.4-pro-2026-03-05
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
NívelRPMTPMLimite da fila de processamento em lote
GratuitoSem suporte
Nível 15050,000900,000
Nível 2500100,0001,350,000
Nível 3500200,000100,000,000
Nível 41,000400,000200,000,000
Nível 51,5004,000,00015,000,000,000