For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal
gpt-realtime-2
GPT-Realtime-2
Modelo de raciocínio com uso de ferramentas
Raciocínio
Velocidade
Preço
$4$24
Entrada
Saída

GPT-Realtime-2 é nosso modelo de voz em tempo real mais capaz. Ele oferece suporte a interações de fala para fala com esforço de raciocínio configurável, maior capacidade de seguir instruções e uso mais confiável de ferramentas em fluxos de trabalho complexos com agentes de voz.

Janela de contexto de 128,000
Máximo de 32,000 tokens de saída
Data de corte do conhecimento: Sep 30, 2024
Suporte a tokens de raciocínio
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Tokens de texto
Por 1M tokens
Entrada
$4.00
Entrada em cache
$0.40
Saída
$24.00
Comparação rápida
Entrada
Entrada em cache
Saída
GPT-Realtime-2
$4.00
GPT-Realtime-1.5
$4.00
Tokens de áudio
Por 1M tokens
Entrada
$32.00
Entrada em cache
$0.40
Saída
$64.00
Tokens de imagem
Por 1M tokens
Entrada
$5.00
Entrada em cache
$0.50

GPT-Realtime-2 oferece suporte a esforço de raciocínio configurável. Um esforço de raciocínio maior pode aumentar a latência e o uso de tokens de saída.

Modalidades
Texto
Entrada e saída
Imagem
Somente entrada
Áudio
Entrada e saída
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Sem suporte
Chamada de função
Com suporte
Saídas estruturadas
Sem suporte
Ajuste fino
Sem suporte
Saídas previstas
Sem suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para GPT-Realtime-2.
gpt-realtime-2
gpt-realtime-2
gpt-realtime-2
gpt-realtime-2
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
NívelRPMRPDTPM
GratuitoSem suporte
Nível 12001,00040,000
Nível 2400-200,000
Nível 35,000-800,000
Nível 410,000-4,000,000
Nível 520,000-15,000,000