GPT-Realtime-1.5
Padrão
O melhor modelo de voz para entrada e saída de áudio
O melhor modelo de voz para entrada e saída de áudio
Desempenho
O mais alto
Velocidade
Rápido
Preço
$4•$16
Entrada•Saída
Entrada
Texto, Áudio, Imagem
Saída
Texto, Áudio
O GPT-Realtime-1.5 é nosso modelo principal de áudio para agentes de voz e suporte ao cliente.
Janela de contexto de 32,000
Máximo de 4,096 tokens de saída
Data de corte do conhecimento: Sep 30, 2024
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Tokens de texto
Por 1M tokens
Entrada
$4.00
Entrada em cache
$0.40
Saída
$16.00
Tokens de áudio
Por 1M tokens
Entrada
$32.00
Entrada em cache
$0.40
Saída
$64.00
Tokens de imagem
Por 1M tokens
Entrada
$5.00
Entrada em cache
$0.50
Modalidades
Texto
Entrada e saída
Imagem
Somente entrada
Áudio
Entrada e saída
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Sem suporte
Chamada de função
Com suporte
Saídas estruturadas
Sem suporte
Ajuste fino
Sem suporte
Saídas previstas
Sem suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para GPT-Realtime-1.5.
gpt-realtime-1.5
gpt-realtime-1.5
gpt-realtime-1.5
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
| Nível | RPM | RPD | TPM |
|---|---|---|---|
| Gratuito | Sem suporte | ||
| Nível 1 | 200 | 1,000 | 40,000 |
| Nível 2 | 400 | - | 200,000 |
| Nível 3 | 5,000 | - | 800,000 |
| Nível 4 | 10,000 | - | 4,000,000 |
| Nível 5 | 20,000 | - | 15,000,000 |