For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal
gpt-realtime-whisper
GPT-Realtime-Whisper
Modelo de conversão de fala em texto com streaming para transcrição em tempo real
Desempenho
Velocidade
Preço
$0.017
Entrada
Saída

GPT-Realtime-Whisper é um modelo de conversão de fala em texto com streaming para aplicações que precisam de atualizações incrementais da transcrição com baixa latência a partir de áudio ao vivo. Ele foi projetado para casos de uso em tempo real nos quais os desenvolvedores precisam ajustar a latência e a precisão. O preço do GPT-Realtime-Whisper é calculado pela duração do áudio, e não por tokens de texto.

Janela de contexto de 16,000
Máximo de 2,000 tokens de saída
Data de corte do conhecimento: Sep 30, 2024
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Duração do áudio em tempo real
Por minuto
Preço
$0.017

O preço do GPT-Realtime-Whisper é calculado pela duração do áudio, e não por tokens de texto.

Modalidades
Texto
Entrada e saída
Imagem
Sem suporte
Áudio
Somente entrada
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Com suporte
Chamada de função
Sem suporte
Saídas estruturadas
Sem suporte
Ajuste fino
Sem suporte
Saídas previstas
Sem suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para GPT-Realtime-Whisper.
gpt-realtime-whisper
gpt-realtime-whisper
gpt-realtime-whisper
gpt-realtime-whisper
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
NívelMinutos de áudio por minuto
GratuitoSem suporte
Nível 1100
Nível 2350
Nível 3650
Nível 41,000
Nível 51,300