For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
whisper-1
Whisper
Modelo de reconocimiento de voz de propósito general
Rendimiento
Velocidad
Precio
$0.006
Entrada
Salida

Whisper es un modelo de reconocimiento de voz de propósito general, entrenado con un gran conjunto de datos de audio diverso. También puedes usarlo como modelo multitarea para reconocer voz en varios idiomas, traducir voz e identificar idiomas.

Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Precios
Caso de uso / 1M tokens
Transcription
Costo / minuto
$0.006
Modalidades
Texto
Solo salida
Imagen
No compatible
Audio
Solo entrada
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para Whisper.
whisper-1
whisper-1
whisper-1
whisper-1
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelRPMRPD
Gratis3200
Nivel 1500-
Nivel 22,500-
Nivel 35,000-
Nivel 47,500-
Nivel 510,000-