For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
gpt-4o-mini
GPT-4o Mini
Modelo pequeño, rápido y económico para tareas específicas
Inteligencia
Velocidad
Precio
$0.15$0.6
Entrada
Salida

GPT-4o Mini (“o” de “omni”) es un modelo pequeño, rápido y económico para tareas específicas. Acepta tanto texto como imágenes de entrada y genera resultados de texto (incluidos resultados estructurados). Es ideal para el ajuste fino, y los resultados de un modelo más grande, como GPT-4o, se pueden destilar en GPT-4o-Mini para obtener resultados similares con menor costo y latencia.

Ventana de contexto de 128,000
Máximo de 16,384 tokens de salida
Fecha límite de conocimiento: Oct 01, 2023
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de texto
Por 1M tokens
Precio de la API de procesamiento por lotes
Entrada
$0.15
Entrada en caché
$0.075
Salida
$0.60
Comparación rápida
Entrada
Entrada en caché
Salida
GPT-4o
$2.50
o3-mini
$1.10
GPT-4o Mini
$0.15
Modalidades
Texto
Entrada y salida
Imagen
Solo entrada
Audio
No compatible
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
Compatible
Llamada a funciones
Compatible
Resultados estructurados
Compatible
Ajuste fino
Compatible
Resultados predichos
Compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para GPT-4o Mini.
gpt-4o-mini
gpt-4o-mini
gpt-4o-mini-2024-07-18
gpt-4o-mini-2024-07-18
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelRPMRPDTPMLímite de la cola de procesamiento por lotes
GratisNo compatible
Nivel 150010,000200,0002,000,000
Nivel 25,000-2,000,00020,000,000
Nivel 35,000-4,000,00040,000,000
Nivel 410,000-10,000,0001,000,000,000
Nivel 530,000-150,000,00015,000,000,000