o3
Predeterminado
Modelo de razonamiento para tareas complejas, cuyo sucesor es GPT-5
Modelo de razonamiento para tareas complejas, cuyo sucesor es GPT-5
Razonamiento
La más alta
Velocidad
La más lenta
Precio
$2•$8
Entrada•Salida
Entrada
Texto, Imagen
Salida
Texto
o3 es un modelo versátil y potente en diversas áreas. Establece un nuevo estándar para tareas de matemáticas, ciencias, programación y razonamiento visual. También se destaca en la redacción técnica y el seguimiento de instrucciones. Úsalo para razonar sobre problemas de varios pasos que requieren analizar texto, código e imágenes.
GPT-5 es el sucesor de o3.
Obtén más información sobre cómo usar nuestros modelos de razonamiento en nuestra guía de razonamiento.
Ventana de contexto de 200,000
Máximo de 100,000 tokens de salida
Fecha límite de conocimiento: Jun 01, 2024
Compatibilidad con tokens de razonamiento
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de texto
Por 1M tokens
∙
Precio de la API de procesamiento por lotes
Entrada
$2.00
Entrada en caché
$0.50
Salida
$8.00
Comparación rápida
Entrada
Entrada en caché
Salida
o1
$15.00
o3
$2.00
o4-mini
$1.10
Tokens de texto
Por 1M tokens
Entrada
$1.00
Entrada en caché
$0.25
Salida
$4.00
Modalidades
Texto
Entrada y salida
Imagen
Solo entrada
Audio
No compatible
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
Compatible
Llamada a funciones
Compatible
Resultados estructurados
Compatible
Ajuste fino
No compatible
Resultados predichos
No compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para o3.
o3
o3-2025-04-16
o3-2025-04-16
En desuso
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
| Nivel | RPM | TPM | Límite de la cola de procesamiento por lotes |
|---|---|---|---|
| Gratis | No compatible | ||
| Nivel 1 | 500 | 30,000 | 90,000 |
| Nivel 2 | 5,000 | 450,000 | 1,350,000 |
| Nivel 3 | 5,000 | 800,000 | 50,000,000 |
| Nivel 4 | 10,000 | 2,000,000 | 200,000,000 |
| Nivel 5 | 10,000 | 30,000,000 | 5,000,000,000 |