For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
gpt-6-astra
GPT-6 Astra
Nuestro modelo más capaz, diseñado para abordar las tareas más difíciles de principio a fin
Razonamiento
Velocidad
Precio
$10$50
Entrada
Salida

GPT-6 Astra es nuestro modelo más capaz, diseñado para abordar las tareas más difíciles de principio a fin. Úsalo para razonamiento complejo, programación, uso de la computadora, investigación y creación de documentos. reasoning.effort admite low, medium, high, xhigh y max.

Da tus primeros pasos con GPT-6 Astra con la guía del modelo.

Ventana de contexto de 1,050,000
Máximo de 128,000 tokens de salida
Fecha límite de conocimiento: Apr 30, 2026
Compatibilidad con tokens de razonamiento
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de texto
Por 1M tokens
Entrada
$10.00
Entrada en caché
$1.00
Escrituras en caché
$12.50
Salida
$50.00

Los prompts con más de 272 000 tokens de entrada se cobran al doble de las tarifas de entrada y caché, y a 1,5 veces la tarifa de salida para toda la solicitud.

Las escrituras en caché se facturan a 1,25 veces la tarifa de los tokens de entrada sin caché.

Las tarifas de Procesamiento por lotes y Flex equivalen al 50 % de las tarifas de Standard. El modo rápido se cobra al doble de las tarifas aplicables.

Modalidades
Texto
Entrada y salida
Imagen
Solo entrada
Audio
No compatible
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
Compatible
Llamada a funciones
Compatible
Resultados estructurados
Compatible
Ajuste fino
No compatible
Herramientas
Herramientas compatibles con este modelo al usar la API Responses.
Búsqueda web
Compatible
Búsqueda de archivos
Compatible
Generación de imágenes
Compatible
Intérprete de código
Compatible
Terminal alojada en la nube
Compatible
Aplicar parches
Compatible
Habilidades
Compatible
Uso de la computadora
Compatible
MCP
Compatible
Búsqueda de herramientas
Compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para GPT-6 Astra.
gpt-6-astra
gpt-6-astra
gpt-6-astra
gpt-6-astra
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelRPMTPMLímite de la cola de procesamiento por lotes
GratisNo compatible
Nivel 1500500,0001,500,000
Nivel 25,0001,000,0003,000,000
Nivel 35,0002,000,000100,000,000
Nivel 410,0004,000,000200,000,000
Nivel 515,00040,000,00015,000,000,000