For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navigation principale
gpt-5.6-sol
GPT-5.6 Sol
Modèle phare pour les tâches professionnelles complexes
Raisonnement
Vitesse
Prix
$4$20
Entrée
Sortie

GPT-5.6 Sol est un modèle phare de la famille GPT-5.6. Il correspond approximativement au niveau de modèle sans suffixe utilisé dans les précédentes familles GPT-5. L’alias gpt-5.6 achemine les requêtes vers GPT-5.6 Sol. Reasoning.effort prend en charge les valeurs suivantes : none, low, medium (par défaut), high, xhigh et max.

Fenêtre de contexte de 1,050,000
128,000 tokens de sortie au maximum
Date limite des connaissances : Feb 16, 2026
Prise en charge des tokens de raisonnement
Tarifs
La tarification repose sur le nombre de tokens utilisés ou sur d’autres mesures selon le type de modèle. Pour les modèles dédiés à des outils, comme la recherche et l’utilisation de l’ordinateur, chaque appel d’outil est facturé. Consultez les détails sur la page des tarifs.
Tokens de texte
Par 1M tokens
Entrée
$4.00
Entrée en cache
$0.40
Sortie
$20.00
Comparaison rapide
Entrée
Entrée en cache
Sortie
GPT-5.5
$5.00
GPT-5.6 Sol
$4.00
GPT-5.4
$2.50

GPT-5.6 Sol coûte 4 $ par million de tokens d’entrée et 20 $ par million de tokens de sortie, soit une réduction de 20 % du tarif en entrée et de 33 % du tarif en sortie. Les tarifs promotionnels de GPT-5.6 Sol sont disponibles au moins jusqu’au 21 novembre 2026 inclus.

Les prompts contenant >272K tokens d’entrée sont facturés à 2x le tarif en entrée et à 1.5x le tarif en sortie pour l’ensemble de la requête.

Les écritures dans le cache sont facturées à 1.25x le tarif des tokens d’entrée non mis en cache.

Modalités
Texte
Entrée et sortie
Image
Entrée uniquement
Audio
Non pris en charge
Vidéo
Non pris en charge
Points de terminaison
En direct
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traduction en temps réel
v1/realtime/translations
Transcription en temps réel
v1/realtime/transcription_sessions
Assistants
v1/assistants
Traitement par lots
v1/batch
Affinage
v1/fine-tuning
Plongements vectoriels
v1/embeddings
Génération d’images
v1/images/generations
Vidéos
v1/videos
Modification d’images
v1/images/edits
Génération de parole
v1/audio/speech
Transcription
v1/audio/transcriptions
Traduction
v1/audio/translations
Modération
v1/moderations
Completions (ancienne version)
v1/completions
Fonctionnalités
Diffusion en continu
Pris en charge
Appel de fonction
Pris en charge
Sorties structurées
Pris en charge
Affinage
Non pris en charge
Outils
Outils pris en charge par ce modèle avec l’API Responses.
Recherche web
Pris en charge
Recherche de fichiers
Pris en charge
Génération d’images
Pris en charge
Interpréteur de code
Pris en charge
Shell distant
Pris en charge
Application de patchs
Pris en charge
Skills
Pris en charge
Utilisation de l’ordinateur
Pris en charge
MCP
Pris en charge
Recherche d’outils
Pris en charge
Instantanés
Les instantanés vous permettent de fixer une version précise du modèle afin de maintenir des performances et un comportement constants. Vous trouverez ci-dessous la liste de tous les instantanés et alias disponibles pour GPT-5.6 Sol.
gpt-5.6-sol
gpt-5.6-sol
gpt-5.6-sol
gpt-5.6-sol
Limites de débit
Les limites de débit garantissent un accès équitable et fiable à l’API en fixant des plafonds précis pour les requêtes, les tokens, la durée audio ou d’autres usages sur une période donnée. Votre niveau d’utilisation détermine ces plafonds et augmente automatiquement à mesure que vous envoyez davantage de requêtes et dépensez davantage pour l’API.
NiveauRPMTPMLimite de la file d’attente du traitement par lots
GratuitNon pris en charge
Niveau 1500500,0001,500,000
Niveau 25,0001,000,0003,000,000
Niveau 35,0002,000,000100,000,000
Niveau 410,0004,000,000200,000,000
Niveau 515,00040,000,00015,000,000,000