GPT-6 Astra est notre modèle le plus performant, conçu pour mener de bout en bout les tâches les plus difficiles.
Utilisez-le pour le raisonnement complexe, la programmation, l’utilisation de l’ordinateur, la recherche et la création de documents.
reasoning.effort prend en charge les valeurs low, medium, high, xhigh et max.
Consultez le guide du modèle pour bien démarrer avec GPT-6 Astra.
Pour les prompts contenant plus de 272 000 tokens d’entrée, les tarifs des tokens d’entrée et des tokens en cache sont multipliés par 2, et ceux des tokens de sortie par 1,5, pour l’ensemble de la requête.
Les écritures en cache sont facturées à 1,25 fois le tarif des tokens d’entrée non mis en cache.
Les tarifs du traitement par lots et de Flex correspondent à 50 % des tarifs Standard. Le mode Rapide est facturé au double des tarifs applicables.
| Niveau | RPM | TPM | Limite de la file d’attente du traitement par lots |
|---|---|---|---|
| Gratuit | Non pris en charge | ||
| Niveau 1 | 500 | 500,000 | 1,500,000 |
| Niveau 2 | 5,000 | 1,000,000 | 3,000,000 |
| Niveau 3 | 5,000 | 2,000,000 | 100,000,000 |
| Niveau 4 | 10,000 | 4,000,000 | 200,000,000 |
| Niveau 5 | 15,000 | 40,000,000 | 15,000,000,000 |