For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navigation principale

Journal des modifications

Les dépréciations à venir sont indiquées sur la page des dépréciations.

septembre 2026

15 sept.
Fonctionnalité

Ajout de contrôles de gouvernance pour la création de clés API au niveau de l’organisation et du projet. Les administrateurs peuvent autoriser uniquement les clés de comptes de service, autoriser uniquement les clés de projet appartenant à des utilisateurs ou désactiver toute création de nouvelles clés API. Les restrictions de l’organisation prévalent sur les paramètres du projet, et les clés API existantes ne sont pas affectées. Consultez les bonnes pratiques en production pour en savoir plus.

10 sept.
Fonctionnalité

Vous pouvez désormais définir une date d’expiration lors de la création de clés API de projet. Les administrateurs peuvent également imposer une durée de validité maximale au niveau de l’organisation ou du projet dans les paramètres de la plateforme. Les nouvelles clés doivent alors expirer dans le délai configuré. Consultez les bonnes pratiques en production pour obtenir des conseils sur l’expiration et la rotation des clés.

10 sept.
Fonctionnalité

Lancement de l’API Agents en bêta publique. Créez des agents avec un harnais Codex géré, tandis qu’OpenAI prend en charge l’orchestration des sessions, le compactage du contexte et la reprise après incident.

Utilisez des sessions durables pour poursuivre le travail d’un tour de conversation à l’autre, diffuser la progression en continu et connecter vos propres outils et serveurs MCP. Exécutez des agents dans des bacs à sable hébergés par OpenAI ou connectez un bac à sable provenant de votre propre infrastructure ou d’un fournisseur pris en charge.

Commencez par le guide de démarrage rapide de l’API Agents.

10 sept.
Fonctionnalité
gpt-live-1
v1/live/sessions

GPT-Live 1 est désormais en disponibilité générale dans l’API. Créez des conversations vocales en duplex intégral qui peuvent se poursuivre pendant qu’un modèle ou un agent côté backend prend en charge le raisonnement et les outils.

Utilisez la délégation via Responses avec un modèle OpenAI, ou la délégation côté client pour connecter votre propre backend. Les sessions vocales coûtent 0,05 $ par minute, avec une facturation à la seconde ; l’utilisation du modèle côté backend et des outils est facturée séparément.

Pour commencer, consultez les guides sur GPT-Live, la conception de prompts et la migration. Consultez les tarifs pour en savoir plus.

8 sept.
Fonctionnalité
v1/responses

Les diagnostics du cache de prompts sont désormais disponibles de manière générale dans l’API Responses pour GPT-5.6 et les modèles ultérieurs compatibles.

Comparez la réutilisation du cache avec celle d’une réponse précédente, identifiez les causes des échecs de cache et suivez les conseils de dépannage pour améliorer la réutilisation du cache.

8 sept.
Fonctionnalité
gpt-image-2.5-sunburst
gpt-image-2.5-flare
v1/images
v1/responses

Lancement de GPT Image 2.5 Sunburst et de GPT Image 2.5 Flare pour la génération et la modification d’images via l’API Image et l’outil de génération d’images de l’API Responses.

Utilisez Sunburst pour les workflows où la précision des retouches prime, ou Flare pour générer rapidement des images de haute qualité au quotidien. Les deux modèles prennent en charge les nouveaux paramètres de qualité xhigh et max et appliquent les tarifs par token de GPT Image 2. Consultez le guide de génération d’images et les tarifs.

8 sept.
Fonctionnalité
gpt-rosalind-research

GPT-Rosalind (gpt-rosalind-research) est désormais en disponibilité générale via le programme d’accès de confiance pour les travaux de recherche internes approuvés en sciences de la vie.

Les tarifs standard sont de 5 $ par million de tokens d’entrée, de 0,50 $ par million de tokens d’entrée en cache et de 25 $ par million de tokens de sortie. La facturation débute le 5 octobre 2026. Consultez les tarifs pour en savoir plus.

3 sept.
Fonctionnalité
gpt-6-astra
v1/responses
v1/chat/completions

Lancement de GPT-6 Astra, notre modèle le plus performant, conçu pour mener à bien les tâches les plus difficiles de bout en bout.

Utilisez GPT-6 Astra pour le raisonnement, la programmation, l’utilisation de l’ordinateur, la recherche et la création de documents. Il combine ces capacités pour mener des tâches complexes de la demande initiale au résultat final, en s’appuyant sur le contexte et les outils que vous fournissez.

Principaux changements à prendre en compte lors de la migration :

  • GPT-6 Astra ne prend pas en charge le niveau d’effort de raisonnement none.
  • GPT-6 Astra ne prend pas en charge les valeurs personnalisées de temperature ou de top_p, ni les probabilités logarithmiques (logprobs).
  • L’appel d’outils nécessite l’API Responses. Si vous utilisez des outils avec Chat Completions, suivez le guide de migration vers Responses.
  • La surveillance du désalignement recherche de manière asynchrone d’éventuels problèmes pendant le travail de l’agent dans les requêtes compatibles de l’API Responses. Ces vérifications peuvent déclencher des alertes de sécurité ou interrompre une conversation pour révision.

Commencez par le guide Utilisation de GPT-6 Astra pour découvrir ses capacités et obtenir des conseils sur la conception de prompts et la migration. Explorez l’utilisation de l’ordinateur pour les workflows dans le navigateur et sur le bureau, et consultez les tarifs pour connaître les offres d’inférence disponibles.

3 sept.
Fonctionnalité
v1/responses

Ajout de nouvelles commandes pour les tâches de longue durée avec GPT-6 Astra dans l’API Responses :

  • Appel asynchrone d’outils : laissez le modèle continuer à travailler pendant que votre application exécute des outils de type fonction ou des outils personnalisés, puis renvoyez les résultats à mesure qu’ils deviennent disponibles.
  • Réorientation en cours de tour : envoyez des instructions supplémentaires pendant la génération d’une réponse via WebSockets, afin que le modèle puisse intégrer des corrections ou de nouvelles exigences.
  • Modification de l’effort de raisonnement en cours de conversation : augmentez l’effort pour les tâches difficiles ou réduisez-le pour les demandes de suivi courantes, tout en conservant le préfixe de prompt mis en cache.
2 sept.
Mise à jour

Mise à jour des erreurs de l’API pour permettre aux applications de distinguer une hausse trop rapide du trafic d’une surcharge temporaire du modèle.

Une hausse trop rapide du trafic peut entraîner une erreur 429 avec le code slow_down. Une surcharge temporaire du modèle entraîne une erreur 503 avec le code server_is_overloaded. Les deux réponses peuvent inclure Retry-After. Lorsque cet en-tête est présent, attendez au moins la durée qu’il indique avant de réessayer. S’il est absent, utilisez un délai exponentiel entre les tentatives. Consultez le guide des codes d’erreur et le guide des limites de débit.

1 sept.
Mise à jour

Les connexions à api.openai.com peuvent désormais utiliser IPv6.

août 2026

29 août
Fonctionnalité

Le TLS mutuel (mTLS) et la fédération d’identités de charge de travail X.509 sont désormais disponibles de manière générale pour l’API OpenAI. Configurez les certificats et les fournisseurs d’identité X.509 directement dans la console de la plateforme, avec un accès contrôlé par les rôles et les autorisations de votre organisation.

26 août
Mise à jour
whisper-1
gpt-4o-transcribe
gpt-4o-mini-transcribe
gpt-4o-transcribe-diarize
v1/audio/transcriptions
v1/realtime

Annonce de la dépréciation de whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe et gpt-4o-transcribe-diarize. Ces modèles seront arrêtés le 26 février 2027. Migrez vers gpt-live-transcribe ou gpt-transcribe. Consultez le guide de transcription et la page des dépréciations.

L’API Assistants a été arrêtée le 26 août 2026. Migrez vers l’API Responses et l’API Conversations à l’aide du guide de migration.

21 août
Fonctionnalité

Les clients de l’API peuvent désormais sélectionner un traitement régional pour chaque requête en utilisant un domaine préfixé avec une clé API issue d’un projet dont la zone géographique est définie sur Global. Les exigences existantes en matière d’éligibilité, de contrôle de la conservation des données, de points de terminaison et de modèles pris en charge continuent de s’appliquer. Pour en savoir plus, consultez le guide des contrôles des données.

21 août
Mise à jour
gpt-5.6-sol

GPT-5.6 Sol coûte désormais 4 $ par million de tokens d’entrée et 20 $ par million de tokens de sortie, soit une baisse de 20 % du tarif d’entrée et de 33 % du tarif de sortie. Les tarifs promotionnels de GPT-5.6 Sol sont disponibles au moins jusqu’au 21 novembre 2026. Consultez les détails des tarifs.

20 août
Fonctionnalité

Lancement du tableau de bord de mise en cache des prompts sur la Plateforme API OpenAI. Suivez votre taux de succès du cache dans le temps, le nombre de lectures du cache par écriture et la répartition des tokens lus depuis le cache, écrits dans le cache et non mis en cache pour comprendre l’efficacité de votre mise en cache et identifier les améliorations possibles. Filtrez les indicateurs par modèle et par offre.

20 août
Mise à jour
gpt-image-2
gpt-image-2-2026-04-21
v1/images/generations
v1/images/edits
v1/responses

Les arrière-plans transparents sont désormais disponibles en préversion pour gpt-image-2 et gpt-image-2-2026-04-21 dans l’API Images et l’outil de génération d’images de l’API Responses. Définissez background sur transparent et utilisez le format de sortie png ou webp ; jpeg ne prend pas en charge les arrière-plans transparents. Pour en savoir plus, consultez le guide de génération d’images.

13 août
Annonce

Annonce du mode Ultrarapide, une nouvelle offre de l’API pour GPT-5.6 Sol, jusqu’à 14 fois plus rapide que le traitement Standard. Disponible en préversion limitée pour certains clients. Inscrivez-vous ici pour recevoir les actualités du mode Ultrarapide.

7 août
Fonctionnalité
gpt-5.6-cyber
gpt-daybreak-red-latest
gpt-daybreak-blue-latest
v1/responses

Daybreak propose désormais deux niveaux d’accès aux spécialistes de la défense approuvés : Daybreak Blue et Daybreak Red. Utilisez-les pour passer des constats de sécurité à des correctifs validés dans le cadre de missions explicitement autorisées.

Commencez par Daybreak Blue pour la plupart des tâches de sécurité défensive. Il donne accès à des modèles généralistes tels que GPT-5.6 Sol pour la découverte de vulnérabilités, la revue de code axée sur la sécurité, l’ingénierie de détection, la réponse aux incidents, l’analyse de logiciels malveillants et la validation de correctifs. Pour en savoir plus, consultez cette page.

Daybreak Red donne accès, sous réserve d’une approbation distincte, à des modèles spécialement entraînés tels que GPT-5.6 Cyber pour des activités autorisées de reproduction de vulnérabilités, de validation d’exploits, de tests d’intrusion, de red teaming et d’analyse de systèmes complexes.

Ces modèles nécessitent une approbation et un provisionnement distincts. Vous pouvez demander à rejoindre le programme Daybreak ici. Consultez les détails des tarifs ici.

6 août
Mise à jour
chat-latest

Mise à jour de l’instantané chat-latest , qui pointe vers le dernier modèle disponible dans ChatGPT pour les utilisateurs Plus et Pro. Nous recommandons d’utiliser GPT-5.6 Sol pour l’utilisation de l’API en production, mais vous pouvez utiliser ce modèle pour tester les dernières améliorations des cas d’utilisation conversationnels. L’instantané du modèle sous-jacent sera régulièrement mis à jour. Pour en savoir plus, consultez cette page.

5 août
Mise à jour
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna

Le mode Rapide prend désormais en charge les requêtes à contexte long pour GPT-5.6 Sol, GPT-5.6 Terra et GPT-5.6 Luna. Dès aujourd’hui, les prompts à contexte long dépassant 272 000 tokens peuvent être traités en mode Rapide, jusqu’à 2,5 fois plus vite qu’avec l’offre Standard. Consultez les détails des tarifs.

4 août
Fonctionnalité

Les clients peuvent désormais filtrer et regrouper les données par clé API dans les tableaux de bord Utilisation et Coûts. L’API Usage et l’API Costs prennent également en charge la dimension clé API pour la création de rapports et l’analyse par programmation.

juillet 2026

30 juil.
Mise à jour
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions

À compter du 30 juillet, GPT-5.6 Luna coûte 80 % de moins et GPT-5.6 Terra coûte 20 % de moins. Consultez les détails des tarifs.

Nous lançons également le mode Rapide dans l’API, en remplacement de notre offre de traitement prioritaire. Pour GPT-5.6 Sol, le mode Rapide offre désormais une vitesse jusqu’à 2,5 fois supérieure à celle du traitement standard, pour un prix deux fois plus élevé. Ce changement est rétrocompatible : les requêtes marquées priority utiliseront automatiquement le mode Rapide.

29 juil.
Fonctionnalité

Lancement du fournisseur Terraform OpenAI officiel pour gérer les ressources de la Plateforme API OpenAI sous forme d’infrastructure as code.

Provisionnez et gérez les projets, les utilisateurs, les groupes, les rôles, les attributions d’accès, les comptes de service, les certificats, les invitations et les limites de débit par projet. Utilisez les workflows Terraform habituels pour examiner et appliquer les modifications, importer des ressources existantes, ainsi que détecter et corriger les écarts de configuration. Installez le fournisseur depuis le Terraform Registry.

28 juil.
Fonctionnalité
gpt-transcribe
gpt-live-transcribe
v1/audio/transcriptions
v1/realtime

Lancement de GPT Transcribe pour la transcription précise de fichiers et les transcriptions finales des tours Realtime validés, ainsi que de GPT Live Transcribe pour la transcription en continu à faible latence.

Les deux modèles prennent en charge un contexte de transcription en texte libre, des indications par mots-clés et plusieurs langues d’entrée attendues. Comparez les sorties et les workflows pris en charge dans le guide de transcription.

22 juil.
Fonctionnalité

Ajout de limites de dépenses strictes pour les organisations et les projets sur la Plateforme API OpenAI. Définissez un plafond mensuel qui entraîne une erreur 429 pour les requêtes API concernées lorsque les dépenses suivies atteignent la limite. Utilisez les alertes de dépenses pour recevoir une notification avant l’interruption du trafic. Pour en savoir plus, consultez le guide des limites de dépenses.

9 juil.
Fonctionnalité
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions
v1/batch

Lancement de la famille de modèles GPT-5.6, comprenant GPT-5.6 Sol pour des capacités de pointe, GPT-5.6 Terra pour un équilibre entre intelligence et coût, et GPT-5.6 Luna pour traiter efficacement de grands volumes de travail. L’alias gpt-5.6 achemine les requêtes vers gpt-5.6-sol.

GPT-5.6 ajoute l’appel d’outils par programmation, des contrôles explicites de mise en cache des prompts, la persistance du raisonnement, le niveau d’effort de raisonnement max et le mode Pro, ainsi que l’orchestration multi-agents en bêta pour l’API Responses. GPT-5.6 accepte également les images dans leurs dimensions d’origine avec le niveau de détail d’image original ou auto.

6 juil.
Fonctionnalité
gpt-realtime-2.1
gpt-realtime-2.1-mini
v1/realtime

Lancement de GPT-Realtime-2.1, une mise à jour du modèle de raisonnement en temps réel qui améliore la reconnaissance alphanumérique, la gestion des silences et du bruit, ainsi que le comportement lors des interruptions. Lancement également de GPT-Realtime-2.1 mini, un modèle de raisonnement distillé plus rapide et moins coûteux pour les applications vocales en temps réel.

juin 2026

24 juin
Mise à jour
chat-latest

Mise à jour de l’instantané chat-latest, qui pointe vers le dernier modèle Instant actuellement utilisé dans ChatGPT. Nous recommandons d’utiliser GPT-5.5 pour l’utilisation de l’API en production, mais vous pouvez utiliser ce modèle pour tester les dernières améliorations des cas d’utilisation conversationnels. L’instantané du modèle sous-jacent sera régulièrement mis à jour. Pour en savoir plus, consultez cette page.

23 juin
Fonctionnalité

Lancement du tableau de bord de suivi de la sécurité sur la Plateforme API OpenAI. Le tableau de bord Sécurité affiche les requêtes Responses bloquées en fonction des valeurs safety_identifier envoyées dans les requêtes pour identifier les utilisateurs finaux. Consultez le tableau de bord Sécurité.

9 juin
Fonctionnalité
v1/responses

La recherche web peut désormais renvoyer des images en plus des résultats textuels habituels. Utilisez la recherche d’images lorsque votre application a besoin de visuels actuels ou issus du web, tels que des photos de produits, de monuments, de lieux ou d’événements, ou des références visuelles. Pour en savoir plus, consultez le guide de recherche web.

5 juin
Mise à jour

Lancement d’une navigation repensée pour la Plateforme API OpenAI. Découvrez-la ici.

4 juin
Fonctionnalité
omni-moderation-latest
v1/responses
v1/chat/completions

Ajout de scores de modération à l’API Responses et à l’API Chat Completions. Transmettez un objet moderation dans une requête de génération pour recevoir, dans une même réponse, les résultats de modération de l’entrée du modèle et de la sortie générée.

Pour en savoir plus, consultez le guide de modération.

3 juin
Mise à jour

Annonce de la dépréciation des objets de prompt réutilisables, de la plateforme d’évaluations et d’Agent Builder. Consultez la page des dépréciations pour connaître les calendriers d’arrêt et les consignes de migration.

2 juin
Mise à jour

À compter du 2 juin 2026, les sessions de conteneur éligibles seront facturées à la minute, avec un minimum de 5 minutes, au lieu d’être facturées au tarif d’une session complète de 20 minutes. Le tarif à la minute restera identique.

Cette mise à jour vise à affiner la facturation des sessions courtes et réduira le coût effectif pour les clients.

Vous trouverez les tarifs actuels des outils intégrés dans notre documentation sur les tarifs de l’API.

1 juin
Fonctionnalité
gpt-5.4
gpt-5.5
v1/responses

Les modèles OpenAI sont désormais disponibles dans Amazon Bedrock via un point de terminaison de l’API Responses compatible avec OpenAI. Les modèles et les fonctionnalités pris en charge varient selon la région AWS. En savoir plus.

mai 2026

29 mai
Mise à jour
v1/responses
v1/chat/completions
v1/batch

Pour les organisations où ZDR n’est pas activé, prompt_cache_retention prend désormais la valeur 24h par défaut au lieu de in_memory, ce qui active par défaut la mise en cache étendue des prompts. En savoir plus.

28 mai
Mise à jour
chat-latest

Lancement de l’instantané chat-latest, qui pointe vers le dernier modèle Instant actuellement utilisé dans ChatGPT. Nous recommandons d’utiliser GPT-5.5 pour l’utilisation de l’API en production, mais vous pouvez utiliser ce modèle pour tester les dernières améliorations des cas d’utilisation conversationnels. L’instantané du modèle sous-jacent sera régulièrement mis à jour. Pour en savoir plus, consultez cette page.

26 mai
Fonctionnalité

Lancement de la fédération d’identités de charge de travail. Les charges de travail de confiance peuvent échanger des jetons d’identité émis par des services externes contre des jetons d’accès OpenAI à courte durée de vie, sans stocker de clés API à longue durée de vie.

26 mai
Mise à jour

Ajout de nouvelles fonctionnalités à l’API d’administration pour gérer les alertes de dépenses, les listes de modèles autorisés, les paramètres de conservation des données et les autorisations des outils hébergés, ainsi que pour consulter les postes de facturation détaillés.

19 mai
Fonctionnalité

Lancement du tunnel MCP sécurisé pour les clients entreprise. Le tunnel MCP sécurisé permet aux produits OpenAI compatibles, notamment ChatGPT sur le web, Codex, l’API Responses et AgentKit, de se connecter à des serveurs MCP privés ou sur site via un tunnel-client hébergé par le client, sans exposer ces serveurs à l’Internet public.

19 mai
Mise à jour

Vous pouvez désormais gérer plusieurs listes d’adresses IP autorisées et appliquer chacune à un projet ou à l’ensemble de l’organisation. Pour les configurer, accédez à Paramètres > Sécurité > Liste d’adresses IP autorisées.

12 mai
Mise à jour
dall-e-2
dall-e-3
v1/realtime

Dépréciation des instantanés des modèles DALL·E et de la version bêta de la Realtime API.

Les instantanés de modèles DALL·E dall-e-2 et dall-e-3 ont été dépréciés et retirés de l’API le 12 mai 2026. Nous recommandons d’utiliser gpt-image-2, gpt-image-1 ou gpt-image-1-mini à la place.

La version bêta de la Realtime API a été dépréciée et retirée de l’API le 12 mai 2026. Si vous utilisez encore l’interface bêta, migrez vers la version stable de la Realtime API. Consultez le guide de migration et la page des dépréciations complète.

11 mai
Fonctionnalité
v1/responses

Ajout de return_token_budget à l’outil de recherche web de l’API Responses. Utilisez ce paramètre pour autoriser des recherches web plus longues avec les modèles de raisonnement GPT-5+, pour les tâches de recherche et d’évaluation qui demandent un effort important.

7 mai
Fonctionnalité
gpt-realtime-2
gpt-realtime-translate
gpt-realtime-whisper
v1/realtime
v1/realtime/translations
v1/realtime/transcription_sessions

Lancement de GPT-Realtime-2, un nouveau modèle vocal en temps réel au raisonnement configurable pour les agents de parole à parole, ainsi que de GPT-Realtime-Translate pour la traduction vocale en continu et de GPT-Realtime-Whisper pour la transcription vocale en continu.

Mise à jour du guide Realtime et audio, ajout d’un guide dédié à la traduction en temps réel, actualisation du guide Transcription en temps réel pour les transcriptions en continu et déplacement des conseils de conception de prompts en temps réel vers le guide Utilisation des modèles en temps réel.

7 mai
Fonctionnalité

Lancement du plugin OpenAI Developers pour Codex. Il vous aide à créer des applications et des agents d’IA dans Codex, en vous donnant accès à la plateforme OpenAI et à des conseils pour configurer l’API OpenAI.

6 mai
Mise à jour

La nouvelle version d’Agents SDK est désormais disponible en TypeScript, avec la prise en charge des agents en bac à sable et un harnais open source intégré. Pour en savoir plus, consultez cette page.

5 mai
Mise à jour
chat-latest

Lancement de l’instantané chat-latest, qui pointe vers le dernier modèle Instant actuellement utilisé dans ChatGPT. Nous recommandons d’utiliser GPT-5.5 pour les appels à l’API en production, mais vous pouvez utiliser ce modèle pour tester nos dernières améliorations pour les cas d’utilisation conversationnels. L’instantané du modèle sous-jacent sera régulièrement mis à jour. Pour en savoir plus, consultez cette page.

4 mai
Mise à jour

Les API d’administration sont désormais prises en charge dans les SDK OpenAI pour Node, Python, Go, Ruby et Java. Consultez le guide des API d’administration pour obtenir des instructions de configuration et des exemples.

avril 2026

24 avr.
Fonctionnalité
gpt-5.5
gpt-5.5-pro
v1/responses
v1/chat/completions
v1/batch

Lancement de GPT-5.5, un nouveau modèle de pointe pour les tâches professionnelles complexes, dans les API Chat Completions et Responses, ainsi que de GPT-5.5 Pro pour les requêtes de l’API Responses portant sur des problèmes plus difficiles qui bénéficient d’une puissance de calcul accrue.

GPT-5.5 prend en charge une fenêtre de contexte d’un million de tokens, les images en entrée, les sorties structurées, l’appel de fonction, la mise en cache des prompts, le traitement par lots, la recherche d’outils, l’utilisation de l’ordinateur intégrée, le shell distant, l’application de patchs, les Skills, MCP et la recherche web. Les principales nouveautés sont les suivantes :

  • L’effort de raisonnement est désormais défini sur medium par défaut.
  • Lorsque image_detail n’est pas défini ou est défini sur auto, le modèle utilise désormais le comportement original.
  • Avec GPT-5.5, la mise en cache fonctionne uniquement avec la mise en cache prolongée des prompts. La mise en cache des prompts en mémoire n’est pas prise en charge. Pour en savoir plus, consultez cette page.
21 avr.
Fonctionnalité
gpt-image-2
v1/images/generations
v1/images/edits
v1/batch

Lancement de GPT Image 2, un modèle de génération d’images à la pointe de la technologie pour la génération et la retouche d’images. GPT Image 2 prend en charge des dimensions d’image flexibles, des images en entrée haute fidélité, une tarification des images basée sur les tokens et l’API Batch avec une réduction de 50 %.

15 avr.
Mise à jour

Mise à jour d’Agents SDK avec de nouvelles capacités, notamment :

  • l’exécution d’agents dans des bacs à sable contrôlés ;
  • l’inspection et la personnalisation du harnais open source ; et
  • le contrôle du moment où les mémoires sont créées et de leur emplacement de stockage.

mars 2026

17 mars
Fonctionnalité
gpt-5.4-mini
gpt-5.4-nano
v1/responses
v1/chat/completions

Lancement de GPT-5.4 mini et de GPT-5.4 nano dans les API Chat Completions et Responses. GPT-5.4 mini offre des capacités de niveau GPT-5.4 dans un modèle plus rapide et plus efficace pour les charges de travail à grand volume, tandis que GPT-5.4 nano est optimisé pour les tâches simples à grand volume où la vitesse et le coût sont prioritaires.

GPT-5.4 mini prend en charge la recherche d’outils, l’utilisation de l’ordinateur intégrée et le compactage. GPT-5.4 nano prend en charge le compactage, mais ne prend en charge ni la recherche d’outils ni l’utilisation de l’ordinateur.

16 mars
Mise à jour
gpt-5.3-chat-latest

Mise à jour du slug gpt-5.3-chat-latest pour qu’il pointe vers le dernier modèle actuellement utilisé dans ChatGPT.

13 mars
Correctif
gpt-5.4
v1/responses
v1/chat/completions

Mise à jour de notre encodeur d’images pour corriger un bug mineur touchant les entrées input_image dans GPT-5.4. La qualité peut désormais être meilleure dans certains cas d’utilisation de compréhension d’images. Aucune action n’est requise.

12 mars
Fonctionnalité
sora-2
sora-2-pro
v1/videos
v1/videos/characters
v1/videos/extensions
v1/batch

Enrichissement de l’API Sora avec des références de personnages réutilisables, des générations plus longues allant jusqu’à 20 secondes, une sortie en 1080p pour sora-2-pro, le prolongement de vidéos et la prise en charge de l’API Batch pour POST /v1/videos. Les générations en 1080p avec sora-2-pro sont facturées $0.70 par seconde. Pour en savoir plus, consultez cette page.

12 mars
Mise à jour
sora-2
sora-2-pro
v1/videos/edits
v1/videos/{video_id}/remix

Ajout de POST /v1/videos/edits pour modifier des vidéos existantes. Ce point de terminaison remplacera POST /v1/videos/{video_id}/remix, qui sera déprécié dans 6 mois. Pour en savoir plus, consultez cette page.

5 mars
Fonctionnalité
gpt-5.4
gpt-5.4-pro
v1/responses
v1/chat/completions

Lancement de GPT-5.4, notre dernier modèle de pointe pour les tâches professionnelles, dans les API Chat Completions et Responses, ainsi que de GPT-5.4 Pro dans l’API Responses pour les problèmes plus difficiles qui bénéficient d’une puissance de calcul accrue.

Également disponibles :

  • La recherche d’outils dans l’API Responses, qui permet aux modèles de différer le chargement de grands ensembles d’outils jusqu’à l’exécution afin de réduire l’utilisation de tokens, de préserver les performances du cache et de réduire la latence.
  • La prise en charge intégrée de l’utilisation de l’ordinateur dans GPT-5.4 via l’outil computer de l’API Responses, pour interagir avec les interfaces utilisateur à partir de captures d’écran.
  • Une fenêtre de contexte d’un million de tokens et la prise en charge native du compactage pour les workflows d’agents de plus longue durée.
3 mars
Fonctionnalité
gpt-5.3-chat-latest
v1/chat/completions
v1/responses

Lancement de gpt-5.3-chat-latest dans les API Chat Completions et Responses. Ce modèle pointe vers l’instantané GPT-5.3 Instant actuellement utilisé dans ChatGPT. Pour en savoir plus, consultez cette page.

février 2026

24 févr.
Fonctionnalité
v1/responses

L’API Responses accepte désormais davantage de types de documents, de présentations, de feuilles de calcul, de fichiers de code et de fichiers texte via input_file. Pour en savoir plus, consultez cette page.

24 févr.
Fonctionnalité
v1/responses

Ajout de phase à l’API Responses. Ce champ indique si un message de l’assistant est un commentaire intermédiaire (commentary) ou la réponse finale (final_answer). Pour en savoir plus, consultez cette page.

24 févr.
Fonctionnalité
gpt-5.3-codex
v1/responses

Lancement de gpt-5.3-codex dans l’API Responses. Pour en savoir plus, consultez cette page.

23 févr.
Fonctionnalité
v1/responses

Lancement du mode WebSocket pour l’API Responses. Pour en savoir plus, consultez cette page.

23 févr.
Fonctionnalité
gpt-realtime-1.5
gpt-audio-1.5
v1/realtime
v1/chat/completions

Lancement de GPT-Realtime-1.5 dans la Realtime API.

Lancement de gpt-audio-1.5 dans l’API Chat Completions. Pour en savoir plus, consultez cette page.

10 févr.
Fonctionnalité
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/batch

L’API Batch est désormais prise en charge pour les modèles GPT Image : gpt-image-1.5, chatgpt-image-latest, gpt-image-1 et gpt-image-1-mini.

10 févr.
Mise à jour
gpt-5.2-chat-latest

Mise à jour du slug gpt-5.2-chat-latest pour qu’il pointe vers le dernier modèle actuellement utilisé dans ChatGPT.

10 févr.
Fonctionnalité
v1/responses

Lancement du compactage côté serveur dans l’API Responses.

10 févr.
Fonctionnalité
v1/responses

Ajout de la prise en charge des Skills dans l’API Responses. Les Skills sont pris en charge aussi bien pour l’exécution locale que pour l’exécution dans des conteneurs hébergés.

10 févr.
Fonctionnalité
v1/responses

Lancement d’un nouvel outil de shell distant, ainsi que de la prise en charge du réseau dans les conteneurs.

9 févr.
Fonctionnalité
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/images/edits

Ajout de la prise en charge des requêtes application/json sur /v1/images/edits pour les modèles d’images GPT. Les requêtes JSON utilisent images (et éventuellement mask) avec des références image_url ou file_id à la place des envois multipart.

3 févr.
Mise à jour
gpt-5.2
gpt-5.2-codex

Nous avons optimisé notre infrastructure d’inférence pour les clients de l’API : GPT-5.2 et GPT-5.2-Codex s’exécutent désormais environ 40 % plus vite. Les modèles et leurs poids restent inchangés.

janvier 2026

15 janv.
Annonce

Annonce d’Open Responses : une spécification open source pour créer des interfaces LLM interopérables et compatibles avec plusieurs fournisseurs, fondées sur l’API Responses originale d’OpenAI.

14 janv.
Fonctionnalité
gpt-5.2-codex
v1/responses

Lancement de gpt-5.2-codex dans l’API Responses. GPT-5.2-Codex est une version de GPT-5.2 optimisée pour les tâches de programmation agentique dans Codex ou des environnements similaires. Pour en savoir plus, consultez cette page.

13 janv.
Fonctionnalité
v1/realtime

Ajout de plages d’adresses IP dédiées au SIP pour la Realtime API. sip.api.openai.com effectue un routage GeoIP et dirige le trafic SIP vers la région la plus proche. En savoir plus.

13 janv.
Mise à jour
gpt-realtime-mini
gpt-audio-mini

Mise à jour des slugs gpt-realtime-mini et gpt-audio-mini pour qu’ils pointent vers les instantanés du 2025-12-15. Si vous avez besoin des instantanés précédents, utilisez gpt-realtime-mini-2025-10-06 et gpt-audio-mini-2025-10-06.

13 janv.
Mise à jour
sora-2

Mise à jour du slug sora-2 pour qu’il pointe vers sora-2-2025-12-08. Si vous avez besoin de l’instantané précédent du modèle, utilisez sora-2-2025-10-06.

13 janv.
Mise à jour
gpt-4o-mini-tts
gpt-4o-mini-transcribe

Mise à jour des slugs gpt-4o-mini-tts et gpt-4o-mini-transcribe pour qu’ils pointent vers les instantanés du 2025-12-15. Si vous avez besoin des instantanés précédents, utilisez gpt-4o-mini-tts-2025-03-20 et gpt-4o-mini-transcribe-2025-03-20. Nous recommandons actuellement d’utiliser gpt-4o-mini-transcribe plutôt que gpt-4o-transcribe pour obtenir les meilleurs résultats.

9 janv.
Correctif
gpt-image-1.5
chatgpt-image-latest

Correction d’un problème qui amenait gpt-image-1.5 et chatgpt-image-latest à utiliser à tort la haute fidélité pour les retouches d’images via /v1/images/edits, même lorsque fidelity était explicitement défini sur low (la valeur par défaut).

décembre 2025

19 déc.
Mise à jour
gpt-image-1.5
chatgpt-image-latest

Ajout de gpt-image-1.5 et de chatgpt-image-latest à l’outil de génération d’images de l’API Responses.

16 déc.
Fonctionnalité
gpt-image-1.5
chatgpt-image-latest

Lancement de gpt-image-1.5 et de chatgpt-image-latest, nos modèles de génération d’images les plus récents et les plus avancés. Pour en savoir plus, consultez cette page.

15 déc.
Fonctionnalité
gpt-realtime-mini
gpt-audio-mini
gpt-4o-mini-transcribe
gpt-4o-mini-tts

Publication de quatre nouveaux instantanés audio datés. Ces mises à jour améliorent la fiabilité, la qualité et la fidélité vocale des applications vocales en temps réel. Pour en savoir plus, consultez cette page.

  • gpt-realtime-mini-2025-12-15
  • gpt-audio-mini-2025-12-15
  • gpt-4o-mini-transcribe-2025-12-15
  • gpt-4o-mini-tts-2025-12-15

Ce lancement inclut également la prise en charge des voix personnalisées pour les clients éligibles.

11 déc.
Fonctionnalité
gpt-5.2
gpt-5.2-chat-latest
v1/responses
v1/chat/completions

Lancement de GPT-5.2, le dernier modèle phare de la famille GPT-5. GPT-5.2 apporte des améliorations par rapport à GPT-5.1 dans les domaines suivants :

  • Intelligence générale
  • Respect des instructions
  • Exactitude et utilisation efficace des tokens
  • Multimodalité, en particulier la vision
  • Génération de code, notamment la création d’interfaces utilisateur front-end
  • Appels d’outils et gestion du contexte dans l’API
  • Compréhension et création de feuilles de calcul.

Les nouveautés de 5.2 comprennent un niveau d’effort de raisonnement xhigh, des résumés de raisonnement concis et une nouvelle gestion du contexte par compactage.

11 déc.
Fonctionnalité
v1/responses/compact

Lancement du compactage côté client. Pour les conversations de longue durée avec l’API Responses, vous pouvez utiliser le point de terminaison /responses/compact pour réduire le contexte envoyé à chaque tour.

4 déc.
Fonctionnalité
gpt-5.1-codex-max
v1/responses

Ajout de gpt-5.1-codex-max à l’API Responses. GPT-5.1-Codex est notre modèle de programmation le plus intelligent, optimisé pour les tâches de programmation agentique de longue durée. Pour en savoir plus, consultez cette page.

novembre 2025

20 nov.
Fonctionnalité
v1/realtime

Ajout de la prise en charge des appuis sur les touches DTMF dans la Realtime API. Vous pouvez désormais recevoir des événements DTMF lorsque vous utilisez une connexion latérale Realtime. Consultez la documentation pour en savoir plus.

13 nov.
Fonctionnalité
gpt-5.1
gpt-5.1-codex
gpt-5.1-chat-latest
gpt-5.1-codex-mini
v1/responses
v1/chat/completions

Lancement de GPT-5.1, le dernier modèle phare de la famille GPT-5. GPT-5.1 est entraîné pour être particulièrement performant dans les domaines suivants :

  • Capacité à se laisser guider et rapidité des réponses lorsqu’un raisonnement moins poussé suffit
  • Génération de code et cas d’utilisation en programmation
  • Workflows agentiques

GPT-5.1 utilise par défaut le nouveau réglage de raisonnement none pour répondre plus rapidement lorsqu’un raisonnement moins poussé suffit, alors que GPT-5 utilisait auparavant medium par défaut.

13 nov.
Fonctionnalité

Lancement de contrôles d’accès basés sur les rôles (RBAC) améliorés. Le contrôle d’accès basé sur les rôles (RBAC) vous permet de décider qui peut faire quoi au sein de votre organisation et de vos projets, aussi bien via l’API que dans le tableau de bord.

13 nov.
Fonctionnalité
gpt-5.1-codex
gpt-5.1-codex-mini
v1/responses

Ajout de gpt-5.1-codex et gpt-5.1-codex-mini à l’API Responses. GPT-5.1-Codex est une version de GPT-5.1 optimisée pour les tâches de programmation agentique dans Codex ou des environnements similaires. Pour en savoir plus, consultez cette page.

13 nov.
Fonctionnalité

Lancement de la conservation prolongée du cache de prompts. Cette fonctionnalité maintient les préfixes en cache actifs plus longtemps, jusqu’à 24 heures. La mise en cache prolongée des prompts transfère les tenseurs clé/valeur vers le stockage local du GPU lorsque la mémoire est pleine, ce qui augmente considérablement la capacité de stockage disponible pour le cache.

octobre 2025

29 oct.
Fonctionnalité
gpt-oss-safeguard-120b
gpt-oss-safeguard-20b

gpt-oss-safeguard-120b et gpt-oss-safeguard-20b sont des modèles de raisonnement dédiés à la sécurité, basés sur gpt-oss. Pour en savoir plus, consultez cette page.

24 oct.
Fonctionnalité

Lancement d’Enterprise Key Management (EKM). Enterprise Key Management (EKM) vous permet de chiffrer votre contenu client chez OpenAI à l’aide de clés gérées par votre propre système externe de gestion des clés (KMS).

24 oct.
Fonctionnalité
6 oct.
Fonctionnalité
gpt-5-pro
gpt-realtime-mini
gpt-audio-mini
gpt-image-1-mini
sora-2
sora-2-pro
v1/responses
v1/batch
v1/chat/completions
v1/videos
v1/realtime
v1/images/generations

Lancement de plusieurs nouvelles fonctionnalités lors d’OpenAI DevDay :

Lancement de GPT-5 Pro, une version de GPT-5 qui utilise davantage de ressources de calcul pour approfondir son raisonnement et fournir de meilleures réponses de manière constante.

Lancement de GPT-Realtime mini et de gpt-audio-mini pour des performances parole à parole à moindre coût.

Lancement de gpt-image-1-mini pour générer et modifier des images à moindre coût.

Lancement de v1/videos pour générer et remixer des vidéos riches, détaillées et dynamiques avec nos derniers modèles Sora 2 et Sora 2 Pro.

Lancement d’Agent Builder pour créer visuellement des workflows multi-agents personnalisés.

Lancement de ChatKit, une interface de discussion intégrable pour déployer des agents.

Lancement d’outils d’évaluation des traces, de jeux de données et d’optimisation des prompts.

Évaluations : ajout de la prise en charge des modèles tiers.

Lancement du tableau de bord de l’état des services.

1 oct.
Fonctionnalité

Lancement de la liste d’adresses IP autorisées. Cette liste restreint l’accès à l’API aux seules adresses IP ou plages d’adresses que vous spécifiez.

septembre 2025

26 sept.
Fonctionnalité
v1/responses

Ajout de la prise en charge des images et des fichiers comme sortie d’appel d’outil dans l’API Responses.

23 sept.
Fonctionnalité
gpt-5-codex
v1/responses

Lancement du modèle spécialisé gpt-5-codex, conçu et optimisé pour une utilisation avec Codex CLI.

août 2025

28 août
Fonctionnalité
v1/realtime

La Realtime API d’OpenAI est désormais disponible de manière générale. Pour en savoir plus, consultez notre guide de la Realtime API.

21 août
Fonctionnalité
v1/responses

Ajout de la prise en charge des connecteurs dans l’API Responses. Les connecteurs sont des adaptateurs MCP maintenus par OpenAI pour des services populaires comme les applications Google, Dropbox et d’autres. Ils permettent de donner au modèle un accès en lecture aux données stockées dans ces services.

20 août
Fonctionnalité
v1/conversations
v1/responses
v1/assistants

Lancement de l’API Conversations, qui permet de créer et de gérer des conversations de longue durée avec l’API Responses. Consultez le guide de migration pour comparer les deux approches côte à côte et découvrir comment migrer une intégration de l’API Assistants vers Responses et Conversations.

7 août
Fonctionnalité
v1/chat/completions
v1/responses

Lancement de la famille de modèles GPT-5 dans l’API, comprenant gpt-5, gpt-5-mini et gpt-5-nano.

Ajout de la valeur minimal pour l’effort de raisonnement afin de privilégier la rapidité des réponses des modèles GPT-5 (qui prennent en charge le raisonnement).

Ajout du type d’appel d’outil custom, qui permet au modèle de recevoir des entrées et de produire des sorties au format libre lors des appels d’outils.

juin 2025

27 juin
Fonctionnalité

Ajout de la prise en charge du traitement prioritaire. Le traitement prioritaire offre une latence nettement plus faible et plus stable que le traitement standard, tout en conservant la souplesse de la facturation à l’usage.

24 juin
Fonctionnalité
o3-deep-research
o3-deep-research-2025-06-26
o4-mini-deep-research
o4-mini-deep-research-2025-06-26
v1/responses

Lancement d’o3-deep-research et d’o4-mini-deep-research, des variantes de nos modèles de raisonnement de la série o dédiées à la recherche approfondie, optimisées pour les tâches d’analyse et de recherche approfondies. Pour en savoir plus, consultez le guide de la recherche approfondie.

Ajout de la gestion asynchrone des événements avec les webhooks. Baisse et simplification des tarifs de l’outil de recherche web. Ajout de la prise en charge de l’outil de recherche web.

13 juin
Fonctionnalité
v1/responses

De nouveaux prompts réutilisables sont désormais disponibles dans le tableau de bord et l’API Responses. Via l’API, vous pouvez désormais référencer les modèles de prompts créés dans le tableau de bord à l’aide du paramètre prompt (avec un id de prompt et une version facultative) et fournir des variables dynamiques pouvant contenir des chaînes de caractères, des images ou des fichiers en entrée. Les prompts réutilisables ne sont pas disponibles dans Chat Completions. En savoir plus.

10 juin
Fonctionnalité
o3-pro
v1/responses
v1/batch

Lancement d’o3-pro, une version du modèle de raisonnement o3 qui utilise davantage de ressources de calcul pour résoudre des problèmes difficiles avec un meilleur raisonnement et une plus grande constance. Les tarifs du modèle o3 ont également baissé pour toutes les requêtes API, y compris le traitement par lots et le traitement Flex.

4 juin
Fonctionnalité
v1/fine_tuning

Ajout de la prise en charge de l’affinage par optimisation directe des préférences pour les modèles gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 et gpt-4.1-nano-2025-04-14.

3 juin
Fonctionnalité
v1/chat/completions
v1/realtime

De nouveaux instantanés des modèles gpt-4o-audio-preview et gpt-4o-realtime-preview sont disponibles. Lancement d’Agents SDK pour TypeScript.

mai 2025

20 mai
Fonctionnalité
v1/responses

Ajout de la prise en charge de nouveaux outils intégrés dans l’API Responses, notamment les serveurs MCP distants et l’interpréteur de code. En savoir plus sur les outils.

20 mai
Fonctionnalité
v1/responses
v1/chat/completions

Ajout de la prise en charge du mode strict pour les schémas d’outils lors des appels d’outils en parallèle avec des modèles non affinés. Ajout de nouvelles fonctionnalités de schéma, notamment la validation des chaînes de caractères pour email et d’autres motifs, ainsi que la définition de bornes pour les nombres et les tableaux.

15 mai
Fonctionnalité
codex-mini-latest
v1/responses
v1/chat/completions

Lancement de codex-mini-latest dans l’API, optimisé pour une utilisation avec Codex CLI.

7 mai
Fonctionnalité
v1/fine-tuning
v1/responses
v1/chat/completions

Ajout de la prise en charge de l’affinage par apprentissage par renforcement. Découvrez les méthodes d’affinage disponibles. gpt-4.1-nano peut désormais être affiné.

avril 2025

30 avr.
23 avr.
Fonctionnalité
v1/images/generations
v1/images/edits

Ajout d’un nouveau modèle de génération d’images, gpt-image-1. Ce modèle établit une nouvelle référence pour la génération d’images, avec une qualité et un respect des instructions améliorés.

Mise à jour des points de terminaison de génération et de modification d’images pour prendre en charge de nouveaux paramètres propres au modèle gpt-image-1.

16 avr.
Fonctionnalité
v1/chat/completions
v1/responses

Ajout de deux nouveaux modèles de raisonnement de la série o, o3 et o4-mini. Ils établissent une nouvelle référence en mathématiques, en sciences et en programmation, ainsi que pour les tâches de raisonnement visuel et la rédaction technique.

Lancement de Codex, notre outil CLI de génération de code.

14 avr.
Fonctionnalité
gpt-4.1
gpt-4.1-mini
gpt-4.1-nano
v1/responses
v1/chat/completions
v1/fine_tuning

Ajout des modèles gpt-4.1, gpt-4.1-mini et gpt-4.1-nano à l’API. Ces nouveaux modèles offrent un meilleur respect des instructions, de meilleures capacités de programmation et une fenêtre de contexte plus grande (jusqu’à 1 million de tokens). gpt-4.1 et gpt-4.1-mini sont disponibles pour l’affinage supervisé. Annonce de l’abandon de gpt-4.5-preview.

mars 2025

20 mars
Mise à jour
v1/audio

Ajout des modèles gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe et whisper-1 à l’API Audio.

19 mars
Fonctionnalité
o1-pro
v1/responses
v1/batch

Lancement d’o1-pro, une version du modèle de raisonnement o1 qui utilise davantage de ressources de calcul pour résoudre des problèmes difficiles avec un meilleur raisonnement et une plus grande constance.

11 mars
Fonctionnalité
gpt-4o-search-preview
gpt-4o-mini-search-preview
computer-use-preview
v1/chat/completions
v1/assistants
v1/responses

Lancement de plusieurs nouveaux modèles et outils, ainsi que d’une nouvelle API pour les workflows agentiques :

  • Lancement de l’API Responses, une nouvelle API pour créer et utiliser des agents et des outils.
  • Lancement d’un ensemble d’outils intégrés pour l’API Responses : recherche web, recherche de fichiers et utilisation de l’ordinateur.
  • Lancement d’Agents SDK, un framework d’orchestration pour concevoir, créer et déployer des agents.
  • Annonce de nouveaux modèles : gpt-4o-search-preview, gpt-4o-mini-search-preview, computer-use-preview.
  • Annonce du projet de transférer toutes les fonctionnalités de l’API Assistants vers l’API Responses, plus simple à utiliser, avec un arrêt d’Assistants prévu en 2026 (après avoir atteint une parité fonctionnelle complète).
3 mars
Fonctionnalité
v1/fine_tuning/jobs

Ajout de la prise en charge du champ metadata dans les tâches d’affinage.

février 2025

27 févr.
Fonctionnalité
GPT-4.5
v1/chat/completions
v1/assistants
v1/batch

Lancement d’un aperçu de recherche de GPT-4.5, notre modèle de discussion le plus grand et le plus performant à ce jour. Le « quotient émotionnel » élevé de GPT-4.5 et sa compréhension des intentions de l’utilisateur le rendent plus performant pour les tâches créatives et la planification agentique.

25 févr.
Fonctionnalité

Lancement de la mise à jour du tableau de bord d’utilisation de l’API. Cette mise à jour répond aux demandes de filtres de données supplémentaires, notamment la sélection de projets, un sélecteur de dates et des intervalles plus précis. Elle améliore également la consultation de l’utilisation par produit et par offre.

5 févr.
Fonctionnalité

La résidence des données est désormais disponible en Europe. Pour en savoir plus, consultez cette page.

janvier 2025

31 janv.
Fonctionnalité
o3-mini
o3-mini-2025-01-31
v1/chat/completions

Lancement d’o3-mini, un nouveau petit modèle de raisonnement optimisé pour les tâches scientifiques, mathématiques et de programmation.

21 janv.
Fonctionnalité
o1

Élargissement de l’accès au modèle o1. Les modèles de la série o1 sont entraînés par apprentissage par renforcement pour effectuer des raisonnements complexes.

décembre 2024

18 déc.
Fonctionnalité

Lancement de la rotation des clés API d’administration, qui permet aux clients de renouveler leurs clés API d’administration par programmation.

Mise à jour des invitations de l’API d’administration, qui permet aux clients d’inviter des utilisateurs à rejoindre des projets par programmation en même temps qu’ils les invitent à rejoindre des organisations.

17 déc.
Fonctionnalité
o1
gpt-4o
gpt-4o-mini
v1/fine_tuning
v1/chat/completions
v1/realtime

Ajout de nouveaux modèles pour o1, gpt-4o-realtime, gpt-4o-audio et d’autres encore.

Ajout d’une méthode de connexion WebRTC pour la Realtime API.

Ajout du paramètre reasoning_effort pour les modèles o1.

Ajout du rôle de message developer pour le modèle o1. Notez qu’o1-preview et o1-mini ne prennent pas en charge les messages system ou developer.

Lancement de l’affinage des préférences à l’aide de l’optimisation directe des préférences (DPO).

Lancement des SDK pour Go et Java en version bêta. En savoir plus.

Ajout de la prise en charge de la Realtime API dans le SDK Python.

4 déc.
Fonctionnalité

Lancement de l’API Usage, qui permet aux clients de consulter par programmation l’activité et les dépenses sur les différentes API OpenAI.

novembre 2024

20 nov.
Mise à jour
v1/chat/completions

Sortie de gpt-4o-2024-11-20, notre dernier modèle de la série gpt-4o.

4 nov.
Fonctionnalité
v1/chat/completions

Lancement des sorties prédites, qui réduisent considérablement la latence lorsque la majeure partie de la réponse du modèle est connue à l’avance. C’est notamment le cas lors de la régénération du contenu de documents et de fichiers de code avec seulement quelques modifications mineures.

octobre 2024

30 oct.
Fonctionnalité
gpt-4o-realtime-preview
gpt-4o-audio-preview
v1/chat/completions

Ajout de cinq nouveaux types de voix dans la Realtime API et l’API Chat Completions.

17 oct.
Fonctionnalité
gpt-4o-audio-preview
v1/chat/completions

Sortie du nouveau modèle gpt-4o-audio-preview pour les complétions de discussion, avec prise en charge de l’audio en entrée et en sortie. Il utilise le même modèle sous-jacent que la Realtime API.

1 oct.
Fonctionnalité
v1/realtime
v1/chat/completions
v1/fine_tuning

Lancement de plusieurs nouvelles fonctionnalités lors de l’OpenAI DevDay à San Francisco :

Realtime API : Intégrez à vos applications des interactions rapides de parole à parole à l’aide d’une interface WebSockets.

Distillation de modèles : Plateforme permettant d’affiner des modèles économiques à partir des sorties que vous avez obtenues d’un grand modèle de pointe.

Affinage avec des images : Affinez GPT-4o avec des images et du texte pour améliorer ses capacités de vision.

Évaluations : Créez et exécutez des évaluations personnalisées pour mesurer les performances des modèles sur des tâches spécifiques.

Mise en cache des prompts : Tarifs réduits et traitement plus rapide des tokens d’entrée récemment traités.

Génération dans le Playground : Générez facilement des prompts, des définitions de fonctions et des schémas de sorties structurées dans le Playground à l’aide du bouton Générer.

septembre 2024

26 sept.
Fonctionnalité
omni-moderation-latest
v1/moderations

Sortie du nouveau modèle de modération omni-moderation-latest, qui prend en charge les images et le texte pour certaines catégories, ajoute deux nouvelles catégories de contenus préjudiciables réservées au texte et fournit des scores plus précis.

12 sept.
Fonctionnalité
o1-preview
o1-mini
v1/chat/completions

Sortie d’o1-preview et o1-mini, de nouveaux grands modèles de langage entraînés par apprentissage par renforcement pour effectuer des tâches de raisonnement complexes.

août 2024

20 août
Fonctionnalité
gpt-4o
v1/fine_tuning

Disponibilité générale de l’affinage de gpt-4o-2024-08-06 : tous les utilisateurs de l’API peuvent désormais affiner le dernier modèle GPT-4o.

15 août
Mise à jour
gpt-4o
v1/chat/completions

Sortie d’un modèle dynamique pour chatgpt-4o-latest : il pointera vers le dernier modèle GPT-4o utilisé par ChatGPT.

6 août
Mise à jour

Lancement des sorties structurées : les sorties des modèles respectent désormais de manière fiable les schémas JSON fournis par les développeurs.

Sortie de gpt-4o-2024-08-06, notre dernier modèle de la série gpt-4o.

1 août
Mise à jour

Lancement des API d’administration et de journaux d’audit, qui permettent aux clients d’administrer leur organisation par programmation et de suivre les modifications à l’aide des journaux d’audit. La journalisation d’audit doit être activée dans les paramètres.

juillet 2024

24 juil.
Mise à jour

Lancement de la configuration SSO en libre-service, qui permet aux clients Entreprise bénéficiant d’une facturation personnalisée et illimitée de configurer l’authentification auprès du fournisseur d’identité (IDP) de leur choix.

23 juil.
Mise à jour

Lancement de l’affinage de GPT-4o mini, qui permet d’obtenir des performances encore meilleures pour des cas d’utilisation spécifiques.

18 juil.
Mise à jour

Sortie de GPT-4o mini, notre petit modèle abordable et intelligent pour les tâches rapides et légères.

17 juil.
Mise à jour

Lancement d’Uploads pour téléverser des fichiers volumineux en plusieurs parties.

juin 2024

6 juin
Mise à jour

L’appel de fonction en parallèle peut être désactivé dans Chat Completions et l’API Assistants en transmettant parallel_tool_calls=false.

Lancement du SDK .NET en version bêta.

3 juin
Mise à jour

Ajout de la prise en charge de la personnalisation de la recherche de fichiers.

mai 2024

15 mai
Mise à jour

Ajout de la possibilité d’archiver des projets. Seuls les propriétaires d’organisation peuvent accéder à cette fonctionnalité.

Ajout de la possibilité de définir des limites de dépenses par projet pour les clients facturés à l’usage.

13 mai
Mise à jour

Sortie de GPT-4o dans l’API. GPT-4o est notre modèle phare le plus rapide et le plus abordable.

9 mai
Mise à jour

Ajout de la prise en charge des images en entrée dans l’API Assistants.

7 mai
Mise à jour

Ajout de la prise en charge des modèles affinés dans l’API Batch.

6 mai
Mise à jour

Ajout du paramètre stream_options: {"include_usage": true} aux API Chat Completions et Completions. Ce paramètre permet aux développeurs d’accéder aux statistiques d’utilisation lors de la diffusion en continu.

2 mai
Mise à jour

Ajout d’un nouveau point de terminaison pour supprimer un message d’un fil de discussion dans l’API Assistants.

avril 2024

29 avr.
Mise à jour

Ajout d’une nouvelle option d’appel de fonction tool_choice: "required" aux API Chat Completions et Assistants.

Ajout d’un guide de l’API Batch et de la prise en charge des modèles de plongements vectoriels dans l’API Batch

17 avr.
Mise à jour

Introduction d’une série de mises à jour de l’API Assistants, notamment un nouvel outil de recherche de fichiers acceptant jusqu’à 10 000 fichiers par assistant, de nouveaux contrôles des tokens et la prise en charge du choix des outils.

16 avr.
Mise à jour

Introduction d’une hiérarchie par projet pour organiser le travail, avec la possibilité de créer des clés API et de gérer les limites de débit et de dépenses par projet (les limites de dépenses sont réservées aux clients Entreprise).

15 avr.
Mise à jour

Lancement de l’API Batch

9 avr.
Mise à jour

Disponibilité générale de GPT-4 Turbo with Vision dans l’API

4 avr.
Mise à jour

Ajout de la prise en charge de seed dans l’API d’affinage

Ajout de la prise en charge des points de contrôle dans l’API d’affinage

Ajout de la possibilité d’ajouter des Messages lors de la création d’un Run dans l’API Assistants

1 avr.
Mise à jour

Ajout de la possibilité de filtrer les Messages par run_id dans l’API Assistants

mars 2024

29 mars
Mise à jour

Ajout de la prise en charge de temperature et de la création de messages d’assistant dans l’API Assistants

14 mars
Mise à jour

Ajout de la prise en charge de la diffusion en continu dans l’API Assistants

février 2024

9 févr.
Mise à jour

Ajout du paramètre timestamp_granularities à l’API Audio

janvier 2024

25 janv.
Mise à jour

Sortie des modèles de plongements vectoriels V3 et d’une version préliminaire mise à jour de GPT-4 Turbo

Ajout du paramètre dimensions à l’API Embeddings

décembre 2023

20 déc.
Mise à jour

Ajout du paramètre additional_instructions à la création d’exécutions dans l’API Assistants

15 déc.
Mise à jour

Ajout des paramètres logprobs et top_logprobs à l’API Chat Completions

14 déc.
Mise à jour

L’argument paramètres de fonction d’un appel d’outil est désormais facultatif

novembre 2023

30 nov.
Mise à jour

Publication du SDK OpenAI pour Deno

6 nov.
Mise à jour

Publication de GPT-4 Turbo Preview, d’une version mise à jour de GPT-3.5 Turbo, de GPT-4 Turbo with Vision, de l’API Assistants, de DALL·E 3 dans l’API et de l’API de synthèse vocale

Dépréciation du paramètre functions de Chat Completions au profit de tools

Publication du SDK OpenAI pour Python V1.0

octobre 2023

16 oct.
Mise à jour

Ajout du paramètre encoding_format à l’API de plongements vectoriels

Ajout de max_tokens aux modèles de modération

6 oct.
Mise à jour

Ajout de la prise en charge de l’appel de fonction à l’API d’affinage