For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navigation principale

Audio dans Chat Completions

Ajoutez des entrées et des sorties audio à une application Chat Completions existante.

Si vous disposez déjà d’une application textuelle reposant sur un LLM et utilisant le point de terminaison Chat Completions, vous pouvez y ajouter des fonctionnalités audio. Par exemple, si votre application de discussion accepte du texte en entrée, vous pouvez ajouter des entrées et des sorties audio : incluez audio dans le tableau modalities et utilisez un modèle audio, comme gpt-audio-1.5.

La documentation de l’API Responses décrit actuellement des entrées textuelles et visuelles avec des sorties textuelles. Pour ce type de discussion audio, utilisez Chat Completions avec un modèle prenant en charge l’audio.

Créez une réponse audio à un prompt avec une voix semblable à celle d’un humain
import { writeFileSync } from "node:fs";
import OpenAI from "openai";

const openai = new OpenAI();

// Generate an audio response to the given prompt
const response = await openai.chat.completions.create({
  model: "gpt-audio-1.5",
  modalities: ["text", "audio"],
  audio: { voice: "alloy", format: "wav" },
  messages: [
    {
      role: "user",
      content: "Is a golden retriever a good family dog?",
    },
  ],
  store: true,
});

// Inspect returned data
console.log(response.choices[0]);

// Write audio data to a file
writeFileSync(
  "dog.wav",
  Buffer.from(response.choices[0].message.audio.data, "base64"),
  { encoding: "utf-8" }
);