For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主要導覽
whisper-1
Whisper
通用語音辨識模型
效能
速度
價格
$0.006
輸入
輸出

Whisper 是通用語音辨識模型,使用包含多樣化音訊的大型資料集訓練而成。你也可以將它作為多任務模型,用於多語言語音辨識、語音翻譯和語言辨識。

定價
費用依使用的 Token 數量計算,或依模型類型採用其他計費指標。搜尋和電腦等工具專用模型,則按每次工具呼叫收費。詳情請參閱 定價頁面
定價
使用案例 / 1M 個 Token
Transcription
費用 / 分鐘
$0.006
模態
文字
僅限輸出
圖像
不支援
音訊
僅限輸入
影片
不支援
端點
即時
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
即時翻譯
v1/realtime/translations
即時轉錄
v1/realtime/transcription_sessions
Assistants
v1/assistants
批次處理
v1/batch
微調
v1/fine-tuning
嵌入向量
v1/embeddings
圖像生成
v1/images/generations
影片
v1/videos
圖像編輯
v1/images/edits
語音生成
v1/audio/speech
轉錄
v1/audio/transcriptions
翻譯
v1/audio/translations
內容審核
v1/moderations
Completions(舊版)
v1/completions
快照
快照可讓你固定使用特定版本的模型,確保效能與行為保持一致。以下列出 Whisper 所有可用的快照與別名。
whisper-1
whisper-1
whisper-1
whisper-1
速率限制
速率限制會對特定時間內的請求數、Token 數、音訊時長或其他用量設定明確上限,確保 API 存取公平且可靠。這些上限取決於你的使用量層級;隨著你傳送的請求與 API 支出增加,使用量層級也會自動提升。
層級RPMRPD
免費3200
層級 1500-
層級 22,500-
層級 35,000-
層級 47,500-
層級 510,000-