GPT-4o Mini
預設
適合特定任務、快速且經濟實惠的小型模型
適合特定任務、快速且經濟實惠的小型模型
智慧
一般
速度
快
價格
$0.15•$0.6
輸入•輸出
輸入
文字, 圖像
輸出
文字
提示詞範例
Intent Classification
提示詞範例
Extract search keywords
提示詞範例
Translate text
提示詞範例
Generate tags
GPT-4o Mini(「o」代表「omni」)是適合特定任務、快速且經濟實惠的小型模型。 它可接受文字與圖像輸入,並產生文字輸出(包括結構化輸出)。 它非常適合微調,也能透過蒸餾,將 GPT-4o 等較大型模型的輸出用於訓練 GPT-4o-Mini,以更低的成本與延遲產生相近的結果。
128,000 上下文視窗
最多輸出 16,384 個 Token
知識截止日期:Oct 01, 2023
定價
費用依使用的 Token 數量計算,或依模型類型採用其他計費指標。搜尋和電腦等工具專用模型,則按每次工具呼叫收費。詳情請參閱 定價頁面。
文字 Token
每 1M 個 Token
∙
Batch API 價格
輸入
$0.15
已快取的輸入
$0.075
輸出
$0.60
快速比較
輸入
已快取的輸入
輸出
GPT-4o
$2.50
o3-mini
$1.10
GPT-4o Mini
$0.15
模態
文字
輸入與輸出
圖像
僅限輸入
音訊
不支援
影片
不支援
端點
即時
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
即時翻譯
v1/realtime/translations
即時轉錄
v1/realtime/transcription_sessions
Assistants
v1/assistants
批次處理
v1/batch
微調
v1/fine-tuning
嵌入向量
v1/embeddings
圖像生成
v1/images/generations
影片
v1/videos
圖像編輯
v1/images/edits
語音生成
v1/audio/speech
轉錄
v1/audio/transcriptions
翻譯
v1/audio/translations
內容審核
v1/moderations
Completions(舊版)
v1/completions
功能
串流
支援
函式呼叫
支援
結構化輸出
支援
微調
支援
預測輸出
支援
快照
快照可讓你固定使用特定版本的模型,確保效能與行為保持一致。以下列出 GPT-4o Mini 所有可用的快照與別名。
gpt-4o-mini
gpt-4o-mini-2024-07-18
gpt-4o-mini-2024-07-18
速率限制
速率限制會對特定時間內的請求數、Token 數、音訊時長或其他用量設定明確上限,確保 API 存取公平且可靠。這些上限取決於你的使用量層級;隨著你傳送的請求與 API 支出增加,使用量層級也會自動提升。
| 層級 | RPM | RPD | TPM | 批次處理佇列上限 |
|---|---|---|---|---|
| 免費 | 不支援 | |||
| 層級 1 | 500 | 10,000 | 200,000 | 2,000,000 |
| 層級 2 | 5,000 | - | 2,000,000 | 20,000,000 |
| 層級 3 | 5,000 | - | 4,000,000 | 40,000,000 |
| 層級 4 | 10,000 | - | 10,000,000 | 1,000,000,000 |
| 層級 5 | 30,000 | - | 150,000,000 | 15,000,000,000 |