For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
メインナビゲーション
gpt-4o-mini
GPT-4o Mini
特定のタスク向けの高速で低コストな小型モデル
応答性能
速度
料金
$0.15$0.6
入力
出力

GPT-4o Mini(「o」は「omni」の略)は、特定のタスク向けの高速で低コストな小型モデルです。 テキストと画像の両方を入力として受け取り、テキスト(構造化出力を含む)を出力します。 ファインチューニングに最適で、GPT-4o などの大規模モデルの出力を GPT-4o-Mini に蒸留することで、コストとレイテンシを抑えながら同様の結果を得られます。

コンテキストウィンドウ:128,000
最大出力トークン数:16,384
知識のカットオフ:Oct 01, 2023
料金
料金は、使用したトークン数、またはモデルの種類に応じたその他の指標に基づいて算出されます。検索やコンピューターの使用など、特定のツール向けのモデルでは、ツール呼び出しごとに料金が発生します。詳細は料金ページをご覧ください。
テキストトークン
1M トークン あたり
Batch API の料金
入力
$0.15
キャッシュ済み入力
$0.075
出力
$0.60
比較早見表
入力
キャッシュ済み入力
出力
GPT-4o
$2.50
o3-mini
$1.10
GPT-4o Mini
$0.15
モダリティ
テキスト
入力と出力
画像
入力のみ
音声
非対応
動画
非対応
エンドポイント
ライブ
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
リアルタイム翻訳
v1/realtime/translations
リアルタイム文字起こし
v1/realtime/transcription_sessions
Assistants
v1/assistants
バッチ
v1/batch
ファインチューニング
v1/fine-tuning
埋め込み
v1/embeddings
画像生成
v1/images/generations
動画
v1/videos
画像編集
v1/images/edits
音声生成
v1/audio/speech
文字起こし
v1/audio/transcriptions
翻訳
v1/audio/translations
モデレーション
v1/moderations
Completions(レガシー)
v1/completions
機能
ストリーミング
対応
Function Calling
対応
構造化出力
対応
ファインチューニング
対応
予測出力
対応
スナップショット
スナップショットを使うと、モデルを特定のバージョンに固定し、性能と動作の一貫性を維持できます。以下は、GPT-4o Mini で利用可能なすべてのスナップショットとエイリアスの一覧です。
gpt-4o-mini
gpt-4o-mini
gpt-4o-mini-2024-07-18
gpt-4o-mini-2024-07-18
レート制限
レート制限は、一定期間内のリクエスト数、トークン数、音声の長さなどの利用量に上限を設けることで、API への公平で安定したアクセスを確保します。上限値は利用ティアによって決まります。利用ティアは、リクエスト数と API の利用金額が増えるにつれて自動的に上がります。
ティアRPMRPDTPMバッチキューの上限
無料非対応
ティア 150010,000200,0002,000,000
ティア 25,000-2,000,00020,000,000
ティア 35,000-4,000,00040,000,000
ティア 410,000-10,000,0001,000,000,000
ティア 530,000-150,000,00015,000,000,000