o3-pro
デフォルト
より多くの計算リソースで応答の質を高めた o3 のバージョン
より多くの計算リソースで応答の質を高めた o3 のバージョン
推論
最高
速度
最低速
料金
$20•$80
入力•出力
入力
テキスト, 画像
出力
テキスト
o シリーズのモデルは、回答する前に考え、複雑な推論を行うように強化学習でトレーニングされています。o3-pro モデルは、より多くの計算リソースを使って深く考え、より質の高い回答を安定して提供します。
o3-pro は Responses API のみで利用できます。 これは、API リクエストに応答する前にモデルが複数ターンのやり取りを行えるようにし、 将来的にはその他の高度な API 機能にも対応できるようにするためです。o3-pro は難しい問題に取り組むよう設計されているため、 一部のリクエストでは完了までに数分かかる場合があります。 タイムアウトを避けるには、バックグラウンドモードをお試しください。
コンテキストウィンドウ:200,000
最大出力トークン数:100,000
知識のカットオフ:Jun 01, 2024
推論トークンへの対応
料金
料金は、使用したトークン数、またはモデルの種類に応じたその他の指標に基づいて算出されます。検索やコンピューターの使用など、特定のツール向けのモデルでは、ツール呼び出しごとに料金が発生します。詳細は料金ページをご覧ください。
テキストトークン
1M トークン あたり
∙
Batch API の料金
入力
$20.00
出力
$80.00
比較早見表
入力
出力
o3-pro
$20.00
o3
$2.00
o3-mini
$1.10
モダリティ
テキスト
入力と出力
画像
入力のみ
音声
非対応
動画
非対応
エンドポイント
ライブ
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
リアルタイム翻訳
v1/realtime/translations
リアルタイム文字起こし
v1/realtime/transcription_sessions
Assistants
v1/assistants
バッチ
v1/batch
ファインチューニング
v1/fine-tuning
埋め込み
v1/embeddings
画像生成
v1/images/generations
動画
v1/videos
画像編集
v1/images/edits
音声生成
v1/audio/speech
文字起こし
v1/audio/transcriptions
翻訳
v1/audio/translations
モデレーション
v1/moderations
Completions(レガシー)
v1/completions
機能
ストリーミング
非対応
Function Calling
対応
構造化出力
対応
ファインチューニング
非対応
予測出力
非対応
スナップショット
スナップショットを使うと、モデルを特定のバージョンに固定し、性能と動作の一貫性を維持できます。以下は、o3-pro で利用可能なすべてのスナップショットとエイリアスの一覧です。
o3-pro
o3-pro-2025-06-10
o3-pro-2025-06-10
非推奨
レート制限
レート制限は、一定期間内のリクエスト数、トークン数、音声の長さなどの利用量に上限を設けることで、API への公平で安定したアクセスを確保します。上限値は利用ティアによって決まります。利用ティアは、リクエスト数と API の利用金額が増えるにつれて自動的に上がります。
| ティア | RPM | TPM | バッチキューの上限 |
|---|---|---|---|
| 無料 | 非対応 | ||
| ティア 1 | 500 | 30,000 | 90,000 |
| ティア 2 | 5,000 | 450,000 | 1,350,000 |
| ティア 3 | 5,000 | 800,000 | 50,000,000 |
| ティア 4 | 10,000 | 2,000,000 | 200,000,000 |
| ティア 5 | 10,000 | 30,000,000 | 5,000,000,000 |