GPT-5.6 Luna
預設
針對成本敏感型工作負載最佳化的 GPT-5.6 模型
針對成本敏感型工作負載最佳化的 GPT-5.6 模型
推理
高
速度
快
價格
$0.2•$1.2
輸入•輸出
輸入
文字, 圖像
輸出
文字
GPT-5.6 Luna 專為成本敏感且處理量大的工作負載設計。 它大致對應於先前 GPT-5 系列中的 nano 模型層級。 Reasoning.effort 支援:none、low、medium(預設)、high、xhigh 和 max。
1,050,000 上下文視窗
最多輸出 128,000 個 Token
知識截止日期:Feb 16, 2026
推理 Token 支援
定價
費用依使用的 Token 數量計算,或依模型類型採用其他計費指標。搜尋和電腦等工具專用模型,則按每次工具呼叫收費。詳情請參閱 定價頁面。
文字 Token
每 1M 個 Token
輸入
$0.20
已快取的輸入
$0.02
輸出
$1.20
快速比較
輸入
已快取的輸入
輸出
GPT-5.6 Terra
$2.00
GPT-5.6 Luna
$0.20
GPT-5.4 nano
$0.20
若提示詞的輸入 Token 數 >272K,整個請求的輸入費用按 2 倍費率計算,輸出費用按 1.5 倍費率計算。
快取寫入費用按未快取輸入 Token 費率的 1.25 倍計算。
模態
文字
輸入與輸出
圖像
僅限輸入
音訊
不支援
影片
不支援
端點
即時
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
即時翻譯
v1/realtime/translations
即時轉錄
v1/realtime/transcription_sessions
Assistants
v1/assistants
批次處理
v1/batch
微調
v1/fine-tuning
嵌入向量
v1/embeddings
圖像生成
v1/images/generations
影片
v1/videos
圖像編輯
v1/images/edits
語音生成
v1/audio/speech
轉錄
v1/audio/transcriptions
翻譯
v1/audio/translations
內容審核
v1/moderations
Completions(舊版)
v1/completions
功能
串流
支援
函式呼叫
支援
結構化輸出
支援
微調
不支援
工具
透過 Responses API 使用此模型時支援的工具。
網頁搜尋
支援
檔案搜尋
支援
圖像生成
支援
程式碼解譯器
支援
託管 Shell 環境
支援
套用修補程式
支援
技能
支援
電腦
支援
MCP
支援
工具搜尋
支援
快照
快照可讓你固定使用特定版本的模型,確保效能與行為保持一致。以下列出 GPT-5.6 Luna 所有可用的快照與別名。
gpt-5.6-luna
gpt-5.6-luna
gpt-5.6-luna
速率限制
速率限制會對特定時間內的請求數、Token 數、音訊時長或其他用量設定明確上限,確保 API 存取公平且可靠。這些上限取決於你的使用量層級;隨著你傳送的請求與 API 支出增加,使用量層級也會自動提升。
| 層級 | RPM | TPM | 批次處理佇列上限 |
|---|---|---|---|
| 免費 | 不支援 | ||
| 層級 1 | 500 | 500,000 | 5,000,000 |
| 層級 2 | 5,000 | 2,000,000 | 20,000,000 |
| 層級 3 | 5,000 | 4,000,000 | 40,000,000 |
| 層級 4 | 10,000 | 10,000,000 | 1,000,000,000 |
| 層級 5 | 30,000 | 180,000,000 | 15,000,000,000 |