GPT-5.6 Terra
默认
兼顾智能与成本的 GPT-5.6 模型
兼顾智能与成本的 GPT-5.6 模型
推理
更高
速度
快
价格
$2•$12
输入•输出
输入
文本, 图像
输出
文本
GPT-5.6 Terra 专为需要兼顾智能与成本的工作负载设计。 它大致相当于早期 GPT-5 系列中的 mini 模型档位。 Reasoning.effort 支持以下值:none、low、medium(默认)、high、xhigh 和 max。
1,050,000 上下文窗口
最多输出 128,000 个 Token
知识截止日期:Feb 16, 2026
推理 Token 支持
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面。
文本 Token
每 1M 个 Token
输入
$2.00
缓存输入
$0.20
输出
$12.00
快速比较
输入
缓存输入
输出
GPT-5.6 Sol
$4.00
GPT-5.6 Terra
$2.00
GPT-5.4 Mini
$0.75
对于输入 Token 数 >272K 的提示,整个请求的输入按 2 倍费率计费,输出按 1.5 倍费率计费。
缓存写入按未缓存输入 Token 费率的 1.25 倍计费。
模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
支持
函数调用
支持
结构化输出
支持
微调
不支持
工具
使用 Responses API 时,此模型支持的工具。
网页搜索
支持
文件搜索
支持
图像生成
支持
代码解释器
支持
托管式 Shell
支持
应用补丁
支持
技能
支持
计算机使用
支持
MCP
支持
工具搜索
支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 GPT-5.6 Terra 的所有可用快照和别名。
gpt-5.6-terra
gpt-5.6-terra
gpt-5.6-terra
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
| 层级 | RPM | TPM | 批处理队列上限 |
|---|---|---|---|
| 免费 | 不支持 | ||
| 层级 1 | 500 | 500,000 | 1,500,000 |
| 层级 2 | 5,000 | 1,000,000 | 3,000,000 |
| 层级 3 | 5,000 | 2,000,000 | 100,000,000 |
| 层级 4 | 10,000 | 4,000,000 | 200,000,000 |
| 层级 5 | 15,000 | 40,000,000 | 15,000,000,000 |