For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

更新日志

有关即将弃用的功能,请参阅弃用信息页面

2026年9月

9月15日
功能

新增了组织和项目级别的 API 密钥创建治理控制功能。管理员可以仅允许创建服务账户密钥、仅允许创建用户拥有的项目密钥,或禁止创建任何新的 API 密钥。组织级别的限制优先于项目设置,现有 API 密钥不受影响。详情请参阅生产环境最佳实践

9月10日
功能

您现在可以在创建项目 API 密钥时设置到期日期。管理员还可以在平台设置中为组织或项目强制设置密钥的最长有效期,要求新创建的密钥在配置的期限内到期。有关密钥到期和轮换的指导,请参阅生产环境最佳实践

9月10日
功能

Agents API 已发布公开测试版。您可以使用托管的 Codex 执行框架构建智能体,由 OpenAI 负责会话编排、上下文压缩和恢复。

使用持久会话跨轮次继续工作,以流式方式传输进度,并连接您自己的工具和 MCP 服务器。在 OpenAI 托管的沙盒中运行智能体,或连接您自己的基础设施或受支持的提供商所提供的沙盒。

请从 Agents API 快速入门开始。

9月10日
功能
gpt-live-1
v1/live/sessions

GPT-Live 1 现已在 API 中正式推出。您可以构建全双工语音对话,即使后端模型或智能体正在处理推理和工具调用,对话也能继续进行。

配合 OpenAI 模型使用 Responses 委派,或通过客户端委派连接您自己的后端。语音会话的费用为每分钟 0.05 美元,按秒计费;后端模型和工具的使用费用另行收取。

请先参阅 GPT-Live提示词迁移指南。有关详细信息,请参阅定价

9月8日
功能
v1/responses

提示缓存诊断现已在 Responses API 中正式推出,支持 GPT-5.6 及后续受支持的模型。

与先前的响应对比缓存复用情况,找出缓存未命中的原因,并按照故障排除指南提高缓存复用率。

9月8日
功能
gpt-image-2.5-sunburst
gpt-image-2.5-flare
v1/images
v1/responses

发布了 GPT Image 2.5 SunburstGPT Image 2.5 Flare,可通过 Image API 和 Responses API 的图像生成工具生成和编辑图像。

对于最注重编辑精度的工作流,请使用 Sunburst;对于追求速度和高质量的日常图像生成,请使用 Flare。这两个模型都支持新增的 xhighmax 质量设置,并采用 GPT Image 2 的 Token 费率。请参阅图像生成指南定价

9月8日
功能
gpt-rosalind-research

GPT-Rosalind(gpt-rosalind-research)现已通过可信访问计划正式推出,可用于经批准的内部生命科学研究。

标准定价为每百万输入 Token 5 美元、每百万缓存输入 Token 0.50 美元,以及每百万输出 Token 25 美元。自 2026 年 10 月 5 日起开始计费。有关详细信息,请参阅定价

9月3日
功能
gpt-6-astra
v1/responses
v1/chat/completions

发布了 GPT-6 Astra,这是我们能力最强的模型,专为最复杂的端到端工作而构建。

您可以使用 GPT-6 Astra 进行推理、编程、计算机使用、研究和文档创作。它结合这些能力,利用您提供的上下文和工具,从最初的请求出发,完成复杂任务并交付最终成果。

迁移时需要注意的主要变化:

  • GPT-6 Astra 不支持 none 推理强度级别。
  • GPT-6 Astra 不支持自定义 temperaturetop_p 值,也不支持对数概率(logprobs)。
  • 工具调用需要使用 Responses API。如果您正在通过 Chat Completions 使用工具,请按照 Responses 迁移指南进行迁移。
  • 对齐偏差监测会在受支持的 Responses API 请求中,异步检查智能体工作过程中的潜在问题。检查可能触发安全警报,或停止对话以供审查。

请先阅读使用 GPT-6 Astra,了解其能力、提示词和迁移指南。您可以探索计算机使用,了解浏览器和桌面工作流,并查看定价以了解可用的推理服务层级。

9月3日
功能
v1/responses

Responses API 新增了用于控制 GPT-6 Astra 长时间运行工作的功能:

  • 异步工具调用:在您的应用运行函数工具或自定义工具时,让模型继续工作,并在结果就绪后陆续返回。
  • 轮次中途引导:在通过 WebSockets 生成响应的过程中发送额外指令,让模型能够根据更正或变化的需求进行调整。
  • 在对话中途更改推理强度:针对复杂工作提高推理强度,或针对常规后续请求降低推理强度,同时保留已缓存的提示前缀。
9月2日
更新

更新了 API 错误,让应用能够区分流量增长过快和模型暂时过载这两种情况。

流量增长过快时,可能返回带有 slow_down 错误代码的 429 错误。模型暂时过载时,会返回带有 server_is_overloaded 错误代码的 503 错误。这两种响应都可能包含 Retry-After。如果存在此响应头,请至少等待其中指定的时长后再重试;如果不存在,请使用指数退避。请参阅错误代码指南速率限制指南

9月1日
更新

现在可以使用 IPv6 连接到 api.openai.com

2026年8月

8月29日
功能

OpenAI API 现已正式支持双向 TLS(mTLS)X.509 工作负载身份联合。您可以直接在平台控制台中配置证书和 X.509 身份提供商,访问权限由您组织的角色和权限设置控制。

8月26日
更新
whisper-1
gpt-4o-transcribe
gpt-4o-mini-transcribe
gpt-4o-transcribe-diarize
v1/audio/transcriptions
v1/realtime

宣布弃用 whisper-1gpt-4o-transcribegpt-4o-mini-transcribegpt-4o-transcribe-diarize。这些模型将于 2027 年 2 月 26 日停止服务。请迁移到 gpt-live-transcribegpt-transcribe。请参阅转录指南弃用信息页面

Assistants API 已于 2026 年 8 月 26 日停止服务。请按照迁移指南迁移到 Responses API 和 Conversations API。

8月21日
功能

API 客户现在可以使用带前缀的域名,搭配地理范围设为全球的项目所提供的 API 密钥,为单个请求选择区域处理。现有的使用资格、数据保留控制、端点和模型支持要求仍然适用。请参阅数据控制指南了解详情。

8月21日
更新
gpt-5.6-sol

GPT-5.6 Sol 现按每百万输入 Token 4 美元、每百万输出 Token 20 美元收费,输入价格降低了 20%,输出价格降低了 33%。GPT-5.6 Sol 的优惠价格至少持续至 2026 年 11 月 21 日。请参阅定价详情

8月20日
功能

OpenAI API 平台推出了提示缓存仪表板。您可以跟踪缓存命中率随时间的变化、每次写入对应的缓存读取次数,以及缓存读取、缓存写入和未缓存 Token 的明细,从而了解缓存效率并找出改进机会。您还可以按模型和服务层级筛选指标。

8月20日
更新
gpt-image-2
gpt-image-2-2026-04-21
v1/images/generations
v1/images/edits
v1/responses

Images API 和 Responses API 的图像生成工具现已为 gpt-image-2gpt-image-2-2026-04-21 提供透明背景预览功能。请将 background 设为 transparent,并使用 pngwebp 格式输出;jpeg 不支持透明背景。请参阅图像生成指南了解详情。

8月13日
公告

宣布推出极速模式,这是 GPT-5.6 Sol 的全新 API 服务层级,运行速度最高可达标准处理的 14 倍。目前以有限预览形式向部分客户开放。您可以在此处注册,接收极速模式的最新消息。

8月7日
功能
gpt-5.6-cyber
gpt-daybreak-red-latest
gpt-daybreak-blue-latest
v1/responses

Daybreak 现为获批的安全防御人员提供两个访问层级:Daybreak Blue 和 Daybreak Red。在获得明确授权的安全工作中,您可以使用它们发现安全问题,并进一步完成和验证修复。

对于大多数防御性安全工作,请先使用 Daybreak Blue。它提供 GPT-5.6 Sol 等通用模型的访问权限,可用于漏洞发现、安全代码审查、检测工程、事件响应、恶意软件分析和补丁验证。请在此处了解详情。

Daybreak Red 提供 GPT-5.6 Cyber 等经过专项训练的模型的访问权限,需单独获得审批,可用于经授权的漏洞复现、漏洞利用验证、渗透测试、红队测试和复杂系统分析。

这些模型需要单独审批和开通。您可以在此处申请加入 Daybreak 计划。定价详情请见此处

8月6日
更新
chat-latest

更新了 chat-latest 快照,该快照指向 ChatGPT 中面向 Plus 和 Pro 用户提供的最新模型。我们建议在生产环境的 API 使用中采用 GPT-5.6 Sol,但您也可以使用此模型测试聊天场景的最新改进。底层模型快照将定期更新。请在此处了解详情。

8月5日
更新
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna

快速模式现已支持 GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna 的长上下文请求。即日起,超过 272K Token 的长上下文提示可在快速模式下运行,速度最高可达标准层级的 2.5 倍。请参阅定价详情

8月4日
功能

客户现在可以在用量和费用仪表板中按 API 密钥筛选和分组数据。Usage APICosts API 也支持 API 密钥维度,方便以编程方式生成报告和进行分析。

2026年7月

7月30日
更新
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions

自 7 月 30 日起,GPT-5.6 Luna 的价格降低 80%,GPT-5.6 Terra 的价格降低 20%。请参阅定价详情

我们还在 API 中推出了快速模式,取代原有的优先处理服务。对于 GPT-5.6 Sol,快速模式的速度现最高可达标准处理的 2.5 倍,价格为标准处理的两倍。此变更向后兼容:标记为 priority 的请求将自动使用快速模式。

7月29日
功能

发布了官方 OpenAI Terraform 提供程序,用于以基础设施即代码的方式管理 OpenAI API 平台资源。

您可以预配和管理项目、用户、组、角色、访问权限分配、服务账户、证书、邀请以及项目级速率限制。使用标准 Terraform 工作流审查和应用更改、导入现有资源,以及检测和纠正配置漂移。请从 Terraform Registry 安装该提供程序。

7月28日
功能
gpt-transcribe
gpt-live-transcribe
v1/audio/transcriptions
v1/realtime

发布了 GPT Transcribe,用于准确转录文件,以及生成已提交 Realtime 轮次的最终转录文本;同时发布了 GPT Live Transcribe,用于低延迟流式转录。

这两个模型都支持自由格式的转录上下文、关键词提示,以及指定多种预期输入语言。请参阅转录指南,比较它们支持的输出和工作流。

7月22日
功能

OpenAI API 平台新增了组织和项目的硬性支出限额。您可以设置每月上限,当跟踪的支出达到限额时,受影响的 API 请求将返回 429 错误。使用支出提醒可在请求流量中断前收到通知。请参阅支出限额指南了解详情。

7月9日
功能
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions
v1/batch

发布了 GPT-5.6 模型系列,包括提供前沿能力的 GPT-5.6 Sol、兼顾智能与成本的 GPT-5.6 Terra,以及适合高效处理大批量工作负载的 GPT-5.6 Luna。gpt-5.6 别名会将请求路由到 gpt-5.6-sol

GPT-5.6 新增了程序化工具调用显式提示缓存控制持久化推理、max 推理强度和 Pro 模式,以及 Responses API 中处于测试阶段的多智能体编排。当图像细节设为 originalauto 时,GPT-5.6 还支持接收原始尺寸的图像。

7月6日
功能
gpt-realtime-2.1
gpt-realtime-2.1-mini
v1/realtime

发布了 GPT-Realtime-2.1,这是更新后的实时推理模型,改进了字母数字识别、静音和噪声处理,以及被打断时的表现。同时发布了 GPT-Realtime-2.1 mini,这是面向实时语音应用的蒸馏推理模型,速度更快、成本更低。

2026年6月

6月24日
更新
chat-latest

更新了 chat-latest 快照,该快照指向 ChatGPT 当前使用的最新即时模型。我们建议在生产环境的 API 使用中采用 GPT-5.5,但您也可以使用此模型测试聊天场景的最新改进。底层模型快照将定期更新。请在此处了解详情。

6月23日
功能

OpenAI API 平台推出了安全用量仪表板。安全仪表板根据请求中用于识别最终用户的 safety_identifier 值,显示被阻止的 Responses 请求。请访问安全仪表板

6月9日
功能
v1/responses

网页搜索现在可以在返回常规文本结果的同时返回图像结果。当您的应用需要最新或来源于网页的视觉素材,例如产品照片、地标、地点、事件或视觉参考资料时,可以使用图像搜索。请参阅网页搜索指南了解详情。

6月5日
更新

OpenAI API 平台推出了重新设计的导航,请在此处查看。

6月4日
功能
omni-moderation-latest
v1/responses
v1/chat/completions

Responses API 和 Chat Completions API 新增了内容审核评分。在生成请求中传入 moderation 对象,即可在同一响应中获取模型输入和生成输出的内容审核结果。

请参阅内容审核指南了解详情。

6月3日
更新

宣布弃用可复用提示对象、评测平台和智能体构建器。请参阅弃用信息页面,了解停止服务的时间安排和迁移指南。

6月2日
更新

自 2026 年 6 月 2 日起,符合条件的容器会话将按分钟计费,最低计费时长为 5 分钟,不再按完整的 20 分钟会话收费。每分钟的基础费率保持不变。

此次更新旨在让较短会话的计费更加精细,并将降低客户的实际成本。

您可以在我们的 API 定价文档中查看当前内置工具的价格。

6月1日
功能
gpt-5.4
gpt-5.5
v1/responses

现在可以在 Amazon Bedrock 中通过兼容 OpenAI 的 Responses API 端点使用 OpenAI 模型。支持的模型和功能因 AWS 区域而异。了解详情

2026年5月

5月29日
更新
v1/responses
v1/chat/completions
v1/batch

对于未启用 ZDR 的组织,prompt_cache_retention 的默认值现已从 in_memory 改为 24h,即默认启用延长提示缓存。了解详情

5月28日
更新
chat-latest

发布了 chat-latest 快照,该快照指向 ChatGPT 当前使用的最新即时模型。我们建议在生产环境的 API 使用中采用 GPT-5.5,但您也可以使用此模型测试聊天场景的最新改进。底层模型快照将定期更新。请在此处了解详情。

5月26日
功能

发布了工作负载身份联合。受信任的工作负载可以用外部签发的身份令牌换取短期 OpenAI 访问令牌,无需存储长期 API 密钥。

5月26日
更新

管理 API 新增了管理支出提醒、模型允许列表、数据保留设置和托管工具权限的能力,并支持查询细化的账单明细。

5月19日
功能

面向企业客户发布了安全 MCP 隧道。安全 MCP 隧道让受支持的 OpenAI 产品(包括 ChatGPT 网页版、Codex、Responses API 和 AgentKit)能够通过客户自行托管的 tunnel-client 连接到私有或本地部署的 MCP 服务器,而无需将这些服务器暴露到公共互联网。

5月19日
更新

您现在可以管理多个 IP 允许列表,并将每个列表应用于项目级别或整个组织。要进行配置,请前往设置 > 安全 > IP 允许列表

5月12日
更新
dall-e-2
dall-e-3
v1/realtime

弃用了 DALL·E 模型快照和 Realtime API 测试版。

DALL·E 模型快照 dall-e-2dall-e-3 已于 2026 年 5 月 12 日弃用并从 API 中移除。我们建议改用 gpt-image-2gpt-image-1gpt-image-1-mini

Realtime API 测试版已于 2026 年 5 月 12 日弃用并从 API 中移除。如果您仍在使用测试版接口,请迁移至正式发布的 Realtime API。请参阅迁移指南和完整的弃用信息页面

5月11日
功能
v1/responses

为 Responses API 的网页搜索工具新增了 return_token_budget。对于需要更多推理的研究和评估工作负载,您可以使用它启用运行时间更长的 GPT-5+ 推理网页搜索。

5月7日
功能
gpt-realtime-2
gpt-realtime-translate
gpt-realtime-whisper
v1/realtime
v1/realtime/translations
v1/realtime/transcription_sessions

发布了 GPT-Realtime-2,这是一款面向语音到语音智能体的新实时语音模型,支持配置推理。同时发布的还有用于流式语音翻译的 GPT-Realtime-Translate 和用于流式语音转文本的 GPT-Realtime-Whisper

更新了实时交互与音频指南,新增了专门的实时翻译指南,更新了实时转录中有关流式转录的内容,并将实时提示词指导移至使用实时模型

5月7日
功能

发布了适用于 Codex 的 OpenAI Developers 插件。该插件提供 OpenAI 平台访问能力和 OpenAI API 设置指导,帮助您在 Codex 中构建 AI 应用和智能体。

5月6日
更新

更新后的 Agents SDK 现已提供 TypeScript 版本,内置沙盒智能体支持和开源执行框架。请在此了解详情

5月5日
更新
chat-latest

发布了 chat-latest 快照,指向 ChatGPT 当前使用的最新即时模型。我们建议在生产环境中调用 API 时使用 GPT-5.5,您也可以使用此模型测试我们针对聊天使用场景的最新改进。底层模型快照将定期更新。请在此了解详情

5月4日
更新

适用于 Node、Python、Go、Ruby 和 Java 的 OpenAI SDK 现已支持管理 API。有关设置说明和示例,请参阅管理 API 指南

2026年4月

4月24日
功能
gpt-5.5
gpt-5.5-pro
v1/responses
v1/chat/completions
v1/batch

在 Chat Completions API 和 Responses API 中发布了 GPT-5.5,这是一款面向复杂专业工作的新前沿模型。同时发布了 GPT-5.5 Pro,可通过 Responses API 请求调用,用于处理能从更多计算资源中受益的更复杂问题。

GPT-5.5 支持 100 万 Token 上下文窗口、图像输入、结构化输出、函数调用、提示缓存、批处理、工具搜索、内置计算机使用、托管式 Shell、应用补丁、技能、MCP 和网页搜索。主要更新包括:

  • 推理强度现在默认为 medium
  • image_detail 未设置或设置为 auto 时,模型现在采用 original 行为
  • GPT-5.5 的缓存仅支持扩展提示缓存,不支持内存提示缓存。 请在此了解详情
4月21日
功能
gpt-image-2
v1/images/generations
v1/images/edits
v1/batch

发布了 GPT Image 2,这是一款用于图像生成和编辑的先进图像生成模型。GPT Image 2 支持灵活的图像尺寸、高保真图像输入、基于 Token 的图像定价,并支持享受 50% 折扣的 Batch API。

4月15日
更新

更新了 Agents SDK,新增功能包括:

  • 在受控沙盒中运行智能体;
  • 检查和自定义开源执行框架;以及
  • 控制记忆的创建时机和存储位置。

2026年3月

3月17日
功能
gpt-5.4-mini
gpt-5.4-nano
v1/responses
v1/chat/completions

在 Chat Completions API 和 Responses API 中发布了 GPT-5.4 miniGPT-5.4 nano。GPT-5.4 mini 以更快、更高效的模型为大规模工作负载提供 GPT-5.4 级别的能力,而 GPT-5.4 nano 则针对最注重速度和成本的大规模简单任务进行了优化。

GPT-5.4 mini 支持工具搜索、内置计算机使用压缩。GPT-5.4 nano 支持压缩,但不支持工具搜索或计算机使用。

3月16日
更新
gpt-5.3-chat-latest

更新了 gpt-5.3-chat-latest Slug,使其指向 ChatGPT 当前使用的最新模型。

3月13日
修复
gpt-5.4
v1/responses
v1/chat/completions

更新了图像编码器,修复了 GPT-5.4 中 input_image 输入的一个小问题。部分图像理解使用场景的效果现在可能有所改善。您无需采取任何操作。

3月12日
功能
sora-2
sora-2-pro
v1/videos
v1/videos/characters
v1/videos/extensions
v1/batch

扩展了 Sora API 的功能,新增可复用的角色参考、最长 20 秒的视频生成、sora-2-pro1080p 输出、视频延长,以及通过 Batch API 调用 POST /v1/videos 的支持。使用 sora-2-pro 生成 1080p 视频按每秒 $0.70 计费。请在此了解详情

3月12日
更新
sora-2
sora-2-pro
v1/videos/edits
v1/videos/{video_id}/remix

新增了 POST /v1/videos/edits,用于编辑现有视频。它将取代 POST /v1/videos/{video_id}/remix,后者将在 6 个月后弃用。请在此了解详情

3月5日
功能
gpt-5.4
gpt-5.4-pro
v1/responses
v1/chat/completions

在 Chat Completions API 和 Responses API 中发布了 GPT-5.4,这是我们面向专业工作的最新前沿模型。同时在 Responses API 中发布了 GPT-5.4 Pro,用于处理能从更多计算资源中受益的更复杂问题。

此外还发布了:

  • Responses API 中的工具搜索,让模型可以将大量工具定义的加载推迟到运行时,从而减少 Token 用量、保持缓存性能并降低延迟。
  • GPT-5.4 内置的计算机使用支持,通过 Responses API 的 computer 工具实现基于屏幕截图的 UI 交互。
  • 100 万 Token 上下文窗口和原生压缩支持,适用于运行时间更长的智能体工作流。
3月3日
功能
gpt-5.3-chat-latest
v1/chat/completions
v1/responses

在 Chat Completions API 和 Responses API 中发布了 gpt-5.3-chat-latest。该模型指向 ChatGPT 当前使用的 GPT-5.3 Instant 快照。请在此了解详情

2026年2月

2月24日
功能
v1/responses

扩展了 Responses API 中 input_file 的支持范围,可接受更多类型的文档、演示文稿、电子表格、代码和文本文件。请在此了解详情

2月24日
功能
v1/responses

在 Responses API 中发布了 phase。它将助手消息标记为中间说明(commentary)或最终答案(final_answer)。请在此了解详情

2月24日
功能
gpt-5.3-codex
v1/responses

在 Responses API 中发布了 gpt-5.3-codex。请在此了解详情

2月23日
功能
v1/responses

为 Responses API 推出了 WebSocket 模式。请在此了解详情

2月23日
功能
gpt-realtime-1.5
gpt-audio-1.5
v1/realtime
v1/chat/completions

在 Realtime API 中发布了 GPT-Realtime-1.5

在 Chat Completions API 中发布了 gpt-audio-1.5。请在此了解详情

2月10日
功能
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/batch

Batch API 现已支持以下 GPT Image 模型:gpt-image-1.5chatgpt-image-latestgpt-image-1gpt-image-1-mini

2月10日
更新
gpt-5.2-chat-latest

更新了 gpt-5.2-chat-latest Slug,使其指向 ChatGPT 当前使用的最新模型。

2月10日
功能
v1/responses

在 Responses API 中推出了服务端压缩

2月10日
功能
v1/responses

在 Responses API 中推出了对技能的支持。本地执行和基于托管容器的执行均支持技能。

2月10日
功能
v1/responses

推出了新的托管式 Shell 工具,并新增了对容器内联网的支持。

2月9日
功能
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/images/edits

为 GPT 图像模型新增了在 /v1/images/edits 上使用 application/json 请求的支持。JSON 请求使用 images(以及可选的 mask),通过 image_urlfile_id 引用图像,而不使用 multipart 上传。

2月3日
更新
gpt-5.2
gpt-5.2-codex

我们为 API 客户优化了推理技术栈,GPT-5.2GPT-5.2-Codex 的运行速度现在提升了约 40%。模型及模型权重均未改变。

2026年1月

1月15日
公告

宣布推出 Open Responses:这是一项基于原版 OpenAI Responses API 的开源规范,用于构建支持多家提供商且可互操作的 LLM 接口。

1月14日
功能
gpt-5.2-codex
v1/responses

在 Responses API 中发布了 gpt-5.2-codex。GPT-5.2-Codex 是 GPT-5.2 的一个版本,针对 Codex 或类似环境中的智能体编程任务进行了优化。请在此了解详情

1月13日
功能
v1/realtime

为 Realtime API 新增了专用 SIP IP 地址范围。sip.api.openai.com 使用 GeoIP 路由,会将 SIP 流量定向到最近的区域。了解详情

1月13日
更新
gpt-realtime-mini
gpt-audio-mini

更新了 gpt-realtime-minigpt-audio-mini Slug,使其指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-realtime-mini-2025-10-06gpt-audio-mini-2025-10-06

1月13日
更新
sora-2

更新了 sora-2 Slug,使其指向 sora-2-2025-12-08。如果您需要之前的模型快照,请使用 sora-2-2025-10-06

1月13日
更新
gpt-4o-mini-tts
gpt-4o-mini-transcribe

更新了 gpt-4o-mini-ttsgpt-4o-mini-transcribe Slug,使其指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-4o-mini-tts-2025-03-20gpt-4o-mini-transcribe-2025-03-20。为了获得最佳效果,我们目前建议优先使用 gpt-4o-mini-transcribe,而非 gpt-4o-transcribe

1月9日
修复
gpt-image-1.5
chatgpt-image-latest

修复了以下问题:gpt-image-1.5chatgpt-image-latest 通过 /v1/images/edits 编辑图像时,即使已将 fidelity 显式设置为 low(默认值),仍会错误地使用高保真度。

2025年12月

12月19日
更新
gpt-image-1.5
chatgpt-image-latest

为 Responses API 的图像生成工具新增了 gpt-image-1.5chatgpt-image-latest

12月16日
功能
gpt-image-1.5
chatgpt-image-latest

发布了 gpt-image-1.5chatgpt-image-latest,这是我们最新、最先进的图像生成模型。请在此了解详情

12月15日
功能
gpt-realtime-mini
gpt-audio-mini
gpt-4o-mini-transcribe
gpt-4o-mini-tts

发布了四个新的带日期版本号的音频模型快照。这些更新提升了实时语音驱动应用的可靠性、质量和语音保真度。请在此了解详情

  • gpt-realtime-mini-2025-12-15
  • gpt-audio-mini-2025-12-15
  • gpt-4o-mini-transcribe-2025-12-15
  • gpt-4o-mini-tts-2025-12-15

此次发布还为符合条件的客户提供了自定义声音支持。

12月11日
功能
gpt-5.2
gpt-5.2-chat-latest
v1/responses
v1/chat/completions

发布了 GPT-5.2,这是 GPT-5 模型家族中的最新旗舰模型。与之前的 GPT-5.1 相比,GPT-5.2 在以下方面有所提升:

  • 通用智能
  • 指令遵循
  • 准确性和 Token 使用效率
  • 多模态能力,尤其是视觉能力
  • 代码生成,尤其是前端 UI 创建
  • API 中的工具调用和上下文管理
  • 电子表格的理解与创建。

5.2 的新功能包括新增的 xhigh 推理强度级别、简洁的推理摘要,以及利用压缩进行上下文管理的新方式。

12月11日
功能
v1/responses/compact

推出了客户端压缩。对于使用 Responses API 的长时间对话,您可以使用 /responses/compact 端点来缩减每轮发送的上下文。

12月4日
功能
gpt-5.1-codex-max
v1/responses

在 Responses API 中发布了 gpt-5.1-codex-max。GPT-5.1-Codex 是我们最智能的编程模型,针对长时间跨度的智能体编程任务进行了优化。点击此处了解更多。

2025年11月

11月20日
功能
v1/realtime

Realtime API 新增了对 DTMF 按键的支持。现在,您可以在使用 Realtime 带外连接时接收 DTMF 事件。有关更多信息,请参阅此处的文档

11月13日
功能
gpt-5.1
gpt-5.1-codex
gpt-5.1-chat-latest
gpt-5.1-codex-mini
v1/responses
v1/chat/completions

发布了 GPT-5.1,这是 GPT-5 模型系列的最新旗舰模型。GPT-5.1 经过训练,在以下方面尤为出色:

  • 可引导性,以及在无需太多思考时更快地响应
  • 代码生成与编程使用场景
  • 智能体工作流

请注意,GPT-5.1 默认采用新的 none 推理设置,以便在无需太多思考时更快地响应,这与 GPT-5 之前默认采用的 medium 设置不同。

11月13日
功能

推出了增强的基于角色的访问控制(RBAC)。基于角色的访问控制(RBAC)让您能够决定组织和项目中的哪些人可以执行哪些操作,涵盖 API 和控制台两种使用方式。

11月13日
功能
gpt-5.1-codex
gpt-5.1-codex-mini
v1/responses

在 Responses API 中发布了 gpt-5.1-codexgpt-5.1-codex-mini。GPT-5.1-Codex 是 GPT-5.1 的一个版本,针对 Codex 或类似环境中的智能体编程任务进行了优化。点击此处了解更多。

11月13日
功能

推出了延长提示缓存保留时间的功能。此功能可让缓存的前缀保持有效更长时间,最长可达 24 小时。延长提示缓存通过在内存已满时将键/值张量卸载到 GPU 本地存储来实现,从而大幅增加可用于缓存的存储容量。

2025年10月

10月29日
功能
gpt-oss-safeguard-120b
gpt-oss-safeguard-20b

gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 是基于 gpt-oss 构建的安全推理模型。点击此处了解更多。

10月24日
功能

推出了企业密钥管理(EKM)。企业密钥管理(EKM)让您可以使用自己的外部密钥管理系统(KMS)所管理的密钥,对您在 OpenAI 的客户内容进行加密。

10月24日
功能

推出了英国数据驻留

10月6日
功能
gpt-5-pro
gpt-realtime-mini
gpt-audio-mini
gpt-image-1-mini
sora-2
sora-2-pro
v1/responses
v1/batch
v1/chat/completions
v1/videos
v1/realtime
v1/images/generations

OpenAI DevDay 上发布了多项新功能:

发布了 GPT-5 Pro,这是 GPT-5 的一个版本,使用更多计算资源进行更深入的思考,并持续提供更好的答案。

发布了 GPT-Realtime minigpt-audio-mini,以更低的成本提供语音到语音能力。

发布了 gpt-image-1-mini,以更低的成本生成和编辑图像。

推出了 v1/videos,通过我们最新的 Sora 2Sora 2 Pro 模型生成和再创作内容丰富、细节细腻且富有动感的视频。

推出了智能体构建器,用于以可视化方式创建自定义多智能体工作流。

推出了 ChatKit,这是一个用于部署智能体的可嵌入聊天界面。

推出了追踪评测、数据集和提示优化工具

评测:新增了对第三方模型的支持。

推出了服务健康状况控制台

10月1日
功能

推出了 IP 允许列表。IP 允许列表将 API 访问限制为仅允许您指定的 IP 地址或地址范围。

2025年9月

9月26日
功能
v1/responses

Responses API 新增了将图像和文件作为工具调用输出的支持。

9月23日
功能
gpt-5-codex
v1/responses

推出了专用模型 gpt-5-codex,专为配合 Codex CLI 使用而构建和优化。

2025年8月

8月28日
功能
v1/realtime

OpenAI Realtime API 现已正式推出。请参阅我们的 Realtime API 指南了解更多。

8月21日
功能
v1/responses

Responses API 新增了对连接器的支持。连接器是由 OpenAI 维护的 MCP 封装,面向 Google 应用、Dropbox 等常用服务,可用于让模型读取这些服务中存储的数据。

8月20日
功能
v1/conversations
v1/responses
v1/assistants

发布了 Conversations API,让您能够配合 Responses API 创建和管理长时间对话。请参阅迁移指南,查看并排对比,并了解如何将 Assistants API 集成迁移到 Responses 和 Conversations。

8月7日
功能
v1/chat/completions
v1/responses

在 API 中发布了 GPT-5 模型系列,包括 gpt-5gpt-5-minigpt-5-nano

新增了推理强度minimal,用于优化 GPT-5 模型(支持推理)的响应速度。

新增了 custom 工具调用类型,允许在工具调用时以自由格式向模型提供输入并接收模型输出。

2025年6月

6月27日
功能

新增了对优先处理的支持。与标准处理相比,优先处理的延迟显著更低且更稳定,同时保留了按量付费的灵活性。

6月24日
功能
o3-deep-research
o3-deep-research-2025-06-26
o4-mini-deep-research
o4-mini-deep-research-2025-06-26
v1/responses

发布了 o3-deep-researcho4-mini-deep-research,它们是我们 o 系列推理模型的深度研究版本,针对深入分析和研究任务进行了优化。请参阅深度研究指南了解更多。

新增了通过 Webhook 处理异步事件的支持。网页搜索工具的价格已下调,定价方式也已简化。新增了对网页搜索工具的支持。

6月13日
功能
v1/responses

控制台和 Responses API 现已支持新的可复用提示。现在,您可以在 API 中通过 prompt 参数(包含提示的 id 和可选的 version)引用在控制台中创建的模板,并提供可包含字符串、图像或文件输入的动态 variables。Chat Completions 不支持可复用提示。了解更多

6月10日
功能
o3-pro
v1/responses
v1/batch

发布了 o3-pro,这是 o3 推理模型的一个版本,使用更多计算资源,以更好的推理能力和一致性解答复杂问题。所有 API 请求的 o3 模型价格也已下调,包括批处理和弹性处理。

6月4日
功能
v1/fine_tuning

新增了对 gpt-4.1-2025-04-14gpt-4.1-mini-2025-04-14gpt-4.1-nano-2025-04-14 模型使用直接偏好优化进行微调的支持。

6月3日
功能
v1/chat/completions
v1/realtime

gpt-4o-audio-previewgpt-4o-realtime-preview 的新模型快照现已可用。发布了 TypeScript 版 Agents SDK

2025年5月

5月20日
功能
v1/responses

Responses API 新增了对内置工具的支持,包括远程 MCP 服务器代码解释器了解有关工具的更多信息

5月20日
功能
v1/responses
v1/chat/completions

使用未经微调的模型进行并行工具调用时,现已支持对工具模式使用 strict 模式。 新增了模式功能,包括针对 email 等格式的字符串验证,以及为数字和数组指定范围。

5月15日
功能
codex-mini-latest
v1/responses
v1/chat/completions

在 API 中推出了 codex-mini-latest,针对配合 Codex CLI 使用进行了优化。

5月7日
功能
v1/fine-tuning
v1/responses
v1/chat/completions

新增了对强化微调的支持。了解可用的微调方法gpt-4.1-nano 现已支持微调。

2025年4月

4月30日
4月23日
功能
v1/images/generations
v1/images/edits

新增了图像生成模型 gpt-image-1。该模型提升了图像质量和指令遵循能力,为图像生成树立了新标准。

更新了图像生成和编辑端点,以支持 gpt-image-1 模型专用的新参数。

4月16日
功能
v1/chat/completions
v1/responses

新增了两个 o 系列推理模型:o3o4-mini。它们在数学、科学、编程、视觉推理任务和技术写作方面树立了新标准。

推出了 Codex,这是我们的代码生成 CLI 工具。

4月14日
功能
gpt-4.1
gpt-4.1-mini
gpt-4.1-nano
v1/responses
v1/chat/completions
v1/fine_tuning

在 API 中新增了 gpt-4.1gpt-4.1-minigpt-4.1-nano 模型。这些新模型提升了指令遵循和编程能力,并提供了更大的上下文窗口(最高 100 万 Token)。gpt-4.1gpt-4.1-mini 支持监督微调。宣布弃用 gpt-4.5-preview

2025年3月

3月20日
更新
v1/audio

在 Audio API 中新增了 gpt-4o-mini-ttsgpt-4o-transcribegpt-4o-mini-transcribewhisper-1 模型。

3月19日
功能
o1-pro
v1/responses
v1/batch

发布了 o1-pro,这是 o1 推理模型的一个版本,使用更多计算资源,以更好的推理能力和一致性解答复杂问题。

3月11日
功能
gpt-4o-search-preview
gpt-4o-mini-search-preview
computer-use-preview
v1/chat/completions
v1/assistants
v1/responses

发布了面向智能体工作流的多个新模型、新工具以及一个新 API:

  • 发布了 Responses API,这是一个用于创建和使用智能体与工具的新 API。
  • 为 Responses API 推出了一组内置工具:网页搜索文件搜索计算机使用
  • 发布了 Agents SDK,这是一个用于设计、构建和部署智能体的编排框架。
  • 宣布推出新模型:gpt-4o-search-previewgpt-4o-mini-search-previewcomputer-use-preview
  • 宣布计划将 Assistants API 的所有功能引入更易用的 Responses API,预计在 2026 年停止提供 Assistants(在实现完全相同的功能之后)。
3月3日
功能
v1/fine_tuning/jobs

微调作业新增了对 metadata 字段的支持。

2025年2月

2月27日
功能
GPT-4.5
v1/chat/completions
v1/assistants
v1/batch

发布了 GPT-4.5 的研究预览版,这是我们迄今为止规模最大、能力最强的聊天模型。GPT-4.5 的高“情商”和对用户意图的理解,使其在创意任务和智能体规划方面表现更好。

2月25日
功能

推出了 API 用量仪表板更新。此次更新响应了用户对更多数据筛选功能的需求,新增了项目选择、日期选择器和更精细的时间间隔等功能,同时改进了跨产品和服务层级查看用量的体验。

2月5日
功能

推出欧洲数据驻留功能。请在此了解更多信息

2025年1月

1月31日
功能
o3-mini
o3-mini-2025-01-31
v1/chat/completions

推出了 o3-mini,这是一款针对科学、数学和编程任务优化的新型小型推理模型。

1月21日
功能
o1

扩大了 o1 模型的开放范围。o1 系列模型通过强化学习训练,能够执行复杂推理。

2024年12月

12月18日
功能

推出了管理 API 密钥轮换功能,客户可以通过编程方式轮换管理 API 密钥。

更新了管理 API 邀请功能,客户可以通过编程方式在邀请用户加入组织的同时,邀请他们加入项目。

12月17日
功能
o1
gpt-4o
gpt-4o-mini
v1/fine_tuning
v1/chat/completions
v1/realtime

新增了 o1gpt-4o-realtimegpt-4o-audio更多新模型。

Realtime API 新增了 WebRTC 连接方式。

为 o1 模型新增了 reasoning_effort 参数

为 o1 模型新增了 developer 消息角色。请注意,o1-preview 和 o1-mini 不支持 system 或 developer 消息。

推出了使用直接偏好优化(DPO)的偏好微调功能。

推出了 Go 和 Java SDK 的测试版。了解更多

Python SDK 中新增了对 Realtime API 的支持。

12月4日
功能

推出了 Usage API,客户可以通过编程方式查询各项 OpenAI API 的使用活动和支出。

2024年11月

11月20日
更新
v1/chat/completions

发布了 gpt-4o-2024-11-20,这是 gpt-4o 系列的最新模型。

11月4日
功能
v1/chat/completions

推出了预测输出功能。如果模型回复的大部分内容已预先确定,此功能可大幅降低回复延迟。这种情况最常见于重新生成仅有少量修改的文档和代码文件内容。

2024年10月

10月30日
功能
gpt-4o-realtime-preview
gpt-4o-audio-preview
v1/chat/completions

Realtime APIChat Completions API 中新增了五种声音。

10月17日
功能
gpt-4o-audio-preview
v1/chat/completions

为 Chat Completions 发布了新的 gpt-4o-audio-preview 模型,支持音频输入和输出。它与 Realtime API 使用相同的底层模型。

10月1日
功能
v1/realtime
v1/chat/completions
v1/fine_tuning

旧金山举办的 OpenAI DevDay 上发布了多项新功能:

Realtime API:使用 WebSockets 接口,在您的应用中构建快速的语音到语音体验。

模型蒸馏:提供一个平台,让您使用大型前沿模型的输出微调经济高效的模型。

图像微调:使用图像和文本微调 GPT-4o,以提升视觉能力。

评测:创建并运行自定义评估,以衡量模型在特定任务上的表现。

提示缓存:对于近期处理过的输入 Token,提供价格折扣和更快的处理速度。

在 Playground 中生成:使用 Playground 中的“生成”按钮,轻松生成提示、函数定义和结构化输出模式。

2024年9月

9月26日
功能
omni-moderation-latest
v1/moderations

发布了新的 omni-moderation-latest 内容审核模型,支持图像和文本(部分分类),新增两个仅针对文本的有害内容分类,并提供更准确的评分。

9月12日
功能
o1-preview
o1-mini
v1/chat/completions

发布了 o1-preview 和 o1-mini,这两款新型大语言模型通过强化学习训练,能够执行复杂推理任务。

2024年8月

8月29日
8月20日
功能
gpt-4o
v1/fine_tuning

gpt-4o-2024-08-06 微调功能正式发布,所有 API 用户现在都可以微调最新的 GPT-4o 模型。

8月15日
更新
gpt-4o
v1/chat/completions

发布了动态模型 chatgpt-4o-latest,该模型将指向 ChatGPT 使用的最新 GPT-4o 模型。

8月6日
更新

推出了结构化输出,模型输出现在能够可靠地遵循开发者提供的 JSON 模式。

发布了 gpt-4o-2024-08-06,这是 gpt-4o 系列的最新模型。

8月1日
更新

推出了管理 API 和审计日志 API,客户可以通过编程方式管理组织,并使用审计日志监控变更。必须在设置中启用审计日志记录。

2024年7月

7月24日
更新

推出了自助 SSO 配置,采用自定义计费和无限额计费的企业客户可以使用所选的 IDP 设置身份验证。

7月23日
更新

推出了 GPT-4o mini 微调功能,可进一步提升模型在特定使用场景中的表现。

7月18日
更新

发布了 GPT-4o mini,这是一款价格实惠、智能的小型模型,适用于快速、轻量的任务。

7月17日
更新

推出了 Uploads,用于分段上传大文件。

2024年6月

6月6日
更新

在 Chat Completions 和 Assistants API 中,可以通过传入 parallel_tool_calls=false 禁用并行函数调用

.NET SDK 测试版已推出。

6月3日
更新

新增了对文件搜索自定义功能的支持。

2024年5月

5月15日
更新

新增了对项目归档的支持。只有组织所有者可以使用此功能。

新增了按量付费客户按项目设置费用上限的功能。

5月13日
更新

在 API 中发布了 GPT-4o。GPT-4o 是我们速度最快、价格最实惠的旗舰模型。

5月7日
更新

新增了对在 Batch API 中使用微调模型的支持。

5月6日
更新

为 Chat Completions 和 Completions API 新增了 stream_options: {"include_usage": true} 参数。设置此参数后,开发者可以在使用流式传输时获取用量统计信息。

5月2日
更新

为 Assistants API 新增了一个端点,用于从线程中删除消息。

2024年4月

4月29日
更新

为 Chat Completions 和 Assistants API 新增了函数调用选项 tool_choice: "required"

新增了 Batch API 指南,并在 Batch API 中新增了对嵌入向量模型的支持。

4月17日
更新

推出了 Assistants API 的一系列更新,包括每个助手最多支持 10,000 个文件的新文件搜索工具、新的 Token 控制功能,以及对工具选择的支持。

4月16日
更新

引入了基于项目的层级结构,用于按项目组织工作,包括按项目创建 API 密钥、管理速率限制和费用上限的功能(费用上限仅对企业客户开放)。

4月15日
更新

发布了 Batch API

4月9日
更新

在 API 中正式发布了 GPT-4 Turbo with Vision

4月4日
更新

在微调 API 中新增了对 seed 的支持。

在微调 API 中新增了对检查点的支持。

在 Assistants API 中新增了对创建运行时添加消息的支持。

4月1日
更新

在 Assistants API 中新增了对按 run_id 筛选消息的支持。

2024年3月

3月29日
更新

在 Assistants API 中新增了对 temperature创建助手消息的支持。

3月14日
更新

在 Assistants API 中新增了对流式传输的支持。

2024年2月

2月9日
更新

为 Audio API 新增了 timestamp_granularities 参数

2024年1月

1月25日
更新

发布了嵌入向量 V3 模型和更新版 GPT-4 Turbo 预览模型。

为 Embeddings API 新增了 dimensions 参数

2023年12月

12月20日
更新

为 Assistants API 的运行创建功能新增了 additional_instructions 参数

12月15日
更新

Chat Completions API 新增了 logprobstop_logprobs 参数

12月14日
更新

已将工具调用中的函数参数设为可选。

2023年11月

11月30日
更新

发布了 OpenAI Deno SDK

11月6日
更新

2023年10月

10月16日
更新

嵌入向量 API 新增了 encoding_format 参数

内容审核模型新增了 max_tokens

10月6日
更新

微调 API 新增了函数调用支持