更新日志
2026年9月
新增了组织和项目级别的 API 密钥创建治理控制功能。管理员可以仅允许创建服务账户密钥、仅允许创建用户拥有的项目密钥,或禁止创建任何新的 API 密钥。组织级别的限制优先于项目设置,现有 API 密钥不受影响。详情请参阅生产环境最佳实践。
您现在可以在创建项目 API 密钥时设置到期日期。管理员还可以在平台设置中为组织或项目强制设置密钥的最长有效期,要求新创建的密钥在配置的期限内到期。有关密钥到期和轮换的指导,请参阅生产环境最佳实践。
Agents API 已发布公开测试版。您可以使用托管的 Codex 执行框架构建智能体,由 OpenAI 负责会话编排、上下文压缩和恢复。
使用持久会话跨轮次继续工作,以流式方式传输进度,并连接您自己的工具和 MCP 服务器。在 OpenAI 托管的沙盒中运行智能体,或连接您自己的基础设施或受支持的提供商所提供的沙盒。
请从 Agents API 快速入门开始。
GPT-Live 1 现已在 API 中正式推出。您可以构建全双工语音对话,即使后端模型或智能体正在处理推理和工具调用,对话也能继续进行。
配合 OpenAI 模型使用 Responses 委派,或通过客户端委派连接您自己的后端。语音会话的费用为每分钟 0.05 美元,按秒计费;后端模型和工具的使用费用另行收取。
提示缓存诊断现已在 Responses API 中正式推出,支持 GPT-5.6 及后续受支持的模型。
与先前的响应对比缓存复用情况,找出缓存未命中的原因,并按照故障排除指南提高缓存复用率。
发布了 GPT Image 2.5 Sunburst 和 GPT Image 2.5 Flare,可通过 Image API 和 Responses API 的图像生成工具生成和编辑图像。
对于最注重编辑精度的工作流,请使用 Sunburst;对于追求速度和高质量的日常图像生成,请使用 Flare。这两个模型都支持新增的 xhigh 和 max 质量设置,并采用 GPT Image 2 的 Token 费率。请参阅图像生成指南和定价。
发布了 GPT-6 Astra,这是我们能力最强的模型,专为最复杂的端到端工作而构建。
您可以使用 GPT-6 Astra 进行推理、编程、计算机使用、研究和文档创作。它结合这些能力,利用您提供的上下文和工具,从最初的请求出发,完成复杂任务并交付最终成果。
迁移时需要注意的主要变化:
- GPT-6 Astra 不支持
none推理强度级别。 - GPT-6 Astra 不支持自定义
temperature或top_p值,也不支持对数概率(logprobs)。 - 工具调用需要使用 Responses API。如果您正在通过 Chat Completions 使用工具,请按照 Responses 迁移指南进行迁移。
- 对齐偏差监测会在受支持的 Responses API 请求中,异步检查智能体工作过程中的潜在问题。检查可能触发安全警报,或停止对话以供审查。
请先阅读使用 GPT-6 Astra,了解其能力、提示词和迁移指南。您可以探索计算机使用,了解浏览器和桌面工作流,并查看定价以了解可用的推理服务层级。
Responses API 新增了用于控制 GPT-6 Astra 长时间运行工作的功能:
- 异步工具调用:在您的应用运行函数工具或自定义工具时,让模型继续工作,并在结果就绪后陆续返回。
- 轮次中途引导:在通过 WebSockets 生成响应的过程中发送额外指令,让模型能够根据更正或变化的需求进行调整。
- 在对话中途更改推理强度:针对复杂工作提高推理强度,或针对常规后续请求降低推理强度,同时保留已缓存的提示前缀。
现在可以使用 IPv6 连接到 api.openai.com。
2026年8月
OpenAI API 现已正式支持双向 TLS(mTLS)和 X.509 工作负载身份联合。您可以直接在平台控制台中配置证书和 X.509 身份提供商,访问权限由您组织的角色和权限设置控制。
宣布弃用 whisper-1、gpt-4o-transcribe、gpt-4o-mini-transcribe 和 gpt-4o-transcribe-diarize。这些模型将于 2027 年 2 月 26 日停止服务。请迁移到 gpt-live-transcribe 或 gpt-transcribe。请参阅转录指南和弃用信息页面。
Assistants API 已于 2026 年 8 月 26 日停止服务。请按照迁移指南迁移到 Responses API 和 Conversations API。
API 客户现在可以使用带前缀的域名,搭配地理范围设为全球的项目所提供的 API 密钥,为单个请求选择区域处理。现有的使用资格、数据保留控制、端点和模型支持要求仍然适用。请参阅数据控制指南了解详情。
GPT-5.6 Sol 现按每百万输入 Token 4 美元、每百万输出 Token 20 美元收费,输入价格降低了 20%,输出价格降低了 33%。GPT-5.6 Sol 的优惠价格至少持续至 2026 年 11 月 21 日。请参阅定价详情。
OpenAI API 平台推出了提示缓存仪表板。您可以跟踪缓存命中率随时间的变化、每次写入对应的缓存读取次数,以及缓存读取、缓存写入和未缓存 Token 的明细,从而了解缓存效率并找出改进机会。您还可以按模型和服务层级筛选指标。
Images API 和 Responses API 的图像生成工具现已为 gpt-image-2 和 gpt-image-2-2026-04-21 提供透明背景预览功能。请将 background 设为 transparent,并使用 png 或 webp 格式输出;jpeg 不支持透明背景。请参阅图像生成指南了解详情。
宣布推出极速模式,这是 GPT-5.6 Sol 的全新 API 服务层级,运行速度最高可达标准处理的 14 倍。目前以有限预览形式向部分客户开放。您可以在此处注册,接收极速模式的最新消息。
Daybreak 现为获批的安全防御人员提供两个访问层级:Daybreak Blue 和 Daybreak Red。在获得明确授权的安全工作中,您可以使用它们发现安全问题,并进一步完成和验证修复。
对于大多数防御性安全工作,请先使用 Daybreak Blue。它提供 GPT-5.6 Sol 等通用模型的访问权限,可用于漏洞发现、安全代码审查、检测工程、事件响应、恶意软件分析和补丁验证。请在此处了解详情。
Daybreak Red 提供 GPT-5.6 Cyber 等经过专项训练的模型的访问权限,需单独获得审批,可用于经授权的漏洞复现、漏洞利用验证、渗透测试、红队测试和复杂系统分析。
更新了 chat-latest 快照,该快照指向 ChatGPT 中面向 Plus 和 Pro 用户提供的最新模型。我们建议在生产环境的 API 使用中采用 GPT-5.6 Sol,但您也可以使用此模型测试聊天场景的最新改进。底层模型快照将定期更新。请在此处了解详情。
2026年7月
发布了官方 OpenAI Terraform 提供程序,用于以基础设施即代码的方式管理 OpenAI API 平台资源。
您可以预配和管理项目、用户、组、角色、访问权限分配、服务账户、证书、邀请以及项目级速率限制。使用标准 Terraform 工作流审查和应用更改、导入现有资源,以及检测和纠正配置漂移。请从 Terraform Registry 安装该提供程序。
发布了 GPT Transcribe,用于准确转录文件,以及生成已提交 Realtime 轮次的最终转录文本;同时发布了 GPT Live Transcribe,用于低延迟流式转录。
这两个模型都支持自由格式的转录上下文、关键词提示,以及指定多种预期输入语言。请参阅转录指南,比较它们支持的输出和工作流。
OpenAI API 平台新增了组织和项目的硬性支出限额。您可以设置每月上限,当跟踪的支出达到限额时,受影响的 API 请求将返回 429 错误。使用支出提醒可在请求流量中断前收到通知。请参阅支出限额指南了解详情。
发布了 GPT-5.6 模型系列,包括提供前沿能力的 GPT-5.6 Sol、兼顾智能与成本的 GPT-5.6 Terra,以及适合高效处理大批量工作负载的 GPT-5.6 Luna。gpt-5.6 别名会将请求路由到 gpt-5.6-sol。
GPT-5.6 新增了程序化工具调用、显式提示缓存控制、持久化推理、max 推理强度和 Pro 模式,以及 Responses API 中处于测试阶段的多智能体编排。当图像细节设为 original 或 auto 时,GPT-5.6 还支持接收原始尺寸的图像。
发布了 GPT-Realtime-2.1,这是更新后的实时推理模型,改进了字母数字识别、静音和噪声处理,以及被打断时的表现。同时发布了 GPT-Realtime-2.1 mini,这是面向实时语音应用的蒸馏推理模型,速度更快、成本更低。
2026年6月
OpenAI API 平台推出了安全用量仪表板。安全仪表板根据请求中用于识别最终用户的 safety_identifier 值,显示被阻止的 Responses 请求。请访问安全仪表板。
网页搜索现在可以在返回常规文本结果的同时返回图像结果。当您的应用需要最新或来源于网页的视觉素材,例如产品照片、地标、地点、事件或视觉参考资料时,可以使用图像搜索。请参阅网页搜索指南了解详情。
OpenAI API 平台推出了重新设计的导航,请在此处查看。
Responses API 和 Chat Completions API 新增了内容审核评分。在生成请求中传入 moderation 对象,即可在同一响应中获取模型输入和生成输出的内容审核结果。
请参阅内容审核指南了解详情。
宣布弃用可复用提示对象、评测平台和智能体构建器。请参阅弃用信息页面,了解停止服务的时间安排和迁移指南。
自 2026 年 6 月 2 日起,符合条件的容器会话将按分钟计费,最低计费时长为 5 分钟,不再按完整的 20 分钟会话收费。每分钟的基础费率保持不变。
此次更新旨在让较短会话的计费更加精细,并将降低客户的实际成本。
您可以在我们的 API 定价文档中查看当前内置工具的价格。
现在可以在 Amazon Bedrock 中通过兼容 OpenAI 的 Responses API 端点使用 OpenAI 模型。支持的模型和功能因 AWS 区域而异。了解详情。
2026年5月
对于未启用 ZDR 的组织,prompt_cache_retention 的默认值现已从 in_memory 改为 24h,即默认启用延长提示缓存。了解详情。
发布了工作负载身份联合。受信任的工作负载可以用外部签发的身份令牌换取短期 OpenAI 访问令牌,无需存储长期 API 密钥。
管理 API 新增了管理支出提醒、模型允许列表、数据保留设置和托管工具权限的能力,并支持查询细化的账单明细。
面向企业客户发布了安全 MCP 隧道。安全 MCP 隧道让受支持的 OpenAI 产品(包括 ChatGPT 网页版、Codex、Responses API 和 AgentKit)能够通过客户自行托管的 tunnel-client 连接到私有或本地部署的 MCP 服务器,而无需将这些服务器暴露到公共互联网。
您现在可以管理多个 IP 允许列表,并将每个列表应用于项目级别或整个组织。要进行配置,请前往设置 > 安全 > IP 允许列表。
为 Responses API 的网页搜索工具新增了 return_token_budget。对于需要更多推理的研究和评估工作负载,您可以使用它启用运行时间更长的 GPT-5+ 推理网页搜索。
发布了 GPT-Realtime-2,这是一款面向语音到语音智能体的新实时语音模型,支持配置推理。同时发布的还有用于流式语音翻译的 GPT-Realtime-Translate 和用于流式语音转文本的 GPT-Realtime-Whisper。
更新了实时交互与音频指南,新增了专门的实时翻译指南,更新了实时转录中有关流式转录的内容,并将实时提示词指导移至使用实时模型。
发布了适用于 Codex 的 OpenAI Developers 插件。该插件提供 OpenAI 平台访问能力和 OpenAI API 设置指导,帮助您在 Codex 中构建 AI 应用和智能体。
更新后的 Agents SDK 现已提供 TypeScript 版本,内置沙盒智能体支持和开源执行框架。请在此了解详情。
适用于 Node、Python、Go、Ruby 和 Java 的 OpenAI SDK 现已支持管理 API。有关设置说明和示例,请参阅管理 API 指南。
2026年4月
在 Chat Completions API 和 Responses API 中发布了 GPT-5.5,这是一款面向复杂专业工作的新前沿模型。同时发布了 GPT-5.5 Pro,可通过 Responses API 请求调用,用于处理能从更多计算资源中受益的更复杂问题。
GPT-5.5 支持 100 万 Token 上下文窗口、图像输入、结构化输出、函数调用、提示缓存、批处理、工具搜索、内置计算机使用、托管式 Shell、应用补丁、技能、MCP 和网页搜索。主要更新包括:
- 推理强度现在默认为
medium。 - 当
image_detail未设置或设置为auto时,模型现在采用 original 行为。 - GPT-5.5 的缓存仅支持扩展提示缓存,不支持内存提示缓存。 请在此了解详情。
发布了 GPT Image 2,这是一款用于图像生成和编辑的先进图像生成模型。GPT Image 2 支持灵活的图像尺寸、高保真图像输入、基于 Token 的图像定价,并支持享受 50% 折扣的 Batch API。
更新了 Agents SDK,新增功能包括:
- 在受控沙盒中运行智能体;
- 检查和自定义开源执行框架;以及
- 控制记忆的创建时机和存储位置。
2026年3月
在 Chat Completions API 和 Responses API 中发布了 GPT-5.4 mini 和 GPT-5.4 nano。GPT-5.4 mini 以更快、更高效的模型为大规模工作负载提供 GPT-5.4 级别的能力,而 GPT-5.4 nano 则针对最注重速度和成本的大规模简单任务进行了优化。
GPT-5.4 mini 支持工具搜索、内置计算机使用和压缩。GPT-5.4 nano 支持压缩,但不支持工具搜索或计算机使用。
更新了 gpt-5.3-chat-latest Slug,使其指向 ChatGPT 当前使用的最新模型。
更新了图像编码器,修复了 GPT-5.4 中 input_image 输入的一个小问题。部分图像理解使用场景的效果现在可能有所改善。您无需采取任何操作。
扩展了 Sora API 的功能,新增可复用的角色参考、最长 20 秒的视频生成、sora-2-pro 的 1080p 输出、视频延长,以及通过 Batch API 调用 POST /v1/videos 的支持。使用 sora-2-pro 生成 1080p 视频按每秒 $0.70 计费。请在此了解详情。
新增了 POST /v1/videos/edits,用于编辑现有视频。它将取代 POST /v1/videos/{video_id}/remix,后者将在 6 个月后弃用。请在此了解详情。
在 Chat Completions API 和 Responses API 中发布了 GPT-5.4,这是我们面向专业工作的最新前沿模型。同时在 Responses API 中发布了 GPT-5.4 Pro,用于处理能从更多计算资源中受益的更复杂问题。
此外还发布了:
在 Chat Completions API 和 Responses API 中发布了 gpt-5.3-chat-latest。该模型指向 ChatGPT 当前使用的 GPT-5.3 Instant 快照。请在此了解详情。
2026年2月
扩展了 Responses API 中 input_file 的支持范围,可接受更多类型的文档、演示文稿、电子表格、代码和文本文件。请在此了解详情。
在 Responses API 中发布了 phase。它将助手消息标记为中间说明(commentary)或最终答案(final_answer)。请在此了解详情。
在 Responses API 中发布了 gpt-5.3-codex。请在此了解详情。
为 Responses API 推出了 WebSocket 模式。请在此了解详情。
在 Realtime API 中发布了 GPT-Realtime-1.5。
在 Chat Completions API 中发布了 gpt-audio-1.5。请在此了解详情。
Batch API 现已支持以下 GPT Image 模型:gpt-image-1.5、chatgpt-image-latest、gpt-image-1 和 gpt-image-1-mini。
更新了 gpt-5.2-chat-latest Slug,使其指向 ChatGPT 当前使用的最新模型。
在 Responses API 中推出了服务端压缩。
在 Responses API 中推出了对技能的支持。本地执行和基于托管容器的执行均支持技能。
推出了新的托管式 Shell 工具,并新增了对容器内联网的支持。
为 GPT 图像模型新增了在 /v1/images/edits 上使用 application/json 请求的支持。JSON 请求使用 images(以及可选的 mask),通过 image_url 或 file_id 引用图像,而不使用 multipart 上传。
我们为 API 客户优化了推理技术栈,GPT-5.2 和 GPT-5.2-Codex 的运行速度现在提升了约 40%。模型及模型权重均未改变。
2026年1月
宣布推出 Open Responses:这是一项基于原版 OpenAI Responses API 的开源规范,用于构建支持多家提供商且可互操作的 LLM 接口。
在 Responses API 中发布了 gpt-5.2-codex。GPT-5.2-Codex 是 GPT-5.2 的一个版本,针对 Codex 或类似环境中的智能体编程任务进行了优化。请在此了解详情。
为 Realtime API 新增了专用 SIP IP 地址范围。sip.api.openai.com 使用 GeoIP 路由,会将 SIP 流量定向到最近的区域。了解详情。
更新了 gpt-realtime-mini 和 gpt-audio-mini Slug,使其指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-realtime-mini-2025-10-06 和 gpt-audio-mini-2025-10-06。
更新了 sora-2 Slug,使其指向 sora-2-2025-12-08。如果您需要之前的模型快照,请使用 sora-2-2025-10-06。
更新了 gpt-4o-mini-tts 和 gpt-4o-mini-transcribe Slug,使其指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-4o-mini-tts-2025-03-20 和 gpt-4o-mini-transcribe-2025-03-20。为了获得最佳效果,我们目前建议优先使用 gpt-4o-mini-transcribe,而非 gpt-4o-transcribe。
修复了以下问题:gpt-image-1.5 和 chatgpt-image-latest 通过 /v1/images/edits 编辑图像时,即使已将 fidelity 显式设置为 low(默认值),仍会错误地使用高保真度。
2025年12月
为 Responses API 的图像生成工具新增了 gpt-image-1.5 和 chatgpt-image-latest。
发布了 gpt-image-1.5 和 chatgpt-image-latest,这是我们最新、最先进的图像生成模型。请在此了解详情。
发布了 GPT-5.2,这是 GPT-5 模型家族中的最新旗舰模型。与之前的 GPT-5.1 相比,GPT-5.2 在以下方面有所提升:
- 通用智能
- 指令遵循
- 准确性和 Token 使用效率
- 多模态能力,尤其是视觉能力
- 代码生成,尤其是前端 UI 创建
- API 中的工具调用和上下文管理
- 电子表格的理解与创建。
5.2 的新功能包括新增的 xhigh 推理强度级别、简洁的推理摘要,以及利用压缩进行上下文管理的新方式。
推出了客户端压缩。对于使用 Responses API 的长时间对话,您可以使用 /responses/compact 端点来缩减每轮发送的上下文。
在 Responses API 中发布了 gpt-5.1-codex-max。GPT-5.1-Codex 是我们最智能的编程模型,针对长时间跨度的智能体编程任务进行了优化。点击此处了解更多。
2025年11月
Realtime API 新增了对 DTMF 按键的支持。现在,您可以在使用 Realtime 带外连接时接收 DTMF 事件。有关更多信息,请参阅此处的文档。
发布了 GPT-5.1,这是 GPT-5 模型系列的最新旗舰模型。GPT-5.1 经过训练,在以下方面尤为出色:
- 可引导性,以及在无需太多思考时更快地响应
- 代码生成与编程使用场景
- 智能体工作流
请注意,GPT-5.1 默认采用新的 none 推理设置,以便在无需太多思考时更快地响应,这与 GPT-5 之前默认采用的 medium 设置不同。
推出了增强的基于角色的访问控制(RBAC)。基于角色的访问控制(RBAC)让您能够决定组织和项目中的哪些人可以执行哪些操作,涵盖 API 和控制台两种使用方式。
在 Responses API 中发布了 gpt-5.1-codex 和 gpt-5.1-codex-mini。GPT-5.1-Codex 是 GPT-5.1 的一个版本,针对 Codex 或类似环境中的智能体编程任务进行了优化。点击此处了解更多。
推出了延长提示缓存保留时间的功能。此功能可让缓存的前缀保持有效更长时间,最长可达 24 小时。延长提示缓存通过在内存已满时将键/值张量卸载到 GPU 本地存储来实现,从而大幅增加可用于缓存的存储容量。
2025年10月
gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 是基于 gpt-oss 构建的安全推理模型。点击此处了解更多。
推出了企业密钥管理(EKM)。企业密钥管理(EKM)让您可以使用自己的外部密钥管理系统(KMS)所管理的密钥,对您在 OpenAI 的客户内容进行加密。
推出了英国数据驻留。
在 OpenAI DevDay 上发布了多项新功能:
发布了 GPT-5 Pro,这是 GPT-5 的一个版本,使用更多计算资源进行更深入的思考,并持续提供更好的答案。
发布了 GPT-Realtime mini 和 gpt-audio-mini,以更低的成本提供语音到语音能力。
发布了 gpt-image-1-mini,以更低的成本生成和编辑图像。
推出了 v1/videos,通过我们最新的 Sora 2 和 Sora 2 Pro 模型生成和再创作内容丰富、细节细腻且富有动感的视频。
推出了智能体构建器,用于以可视化方式创建自定义多智能体工作流。
推出了 ChatKit,这是一个用于部署智能体的可嵌入聊天界面。
推出了追踪评测、数据集和提示优化工具。
评测:新增了对第三方模型的支持。
推出了服务健康状况控制台。
推出了 IP 允许列表。IP 允许列表将 API 访问限制为仅允许您指定的 IP 地址或地址范围。
2025年9月
Responses API 新增了将图像和文件作为工具调用输出的支持。
推出了专用模型 gpt-5-codex,专为配合 Codex CLI 使用而构建和优化。
2025年8月
OpenAI Realtime API 现已正式推出。请参阅我们的 Realtime API 指南了解更多。
Responses API 新增了对连接器的支持。连接器是由 OpenAI 维护的 MCP 封装,面向 Google 应用、Dropbox 等常用服务,可用于让模型读取这些服务中存储的数据。
发布了 Conversations API,让您能够配合 Responses API 创建和管理长时间对话。请参阅迁移指南,查看并排对比,并了解如何将 Assistants API 集成迁移到 Responses 和 Conversations。
在 API 中发布了 GPT-5 模型系列,包括 gpt-5、gpt-5-mini 和 gpt-5-nano。
新增了推理强度值 minimal,用于优化 GPT-5 模型(支持推理)的响应速度。
新增了 custom 工具调用类型,允许在工具调用时以自由格式向模型提供输入并接收模型输出。
2025年6月
新增了对优先处理的支持。与标准处理相比,优先处理的延迟显著更低且更稳定,同时保留了按量付费的灵活性。
发布了 o3-deep-research 和 o4-mini-deep-research,它们是我们 o 系列推理模型的深度研究版本,针对深入分析和研究任务进行了优化。请参阅深度研究指南了解更多。
新增了通过 Webhook 处理异步事件的支持。网页搜索工具的价格已下调,定价方式也已简化。新增了对网页搜索工具的支持。
控制台和 Responses API 现已支持新的可复用提示。现在,您可以在 API 中通过 prompt 参数(包含提示的 id 和可选的 version)引用在控制台中创建的模板,并提供可包含字符串、图像或文件输入的动态 variables。Chat Completions 不支持可复用提示。了解更多。
发布了 o3-pro,这是 o3 推理模型的一个版本,使用更多计算资源,以更好的推理能力和一致性解答复杂问题。所有 API 请求的 o3 模型价格也已下调,包括批处理和弹性处理。
新增了对 gpt-4.1-2025-04-14、gpt-4.1-mini-2025-04-14 和 gpt-4.1-nano-2025-04-14 模型使用直接偏好优化进行微调的支持。
gpt-4o-audio-preview 和 gpt-4o-realtime-preview 的新模型快照现已可用。发布了 TypeScript 版 Agents SDK。
2025年5月
Responses API 新增了对内置工具的支持,包括远程 MCP 服务器和代码解释器。了解有关工具的更多信息。
使用未经微调的模型进行并行工具调用时,现已支持对工具模式使用 strict 模式。
新增了模式功能,包括针对 email 等格式的字符串验证,以及为数字和数组指定范围。
在 API 中推出了 codex-mini-latest,针对配合 Codex CLI 使用进行了优化。
新增了对强化微调的支持。了解可用的微调方法。gpt-4.1-nano 现已支持微调。
2025年4月
新增了对增强的 API 预算提醒和自动充值限额的支持。
新增了图像生成模型 gpt-image-1。该模型提升了图像质量和指令遵循能力,为图像生成树立了新标准。
更新了图像生成和编辑端点,以支持 gpt-image-1 模型专用的新参数。
新增了两个 o 系列推理模型:o3 和 o4-mini。它们在数学、科学、编程、视觉推理任务和技术写作方面树立了新标准。
推出了 Codex,这是我们的代码生成 CLI 工具。
在 API 中新增了 gpt-4.1、gpt-4.1-mini 和 gpt-4.1-nano 模型。这些新模型提升了指令遵循和编程能力,并提供了更大的上下文窗口(最高 100 万 Token)。gpt-4.1 和 gpt-4.1-mini 支持监督微调。宣布弃用 gpt-4.5-preview。
2025年3月
在 Audio API 中新增了 gpt-4o-mini-tts、gpt-4o-transcribe、gpt-4o-mini-transcribe 和 whisper-1 模型。
发布了面向智能体工作流的多个新模型、新工具以及一个新 API:
- 发布了 Responses API,这是一个用于创建和使用智能体与工具的新 API。
- 为 Responses API 推出了一组内置工具:网页搜索、文件搜索和计算机使用。
- 发布了 Agents SDK,这是一个用于设计、构建和部署智能体的编排框架。
- 宣布推出新模型:
gpt-4o-search-preview、gpt-4o-mini-search-preview、computer-use-preview。 - 宣布计划将 Assistants API 的所有功能引入更易用的 Responses API,预计在 2026 年停止提供 Assistants(在实现完全相同的功能之后)。
微调作业新增了对 metadata 字段的支持。
2025年2月
发布了 GPT-4.5 的研究预览版,这是我们迄今为止规模最大、能力最强的聊天模型。GPT-4.5 的高“情商”和对用户意图的理解,使其在创意任务和智能体规划方面表现更好。
推出了 API 用量仪表板更新。此次更新响应了用户对更多数据筛选功能的需求,新增了项目选择、日期选择器和更精细的时间间隔等功能,同时改进了跨产品和服务层级查看用量的体验。
推出欧洲数据驻留功能。请在此了解更多信息。
2025年1月
推出了 o3-mini,这是一款针对科学、数学和编程任务优化的新型小型推理模型。
扩大了 o1 模型的开放范围。o1 系列模型通过强化学习训练,能够执行复杂推理。
2024年12月
推出了管理 API 密钥轮换功能,客户可以通过编程方式轮换管理 API 密钥。
更新了管理 API 邀请功能,客户可以通过编程方式在邀请用户加入组织的同时,邀请他们加入项目。
新增了 o1、gpt-4o-realtime、gpt-4o-audio 及更多新模型。
为 Realtime API 新增了 WebRTC 连接方式。
为 o1 模型新增了 reasoning_effort 参数。
为 o1 模型新增了 developer 消息角色。请注意,o1-preview 和 o1-mini 不支持 system 或 developer 消息。
推出了使用直接偏好优化(DPO)的偏好微调功能。
推出了 Go 和 Java SDK 的测试版。了解更多。
在 Python SDK 中新增了对 Realtime API 的支持。
推出了 Usage API,客户可以通过编程方式查询各项 OpenAI API 的使用活动和支出。
2024年11月
发布了 gpt-4o-2024-11-20,这是 gpt-4o 系列的最新模型。
推出了预测输出功能。如果模型回复的大部分内容已预先确定,此功能可大幅降低回复延迟。这种情况最常见于重新生成仅有少量修改的文档和代码文件内容。
2024年10月
在 Realtime API 和 Chat Completions API 中新增了五种声音。
为 Chat Completions 发布了新的 gpt-4o-audio-preview 模型,支持音频输入和输出。它与 Realtime API 使用相同的底层模型。
在旧金山举办的 OpenAI DevDay 上发布了多项新功能:
Realtime API:使用 WebSockets 接口,在您的应用中构建快速的语音到语音体验。
模型蒸馏:提供一个平台,让您使用大型前沿模型的输出微调经济高效的模型。
图像微调:使用图像和文本微调 GPT-4o,以提升视觉能力。
评测:创建并运行自定义评估,以衡量模型在特定任务上的表现。
提示缓存:对于近期处理过的输入 Token,提供价格折扣和更快的处理速度。
在 Playground 中生成:使用 Playground 中的“生成”按钮,轻松生成提示、函数定义和结构化输出模式。
2024年9月
发布了新的 omni-moderation-latest 内容审核模型,支持图像和文本(部分分类),新增两个仅针对文本的有害内容分类,并提供更准确的评分。
发布了 o1-preview 和 o1-mini,这两款新型大语言模型通过强化学习训练,能够执行复杂推理任务。
2024年8月
Assistants API 现已支持包含文件搜索工具使用的文件搜索结果,以及自定义排序行为。
gpt-4o-2024-08-06 微调功能正式发布,所有 API 用户现在都可以微调最新的 GPT-4o 模型。
发布了动态模型 chatgpt-4o-latest,该模型将指向 ChatGPT 使用的最新 GPT-4o 模型。
推出了结构化输出,模型输出现在能够可靠地遵循开发者提供的 JSON 模式。
发布了 gpt-4o-2024-08-06,这是 gpt-4o 系列的最新模型。
推出了管理 API 和审计日志 API,客户可以通过编程方式管理组织,并使用审计日志监控变更。必须在设置中启用审计日志记录。
2024年7月
推出了自助 SSO 配置,采用自定义计费和无限额计费的企业客户可以使用所选的 IDP 设置身份验证。
推出了 GPT-4o mini 微调功能,可进一步提升模型在特定使用场景中的表现。
发布了 GPT-4o mini,这是一款价格实惠、智能的小型模型,适用于快速、轻量的任务。
推出了 Uploads,用于分段上传大文件。
2024年5月
在 API 中发布了 GPT-4o。GPT-4o 是我们速度最快、价格最实惠的旗舰模型。
新增了对在 Batch API 中使用微调模型的支持。
为 Chat Completions 和 Completions API 新增了 stream_options: {"include_usage": true} 参数。设置此参数后,开发者可以在使用流式传输时获取用量统计信息。
为 Assistants API 新增了一个端点,用于从线程中删除消息。
2024年4月
为 Chat Completions 和 Assistants API 新增了函数调用选项 tool_choice: "required"。
新增了 Batch API 指南,并在 Batch API 中新增了对嵌入向量模型的支持。
推出了 Assistants API 的一系列更新,包括每个助手最多支持 10,000 个文件的新文件搜索工具、新的 Token 控制功能,以及对工具选择的支持。
发布了 Batch API。
在 API 中正式发布了 GPT-4 Turbo with Vision。
在 Assistants API 中新增了对按 run_id 筛选消息的支持。
2024年1月
发布了嵌入向量 V3 模型和更新版 GPT-4 Turbo 预览模型。
为 Embeddings API 新增了 dimensions 参数。
2023年12月
为 Assistants API 的运行创建功能新增了 additional_instructions 参数。
Chat Completions API 新增了 logprobs 和 top_logprobs 参数。
已将工具调用中的函数参数设为可选。
2023年11月
发布了 OpenAI Deno SDK。
发布了 GPT-4 Turbo Preview、更新版 GPT-3.5 Turbo、GPT-4 Turbo with Vision、Assistants API、API 中的 DALL·E 3 和文本转语音 API。
已弃用 Chat Completions 的 functions 参数,改用 tools。