For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航

安全分类器

了解安全分类器,并应对 API 访问限制。

随着 GPT-5 的推出,我们新增了一些检查,用于识别并阻止对危险信息的访问。一些用户可能迟早会尝试使用您的应用进行违反 OpenAI 政策的活动,尤其是在支持多种使用场景的应用中。

安全分类器的工作流程

  1. 我们按风险阈值对发往 GPT-5 的请求进行分类。
  2. 如果您的组织反复触及高风险阈值,OpenAI 会返回错误并发送警告邮件。
  3. 如果此类请求在规定时限(通常为七天)过后仍然持续,我们将停止您的组织对 GPT-5 的访问。请求将不再有效。

如何避免错误、延迟和封禁

如果您的组织存在违反我们安全政策的可疑活动,我们可能会返回错误、限制模型访问,甚至封禁您的账户。以下安全措施有助于我们识别高风险请求的来源,并封禁个别最终用户,而非您的整个组织。

  • 对于允许各个用户与模型交互的产品,请实施安全标识符。我们建议使用安全标识符,但并不强制要求。
  • 如果您的使用场景需要访问限制较少的服务版本,以开展生命科学领域的有益应用,请了解我们的特殊访问计划,确认您是否符合条件。

为各个用户实施安全标识符

Responses API 和较早的 Chat Completions API 均支持 safety_identifier 参数。Realtime API 通过 OpenAI-Safety-Identifier 请求头支持相同的机制。要使用安全标识符,请在每次请求中为最终用户提供一个稳定的 ID。请对用户邮箱地址或内部用户 ID 进行哈希处理,以避免传递任何个人信息。

安全标识符不会在不同 API 或会话之间自动沿用。如果您的应用已在 Responses API 请求中发送 safety_identifier,请在创建或连接每个 Realtime 会话时,单独传入相同的稳定值。

在 Responses API 中提供安全标识符
import OpenAI from "openai";

const client = new OpenAI();

const response = await client.responses.create({
  model: "gpt-5.6-terra",
  input: "This is a test",
  safety_identifier: "user_123456",
});

console.log(response.output_text);

可能的后果

如果 OpenAI 的监控系统识别出潜在滥用,我们可能会采取不同程度的措施:

  • 延迟流式响应
    • 对于可能违反政策的用户,OpenAI 可能先采取影响较小的干预措施:在向该用户返回完整响应之前,执行额外检查,并在检查期间延迟流式响应。
    • 如果检查通过,流式传输就会开始。如果检查未通过,请求将停止,不会显示任何 Token,也不会开始流式响应。
    • 为了改善最终用户体验,您可以考虑在流式传输延迟时显示加载动画。
  • 阻止个别用户访问模型
    • 如果以高置信度判定存在违反政策的行为,相关的 safety_identifier 将被完全禁止访问 OpenAI 模型。
    • 此后,使用同一安全标识符的所有 GPT-5 请求都会收到 identifier blocked 错误。OpenAI 目前无法解除对单个标识符的封禁。

为确保这些封禁措施有效,请采取管控措施,防止被封禁的用户注册新账户。请注意,您的组织如果反复违反政策,可能导致整个组织失去访问权限。

我们为何这样做

具体执行标准可能会随着实际使用情况的变化或新模型的发布而调整。目前,对于涉及高风险或可疑生物学或化学活动的安全标识符,OpenAI 可能会限制或阻止其访问。请参阅这篇博客文章,进一步了解我们如何应对 AI 在生物学领域日益增强的能力。

其他类型的安全检查

有关针对工具和模型自定义的安全措施,请参阅计算机使用的确认与同意微调安全。OpenAI 还会在模型评估中心发布结果。