Skip to main content

OpenAI GPT-5.4

使用本指南,在生产环境中安全采用 openai/gpt-5.4。 GPT-5.4 的重点不在于全新的请求格式,而在于更新推理控制、视觉处理和工具使用。截至 2026 年 3 月 10 日,OpenAI 官方文档重点介绍 reasoning.effort、改进的计算机操作和更高保真度的图像输入。文档未提及 GPT-5.4 专属的 phase 参数。

迁移快速入门

  1. 将模型 ID 改为 openai/gpt-5.4,其余请求保持不变。
  2. 选择并测试符合该路由延迟预算的推理强度。
  3. 根据需要重新测试视觉、结构化输出和计算机操作工作流。
  4. 灰度试用 GPT-5.4,并保留旧路由作为回退。

新功能

  • reasoning.effort 支持 none、low、medium、high 和 xhigh。
  • GPT-5.4 新增 original 图像细节级别,可实现高保真视觉感知。
  • 更新后的 computer 工具是 GPT-5.4 计算机操作工作流的官方路径。
  • GPT-5.4 改进了长周期工具使用、大上下文任务和专业文档工作流。

集成需要调整的内容

1. 检查推理设置

如果从 GPT-4.1 或更早的 GPT-5 版本迁移,不要假设以前的默认值仍然合适。请根据路由的延迟预算重新测试相应强度:
  • 低延迟路由使用 none 或 low。
  • 大多数结构化任务使用 medium 或 high。
  • 深度推理或代理工作流使用 xhigh。

2. 检查视觉处理流程

如果工作流依赖密集截图、文档或 UI 本地化,请测试新的 original 图像细节级别。它会同时影响保真度和成本。

3. 重新检查计算机操作路由

如果要迁移浏览器或桌面自动化任务,请更新到当前 computer 工具路径,并端到端重新测试步骤完成情况。

测试内容

提示词兼容性

  • 长系统提示词
  • 提取和分类提示词
  • 对格式敏感的输出
  • 以前需要重试才能保持任务方向的提示词

工具和结构化输出

  • 各强度级别下的 Schema 遵循情况
  • 工具选择质量
  • 参数完整性
  • 多步骤计算机操作工作流的稳定性

视觉和运维

  • 使用 high 与 original 细节级别理解截图和文档
  • 真实负载下的延迟和 token 用量
  • 重试率和超时率
  • 与被替换模型相比,每个成功任务的成本

安全发布

  1. 使用计划采用的具体强度级别评估 GPT-5.4。
  2. 如果使用图像,请单独测试 original,因为它会改变质量和成本。
  3. 更改默认路由前,对生产提示词进行影子测试。
  4. 逐步增加流量,并保留旧版 OpenAI 模型或其他提供商作为回退。

来源

最后修改于 2026年10月2日