OpenAI GPT-5.4
使用本指南,在生产环境中安全采用openai/gpt-5.4。
GPT-5.4 的重点不在于全新的请求格式,而在于更新推理控制、视觉处理和工具使用。截至 2026 年 3 月 10 日,OpenAI 官方文档重点介绍 reasoning.effort、改进的计算机操作和更高保真度的图像输入。文档未提及 GPT-5.4 专属的 phase 参数。
迁移快速入门
- 将模型 ID 改为
openai/gpt-5.4,其余请求保持不变。 - 选择并测试符合该路由延迟预算的推理强度。
- 根据需要重新测试视觉、结构化输出和计算机操作工作流。
- 灰度试用 GPT-5.4,并保留旧路由作为回退。
新功能
reasoning.effort支持none、low、medium、high和xhigh。- GPT-5.4 新增
original图像细节级别,可实现高保真视觉感知。 - 更新后的
computer工具是 GPT-5.4 计算机操作工作流的官方路径。 - GPT-5.4 改进了长周期工具使用、大上下文任务和专业文档工作流。
集成需要调整的内容
1. 检查推理设置
如果从 GPT-4.1 或更早的 GPT-5 版本迁移,不要假设以前的默认值仍然合适。请根据路由的延迟预算重新测试相应强度:- 低延迟路由使用
none或low。 - 大多数结构化任务使用
medium或high。 - 深度推理或代理工作流使用
xhigh。
2. 检查视觉处理流程
如果工作流依赖密集截图、文档或 UI 本地化,请测试新的original 图像细节级别。它会同时影响保真度和成本。
3. 重新检查计算机操作路由
如果要迁移浏览器或桌面自动化任务,请更新到当前computer 工具路径,并端到端重新测试步骤完成情况。
测试内容
提示词兼容性
- 长系统提示词
- 提取和分类提示词
- 对格式敏感的输出
- 以前需要重试才能保持任务方向的提示词
工具和结构化输出
- 各强度级别下的 Schema 遵循情况
- 工具选择质量
- 参数完整性
- 多步骤计算机操作工作流的稳定性
视觉和运维
- 使用
high与original细节级别理解截图和文档 - 真实负载下的延迟和 token 用量
- 重试率和超时率
- 与被替换模型相比,每个成功任务的成本
安全发布
- 使用计划采用的具体强度级别评估 GPT-5.4。
- 如果使用图像,请单独测试
original,因为它会改变质量和成本。 - 更改默认路由前,对生产提示词进行影子测试。
- 逐步增加流量,并保留旧版 OpenAI 模型或其他提供商作为回退。